局势已经逆转。2023年初,谷歌发出了一份”红色代码”:为应对ChatGPT的突然主导地位而匆忙做出响应。快进到2025年12月,警报声响起的地方是旧金山,而不是山景城。
在谷歌Gemini 3发布后,该产品从MMLU-Pro到HumanEval-X已经决定性地在所有主要人工智能基准上名列前茅。据报道,OpenAI首席执行官萨姆·阿尔特曼宣布了他自己的内部”红色代码”。该命令是什么?放弃一切与ChatGPT生存不相关的项目。
据传12月9日发布,GPT-5.2究竟包含什么?为什么Gemini 3会对OpenAI内部造成如此立即的警报?这次深度分析将探索硅芯片、软件和战略,这些正在定义人工智能历史上这一关键时刻。
紧急按钮:为什么是现在?
行业消息来源和分析师报告证实的泄露信息描绘了OpenAI内部的混乱局面。曾经是路线图宠儿的项目——购物代理、健康顾问和复杂的语音模式——都已暂停。该指令很简单:修复ChatGPT。
具体来说,“红色代码”关注Gemini 3推出以来识别的四个关键失败:
- 速度:减少推理模型令人痛苦的延迟。当Gemini 3立即回答时,用户不再愿意等待10秒钟来获取一个”思考”标记。
- 可靠性:消除仍然困扰GPT-5.1的幻觉。
- 个性化:最终实现一个”了解”你的模型的承诺,这是谷歌深度整合到Android 16中的一个特性。
- 答案质量:从Gemini 3重新夺取对复杂、多步骤查询的控制权。
这个激进的转变表明,Gemini 3不仅击败了ChatGPT,而且使其某些部分过时了。当竞争对手的模型既快又聪明时,“足够好”就不再是一个商业模式了。
技术深度探索:架构差距
为什么OpenAI用点版本(GPT-5.2)而不是革命性的GPT-6匆忙推出?答案在于架构差距。
原生多模态 vs. 拼凑方案
Gemini 3的核心优势是其原生多模态。谷歌从零开始同时在文本、图像、视频和音频上训练该模型。这允许进行GPT-4.5和GPT-5.0根本无法匹配的”跨模态推理”。
- Gemini 3:看到一段漏水管的视频,并同时理解流体动力学和滴水的声音来诊断压力问题。
- GPT-5.x:可能仍然依赖于”弗兰肯斯坦”方法:将视觉编码器(如VIP-L)缝合到文本转换器。这会引入延迟和模式之间的”转换损失”。
OpenAI的”红色代码”可能涉及试图在GPT-6在2026年末准备好之前,将这种原生流畅性黑客入他们现有的架构中。他们正在尝试优化一个解耦的系统来与统一的系统竞争。
计算瓶颈:TPU v6 vs. GPU集群
谷歌的优势在于垂直整合。他们拥有芯片(TPU v6 Trillium)、云(GCP)和数据(搜索/YouTube)。OpenAI仍然受到微软Azure分配和NVIDIA GPU供应链的束缚。
在2025年,互连墙被触及。训练运行不再受每个芯片的FLOP限制,而是受芯片通信速度的限制。
- 谷歌的TPU Pods:使用光学互连(ICI)设计,允许数万个芯片充当一个单一的超级计算机,几乎没有延迟损失。
- OpenAI的NVIDIA集群:虽然强大,但InfiniBand网络复杂性随着扩展到100k+ H100而呈指数级增长。
在”红色代码”情景中,这个硬件差异至关重要。OpenAI必须优化软件以从现有集群中挤出性能。谷歌可以简单地向问题投入更多硬件,因为他们拥有代工厂分配。要理解GPT-5.2的紧迫性,首先必须量化威胁。上周,谷歌悄悄发布了Gemini 3,基准数据在业界引发了冲击波。与之前谷歌声称小幅领先不同,Gemini 3展示了在两个关键领域的决定性优势:代理推理和上下文长期规划。谷歌的”Project Astra”已经有效地将Android手机转变为实时代理。它可以浏览网络、预订航班和管理应用程序,无需用户干预。
OpenAI对此的回应应该是**“Operator”。 传闻于2024年末发布,然后是2025年中期,“Operator”实际上是失踪(MIA)。“红色代码”暂停表明”Operator”不仅仅被延迟,而且可能被破坏**。
“沙箱”问题
在沙箱中构建工作的代理(受控浏览器)很容易。在用户混乱、混乱的笔记本上构建工作的代理很难。谷歌通过拥有操作系统(Android/Chrome)解决了这个问题。他们拥有深层系统级别的挂钩。 OpenAI没有操作系统。他们试图在Windows和MacOS之上将”Operator”构建为应用程序层,与权限、安全沙箱和用户界面更改作斗争。
- 代码红色影响:OpenAI可能意识到,没有操作系统,他们无法赢得代理战争。他们正在转向他们控制的一件事:聊天机器人。
背景历史:伟大逆转
在这一刻,无法忽视讽刺。
- 2022年(谷歌的代码红色):谷歌惊恐了。ChatGPT推出,Sundar Pichai意识到搜索受到了威胁。结果是草率、拙劣的Bard推出,它在自己的演示中产生幻觉。谷歌看起来很绝望、毫无准备且公司化。
- 2025年(OpenAI的代码红色):现在OpenAI是惊恐的。他们正在废弃路线图、暂停长期研究,并在假期前匆忙发布。
这一次的区别在于护城河。当谷歌在Bard中跌倒时,他们有近乎垄断的搜索、YouTube和Android作为后盾。他们可以承受在人工智能中名列第二,因为他们拥有分布。 OpenAI没有这样的奢侈。如果他们失去”最聪明的模型”皇冠,他们就失去了他们的主要价值主张。他们没有搜索引擎(SearchGPT除外)、浏览器或移动操作系统。他们只有模型智能。如果这种智能是二流的,他们的估值就会崩溃。
前瞻性分析:他们会让人眼花缭乱还是会失败?
OpenAI在12月9日面临的风险是巨大的。如果GPT-5.2只是”更快且稍微更可靠”,它将确认谷歌已经赢得2025年周期的叙事。
要让人眼花缭乱,GPT-5.2需要一个”魔法”时刻:类似于世界第一次看到Sora或GPT-4的事物。它需要做Gemini 3不能做的事情。
- 可能性1:推理速度。如果他们能让”o1”推理模型以实时速度运行(低于200毫秒延迟),这对语音模式改变游戏。
- 可能性2:内存。真正的、无限的上下文窗口,完美地记住你曾经进行过的每一次对话。
要失败,他们只需要满足预期。在目前的炒作周期中,满足预期就是失败。如果GPT-5.2只是一个”更好的GPT-5.1”,叙事就会转变。开发人员将转向Gemini的API以获得更低的成本和更高的限制。企业将转向Gemini以获得Google Workspace集成。
如果信誉的”代码红色”谣言是真的,OpenAI比任何人都更了解这一点。他们不再为市场份额而战;三年来第一次,他们正在为人工智能生态系统中顶级捕食者的生存而战。
资料来源 (3)
- 9to5mac.com Next ChatGPT Upgrade Imminent Following Code Red
- youtube.com OpenAI Declares Code Red Response to Gemini 3
- deepmind.google Google Gemini 3 Technical Report
🦋 Bluesky 讨论
在 Bluesky 上讨论