
当地时间2026年9月30日,谷歌推出新模型Gemini 4 Argon。图:视觉中国
【财新网】继OpenAI和Anthropic发布新代际的旗舰模型后,谷歌也发布新一代模型。当地时间9月30日,谷歌推出新模型 Gemini 4 Argon,称能在复杂、长周期工作流中持续进行深度推理。
目前,该模型只向一批“可信赖的”网络安全防御人员开放。谷歌解释称,需分阶段发布高水平的模型能力。谷歌自愿和美国政府协调沟通,逐步扩大模型的适用范围。谷歌称,将继续收集早期测试者的反馈,在不断完善安全防护措施后,尽快向开发者、企业和消费者提供Gemini 4 Argon。
Gemini 4 Argon强调模型的安全性。在谷歌的“灰天鹅IPI”测试中,黑客攻击对Gemini 4 Argon成功率最低,为0.7%,其后依次为Claude Opus 5.5和Claude Fable 5.1,均为1%;Claude Opus 5为4.6%; GPT-6 Astra为8.5%;Meta的Muse Spark 1.3为15.9%;智谱的最新模型 GLM 5.3为31.5%;马斯克SpaceX的Grok 4.6模型为51.8%;而月之暗面的Kimi K3最高,为52.7%。
美国近期呼吁“放慢AI速度”。Anthropic创始人及CEO达里奥·阿莫代伊(Dario Amodei)在9月12日称, AI自我改进速度加快,“若缺乏有效约束,发展速度可能超出我们理解和控制这些系统的能力”。此后美国政界和商界就此话题展开了激烈讨论,但谷歌并未深度加入“战局”。(详见《Anthropic:AI“吹哨人”背后》)
谷歌展示了Gemini 4 Argon的一些用例。该模型已经用于谷歌内部工作流,用于专业编程任务、深度研究和高质量写作;Argon正帮助谷歌量子计算研究人员优化量子算法,在某个案例中,仅用几分钟就将已发表的基准结果提升了40%;Argon自主识别并优化了谷歌数据中心的内存,释放了超过300TiB内存,预计总计可节省500TiB至1PiB内存;Argon智能体正在协助数据迁移,将谷歌的C/C++代码库迁移至Rust。
谷歌放出的榜单中,相比OpenAI的GPT-6 Astra,以及Anthropic的Claude Fable 5.1和Claude Opus 5.5等最新模型,Gemini 4 Argon的多模态理解、长上下文和知识类工作能力更强,而在智能体(agent)编程能力上和对手平分秋色。
在第三方AI榜单Artificial Analysis上,Gemini 4 Argon和GPT-6 Astra并列第三,而Claude Opus 5.5和Claude Fable 5.1分别为前两名。
Argon开打价格战,初始价格为每百万输入词符(token )2美元、每百万输出词符10美元。相比之下,GPT-6 Astra按每百万 (1M) Token 计费,输入10美元,输出50美元;Claude Opus 5.5输入和输出价格分别为每百万个token 4美元和20美元。
即便呼吁放缓AI,但9月以来,硅谷各家大模型公司仍纷纷发布新一代模型。9月3日,OpenAI发布新模型GPT‑6 Astra,称为“全球最智能、最符合对齐要求”的模型。(详见《OpenAI推出新模型GPT‑6 Astra API提价》)9月23日凌晨,美国AI大模型公司Anthropic发布新模型Claude Opus 5.5,是全新Claude 5.5系列的首款模型。(详见《Anthropic推新模型Claude Opus 5.5 大幅降低综合成本》)
自2026年6月以来,谷歌的模型能力逐渐在激烈的竞争中掉队,新模型也原本在5月谷歌大会上提到6月会发布Gemini 3.5 Pro,但到6月却未发布,此后在8月中旬发布了Gemini 3.7 Flash,在能力上并不出众。
谷歌的大模型研究机构DeepMind还经历了高层变动。8月5日, DeepMind的CEO德米斯·哈萨比斯(Demis Hassabis)卸任,转任DeepMind董事长及谷歌母公司Alphabet的首席科学家。DeepMind首席技术官及谷歌首席AI架构师科雷·卡武克丘奥卢(Koray Kavukcuoglu)晋升为谷歌DeepMind高级副总裁。(详见《谷歌DeepMind CEO哈萨比斯卸任 转任DeepMind董事长及谷歌首席科学家》)