谷歌于2026年9月30日正式发布Gemini 4 Argon人工智能模型,该模型专为软件开发、研究、网络安全及企业自动化等长周期与复杂任务设计。
Gemini 4 Argon最显著的提升在于其输出能力上限从以往的6.4万提升至最高100万Token。这一突破使模型能够在单一任务中持续工作更长时间,尤其适用于生成大量代码或执行多步骤推理的场景。
在软件工程领域,该模型在DeepSWE v1.1基准测试中取得77.9%的成绩,高于Claude Opus 5.5的74.2%与GPT-6 Astra的74.1%。目前模型已在谷歌内部投入使用,多个智能体已协助识别出可节省超300 TiB内存的数据中心优化方案。谷歌利用该模型完成了超80万行代码的C/C++向Rust迁移,并在libgav1视频解码器项目中将约3.2万行SIMD代码替换为Rust实现,运行速度提升2.7倍。


网络安全是该模型的另一重点方向。Gemini 4 Argon在CWE-bench v1基准测试(侧重漏洞识别与修复)中达到68%的得分。现阶段谷歌仅向受信任的测试人员与专业人士开放相关功能,并加强了针对间接提示词注入及高风险用途的防护机制。该模型正接受额外的网络安全以及化学、生物、放射性和核领域风险评估。
已于9月底公布,但Gemini 4 Argon目前仍处于逐步部署阶段,计划优先面向Google AI Ultra订阅用户及付费API使用者开放。官方公布的启动期具体定价尚未完整披露,但明确过渡期结束后价格将分别调整为4美元和20美元,缓存输入可享受95%的费用减免。
百万级输出Token赋予了模型处理超长代码、文档或自动化任务的巨大空间,但这并不直接等同于质量优势。核心挑战在于模型能否在连续多步操作中保持可靠性。谷歌旨在将其定位为能够长期执行复杂工作的底层模型,而非普通聊天机器人。最终表现仍需等待独立第三方测试与现有主流模型的对比验证。
