谷歌最前沿AI模型:Gemini 4 Argon登场,长周期代码工程测试超Opus 5.5

发布时间:2026-10-01 07:33

  定位方面,Gemini 4 Argon 是谷歌当前“最先进”模型,重点是长流程软件工程、企业知识工作和网络安全防御。官方称其在真实世界软件工程测试创纪录,网络安全基准并列第一,并在金融、法律等专业任务基准领先。

  模型特性方面,Gemini 4 Argon 单次输出上限达到约 100 万 tokens,高于此前的 64,000 tokens,适合处理大型代码库、长文档和多阶段任务。

  在新模型在某些编码和知识工作基准测试中处于最先进水平,在多个方面都优于竞争对手 OpenAI 的前沿模型 GPT-6 Astra。

  安全防御性能方面,谷歌对 Gemini 4 Argon 进行了训练,使其“在网络安全防御方面能力超群”,比 3.8 Flash Cyber 有了显著提升。在评估模型修复安全漏洞能力的 CWE-bench v1 测试中,Argon 以 68% 的最高分并列第一。

  分发方面,谷歌表示会分阶段发布,第一阶段通过名为 Fairwind Program 的计划,提供给受信任的网络安全防御者,并参与美国政府的自愿预发布模型访问流程。

  费用方面,谷歌计划先向付费 API 客户和 Google AI Ultra 用户开放,之后再扩大到企业和普通消费者:

  项目初始价格后续价格输入 tokens每百万 2 美元每百万 4 美元输出 tokens每百万 10 美元每百万 20 美元缓存输入 tokens输入价格的约 95% 折扣—

排行

精选