跳到正文
原文
InfoQ 中文· 李冬梅·· 1 天前精选AI 评分82

谷歌发布 Gemini 4 Argon,输出上限升至百万 Token 且初期仅向受信任安全团队开放

刚刚,Gemini 4 Argon 发布:多项基测碾压 GPT-6 Astra,已参与谷歌 80 万行内核代码迁移

AI 导读

谷歌发布新一代模型 Gemini 4 Argon,主打长流程软件工程、企业知识工作与网络安全防御,输出 Token 上限从 64K 提升至 100 万,并采用分阶段开放:初期仅通过 Fairwind 计划向受信任的网络安全防御团队提供,后续才从付费 API 客户和 Google AI Ultra 订阅用户开始,具体时间未公布;定价为每百万输入 Token 2 美元、每百万输出 Token 10 美元,缓存输入价格较普通输入低 95%。

容易被标题带偏的是两个口径。其一,谷歌披露 Argon 智能体参与 C/C++ 向 Rust 的迁移,规模从 re2、libgav1 等核心库扩展至 Fuchsia 操作系统 Zircon 内核的 80 多万行代码,但原文明确这不代表迁移已完成或投入生产;libgav1 案例中替换约 3.2 万行 SIMD 代码后运行速度达到原 Rust 移植版本的 2.7 倍,比较对象是 Rust 移植版而非优化后的 C++ 实现。其二,DeepSWE v1.1 的 77.9%、AutomationBench 的 51.3%、LVBench 的 91.7%、CWE-bench v1 的 68% 并列第一均为谷歌公布或引用的结果,且配套表格中 GPT-6 Astra 在 FrontierSWE v2、Terminal-bench 4.0 等项目上仍高于 Argon,全面碾压的说法并不成立。

事实层面,谷歌把网络安全防御作为优先开放领域,向受信任防御者提供不带网络安全防护措施的版本,并计划用对齐偏差监测跟踪模型思维链与行动,必要时停止执行;推断层面,受信任测试者先行的节奏意味着公开跑分与开发者实际可用性之间的差距在拉大,正如评论中基准领先但普通开发者还拿不到 API 的质疑;猜测层面,后续开放时间未公布,付费 API 与订阅用户何时能用仍无依据。对准备把智能体接入工程流程的团队而言,眼下可依赖的是价格、输出上限这类硬参数,而非内部案例的性能倍数。

推荐理由

材料拆出了Argon迁移案例与跑分的真实口径:2.7倍速度是对比Rust移植版而非C++,80万行内核迁移尚未投产,可校正把基准成绩当工程落地能力的判断。

来源:InfoQ 中文 · infoq.cn