跳到正文
热点事件观察中

Gemini 4 Argon 发布,输出上限提至百万 Token

1 篇报道1 个报道来源1 天前更新

先了解这件事

报道摘要

谷歌发布新一代模型 Gemini 4 Argon,主打长流程软件工程、企业知识工作与网络安全防御,输出 Token 上限从 64K 提升至 100 万,并采用分阶段开放:初期仅通过 Fairwind 计划向受信任的网络安全防御团队提供,后续才从付费 API 客户和 Google AI Ultra 订阅用户开始,具体时间未公布;定价为每百万输入 Token 2 美元、每百万输出 Token 10 美元,缓存输入价格较普通输入低 95%。 容易被标题带偏的是两个口径。其一,谷歌披露 Argon 智能体参与 C/C++ 向 Rust 的迁移,规模从 re2、libgav1 等核心库扩展至 Fuchsia 操作系统 Zircon 内核的 80 多万行代码,但原文明确这不代表迁移已完成或投入生产;libgav1 案例中替换约 3.2 万行 SIMD 代码后运行速度达到原 Rust 移植版本的 2.7 倍,比较对象是 Rust 移植版而非优化后的 C++ 实现。其二,DeepSWE v1.1 的 77.9%、AutomationBench 的 51.3%、LVBench 的 91.7%、CWE-bench v1 的 68% 并列第一均为谷歌公布或引用的结果,且配套表格中 GPT-6 Astra 在 FrontierSWE v2、Terminal-bench 4.0 等项目上仍高于 Argon,全面碾压的说法并不成立。 事实层面,谷歌把网络安全防御作为优先开放领域,向受信任防御者提供不带网络安全防护措施的版本,并计划用对齐偏差监测跟踪模型思维链与行动,必要时停止执行;推断层面,受信任测试者先行的节奏意味着公开跑分与开发者实际可用性之间的差距在拉大,正如评论中基准领先但普通开发者还拿不到 API 的质疑;猜测层面,后续开放时间未公布,付费 API 与订阅用户何时能用仍无依据。对准备把智能体接入工程流程的团队而言,眼下可依赖的是价格、输出上限这类硬参数,而非内部案例的性能倍数。

摘自 InfoQ 中文

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. InfoQ 中文精选
    谷歌发布 Gemini 4 Argon,输出上限升至百万 Token 且初期仅向受信任安全团队开放

    谷歌发布新一代模型 Gemini 4 Argon,主打长流程软件工程、企业知识工作与网络安全防御,输出 Token 上限从 64K 提升至 100 万,并采用分阶段开放:初期仅通过 Fairwind 计划向受信任的网络安全防御团队提供,后续才从付费 API 客户和 Google AI Ultra 订阅用户开始,具体时间未公布;定价为每百万输入 Token 2 美元、每百万输出 Token 10 美元,缓存输入价格较普通输入低 95%。 容易被标题带偏的是两个口径。其一,谷歌披露 Argon 智能体参与 C/C++ 向 Rust 的迁移,规模从 re2、libgav1 等核心库扩展至 Fuchsia 操作系统 Zircon 内核的 80 多万行代码,但原文明确这不代表迁移已完成或投入生产;libgav1 案例中替换约 3.2 万行 SIMD 代码后运行速度达到原 Rust 移植版本的 2.7 倍,比较对象是 Rust 移植版而非优化后的 C++ 实现。其二,DeepSWE v1.1 的 77.9%、AutomationBench 的 51.3%、LVBench 的 91.7%、CWE-bench v1 的 68% 并列第一均为谷歌公布或引用的结果,且配套表格中 GPT-6 Astra 在 FrontierSWE v2、Terminal-bench 4.0 等项目上仍高于 Argon,全面碾压的说法并不成立。 事实层面,谷歌把网络安全防御作为优先开放领域,向受信任防御者提供不带网络安全防护措施的版本,并计划用对齐偏差监测跟踪模型思维链与行动,必要时停止执行;推断层面,受信任测试者先行的节奏意味着公开跑分与开发者实际可用性之间的差距在拉大,正如评论中基准领先但普通开发者还拿不到 API 的质疑;猜测层面,后续开放时间未公布,付费 API 与订阅用户何时能用仍无依据。对准备把智能体接入工程流程的团队而言,眼下可依赖的是价格、输出上限这类硬参数,而非内部案例的性能倍数。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。