一句话结论
谷歌推出 Gemini 4 Argon,输出上限升至 100 万 Token 并优先向受信任安全团队开放,旨在攻克长流程工程与安全防御任务。
关键要点
- 输出 Token 上限从 64K 提升至 100 万,支持单条轨迹下数十万 Token 的深度推理与复杂任务执行。
- 定价初期每百万输入 Token 2 美元、输出 Token 10 美元,缓存输入价格较普通输入低 95%。
- 在 DeepSWE v1.1 软件工程评测中以 77.9% 创下新纪录,在 Zapier AutomationBench 中以 51.3% 排名第一。
- 该模型正参与 Fuchsia 操作系统内核等 80 多万行 C/C++ 代码向 Rust 的迁移项目,但尚未全部投入生产。
- 发布采取分阶段策略,目前仅通过 Fairwind 计划向受信任网络安全防御团队开放,未对普通开发者上线 API。
背景与事实
谷歌首席执行官 Sundar Pichai 近期宣布推出新一代模型 Gemini 4 Argon,明确其核心定位面向长流程软件工程、法律与金融等企业知识工作,以及网络安全防御。此次发布采取分阶段开放方式,当前仅通过 Fairwind 计划向一批受信任的网络安全防御团队提供访问权限。谷歌表示,将根据早期测试反馈调整安全防护措施,后续开放将从付费 API 客户和 Google AI Ultra 订阅用户开始,但未公布具体时间。在价格方面,Argon 上线初期每百万输入 Token 为 2 美元,每百万输出 Token 为 10 美元,缓存输入 Token 的价格较普通输入低 95%。
技术层面,Argon 的一项主要变化是输出 Token 上限从 64K 提升至 100 万。谷歌认为,更大的输出空间能够让模型在单条执行轨迹中进行更深入的推理,从而支持更长、更复杂的任务。对于软件迁移、金融研究和企业流程执行,这一设计试图解决的是任务持续性问题,即模型需要在多轮分析、验证与修改中推进工作。不过,输出上限本身并不等于任务完成能力,实际效果仍取决于模型能否保持目标一致、正确调用工具,并发现和纠正执行过程中的错误。
在基准测试方面,按照谷歌公布的结果,Argon 在衡量真实、长流程软件工程能力的 DeepSWE v1.1 中取得 77.9%,创下该评测的新纪录。在企业任务方面,Argon 在覆盖金融、编码、法律和税务工作的 Vals Index 中处于领先位置,在多步骤金融研究评测 Vals Finance Agent v2 和 Harvey 法律智能体评测中,也取得领先表现。此外,Argon 在 Zapier 的 AutomationBench 中以 51.3% 排名第一,该基准测试衡量核心业务功能的端到端执行力。Argon 在需要视觉理解的知识型工作中也展现出优势,例如在衡量长视频理解能力的 LVBench 测试中,Argon 的得分高达 91.7%。
影响分析
对于中文开发者与企业从业者而言,Argon 在长流程工程与安全领域的突破具有双重影响。一方面,输出上限的大幅提升及在软件工程基准测试中的领先表现,意味着未来在处理大规模代码迁移、金融研究及自动化办公流程时,模型具备更强的持续工作能力。对于涉及 C/C++ 向 Rust 迁移等底层系统重构的企业团队,这种能进入分析、修改、测试和优化连续工程流程的模型能力,将显著降低人力成本并提高工程效率。另一方面,当前分阶段开放的策略意味着普通开发者短期内无法通过公开 API 调用该模型,技术能力的获取存在门槛。企业需关注后续开放时间表,并评估在等待期内的技术替代方案。同时,模型在网络安全防御上的强化也提示,随着模型具备自主发现与修复漏洞的能力,企业安全策略需从单纯防护转向与 AI 协同的防御体系。
适用边界
上述关于工程效率与安全能力的结论,基于当前 Argon 仅向受信任网络安全防御团队开放的事实。若模型尚未对特定企业开放,或该企业数据不符合受信任团队标准,则无法直接应用其安全防御功能。此外,输出上限 100 万 Token 的优势仅适用于长流程、多步骤任务,对于短文本生成或简单问答场景,该特性不构成实际优势。谷歌明确指出,大规模代码重写仍需经过严格的自动化和人工审计、仿真测试与评审,因此不能直接将模型输出视为可立即投入生产的最终代码。
孤本观察
发布策略凸显能力与风控平衡。谷歌选择“先信任后开放”的路径,表明前沿模型能力已触及安全敏感区,开放节奏成为竞争新维度。





常见问题
Gemini 4 Argon 的输出 Token 上限是多少?
Gemini 4 Argon 的输出 Token 上限从 64K 提升至 100 万。
Gemini 4 Argon 的初期定价是多少?
初期每百万输入 Token 2 美元,每百万输出 Token 10 美元,缓存输入价格较普通输入低 95%。
Gemini 4 Argon 在 DeepSWE v1.1 评测中的得分是多少?
在 DeepSWE v1.1 软件工程评测中取得 77.9%,创下该评测新纪录。
目前 Gemini 4 Argon 对哪些用户开放?
目前仅通过 Fairwind 计划向受信任的网络安全防御团队开放,未对普通开发者上线 API。
Gemini 4 Argon 是否已投入生产?
该模型正参与代码迁移项目,但尚未全部投入生产,大规模代码重写仍需经过严格审计与测试。
来源:InfoQ 中文 AI