Google 推出 Gemini 4 Argon,在多项 AI 基准测试领先并强调网络安全
要点
Google 推出 Gemini 4 Argon,这是其最新的 frontier 模型,在 DeepSWE v1.1 上取得 77.9% 的成绩,并在 18 项内部基准测试中领先 12 项。该模型对间接提示注入攻击表现出强大的抵抗力,在 Gray Swan 的测试中攻击成功率为 0.7%。Argon 将先通过 Fairwind 项目提供给经过审查的防御团队,在更广泛的 API 和订阅者可用之前不具内置的网络防护限制。 Argon 在网络安全上的突出表现是此版本的关键差异化因素。
情绪分析
- 整体情绪为谨慎乐观:公告强调显著的技术进展,特别是在网络安全与编码能力方面,同时也承认基准测试与分阶段推出的注意事项。语气在对模型能力的热情与对安全与比较性声明的审慎之间取得平衡。
文章正文
Google 发布 Gemini 4 Argon 作为其最新的 frontier 模型,被定位为公司在从编码与办公工作到网络防御等任务上最强大的产品。在内部评估中,Argon 在 DeepSWE v1.1 上取得 77.9%,该基准测试评估 AI 完成复杂且具真实世界情境的软件工程任务的能力。该分数在报道的比较中超越了几个来自竞争对手的近期模型,并标志着相较早期 Gemini 发行版本的显著提升。
除了编码性能外,Argon 扩展的响应容量也值得注意:该模型单次回复最多可生成 100 万个标记(tokens),这比此前的 64,000 标记限制大幅提升。这使得长篇连续输出成为可能,适用于广泛文档撰写、长篇生成或多阶段技术协助。
基准数据应谨慎解读。Google 报告了自家的 DeepSWE 成绩,并展示了一张表格显示 Argon 在多数测试中领先,但在其他几项测试仍落后。比较结合了跨编码、科学与控制任务的各类评估,且部分竞争者的分数取自公开排行榜与公司报告,而非单一统一的测试环境。
网络安全是 Argon 的一项重点能力。间接提示注入——即恶意指令隐藏在代理程序所读取的内容中——对于会访问用户电子邮件、文件或其他数据的助手构成严重风险。在 Gray Swan 的间接提示注入基准测试中,Argon 在多次尝试中的攻击成功率为 0.7%,这是一个低(较好)数值,优于在相同基准测试上测试的几个近期模型。对此类提示注入攻击的抵抗是 Google 在说明 Argon 防御效用时的一项核心主张。
Google 起初通过 Fairwind 项目将 Argon 提供给经过审查的网络防御者,这是一项受控访问的计划,包含政府、关键基础设施运营者与安全合作伙伴。在此阶段,Argon 部署时不具通常的内置拒绝机制——通常称为网络防护限制——以便让安全团队模拟攻击者行为并在更广泛可用前找出漏洞。其理由是防御者能从一个能像攻击者思考的模型中获益,发现并修补缺陷,但 Google 强调会以分阶段推出来限制风险。
此做法遵循行业先例:其他实验室也以类似方式将早期聚焦于网络的发布限制于受信任伙伴,使协调式的漏洞发现与修补成为可能。Google 也报告在例如 Wiz 渗透测试基准等测试中的内部基准提升,Argon 在这些测试中解决了比先前受限模型更多的利用挑战。公司引用与合作伙伴共同发现的真实世界发现,包括 Argon 帮助识别的一个医疗软件关键漏洞。
尽管技术上有进展,此次发布仍发生在公司面临更广泛挑战与市场审视之际。今年夏天早些时候,Google 推迟了部分计划中的模型更新,并面临与产品策略相关的股东压力。Argon 的定价与访问细节已公布:入门 API 价格订为每百万输入标记 2 美元及每百万输出标记 10 美元,并表示之后标准费率会更高,但未说明何时转为标准定价。
Google 提到其参与与政府利益相关者协调的自愿性预发布访问程序。分阶段分发以及与安全公司合作的做法反映了双重目标:在加速关键部门的防御能力同时,管理释放高能力模型可能被滥用的风险。 公司强调谨慎、分阶段的访问对于在能力与安全之间取得平衡至关重要。
总而言之,Gemini 4 Argon 代表了 Google 在技术上的重要进步,尤其是在网络防御与长篇生成领域。该模型强劲的基准结果与针对性发布策略旨在为防御者提供先进工具,同时让更广泛的社区与监管机构观察这类能力如何被管理与部署。
关键见解表格
| 面向 | 描述 |
|---|---|
| DeepSWE v1.1 的表現 | Argon 得分 77.9%,在所呈现的比较中领先,并较早期 Gemini 模型有所提升。 |
| 提示注入抗性 | Argon 在 Gray Swan 的间接提示注入基准测试上记录到 0.7% 的成功率,显示出强抗性。 |
| 访问策略 | 初期通过 Fairwind 提供给经过审查的防御者,且不设网络防护限制,之后再分阶段开放 API 与订阅者访问。 |
| 输出容量 | 单次回复支持高达 100 万个标记,能产生比先前限制长得多的连续输出。 |
| 定价 | 宣布的入门 API 价格为每百万输入标记 2 美元与每百万输出标记 10 美元,之后将有更高的标准费率。 |
最後編輯時間:2026/10/1
