产品派
返回

谷歌发布Gemini 4 Argon:输出上限提升至百万Token

AIInfoQ 中文站2026/10/1 13:03:16
AI 导读

谷歌发布面向长流程软件工程、法律金融知识工作和网络安全防御的Gemini 4 Argon。CEO Sundar Pichai称,该模型已被内部团队用于从编程到量子计算等任务,但目前尚未向普通开发者和消费者开放。

Argon现通过Fairwind计划向受信任的网络安全团队提供访问,谷歌将根据测试反馈完善安全措施,后续优先向付费API客户和Google AI Ultra用户开放,时间尚未公布。初始价格为每百万输入Token 2美元、输出Token 10美元,缓存输入价格较普通输入低95%。

Argon的输出上限由64K提升至100万Token,重点是让模型在单次执行中持续完成分析、验证、修改和工具调用,而非只生成一次答案。谷歌公布的DeepSWE v1.1得分为77.9%,并称创下该评测纪录。

在企业任务方面,Argon在覆盖金融、编码、法律和税务工作的Vals Index,以及Vals Finance Agent v2和Harvey法律智能体评测中处于领先位置;它还在Zapier AutomationBench中以51.3%排名第一。视觉知识工作方面,模型支持图表分析、长视频细节识别和跨文档行动,LVBench得分为91.7%。

谷歌称,Argon智能体正参与将re2、libgav1等C/C++代码库迁移至Rust,并扩展到Fuchsia Zircon内核80多万行代码,但所有改写仍需自动化和人工审计、仿真测试及评审。在libgav1案例中,模型替换约3.2万行SIMD代码,使解码速度达到原Rust版本的2.7倍;它还释放了数据中心超过300 TiB内存,预计总节省500 TiB至1 PiB,并在一个量子算法案例中用数分钟取得比已发表基准好40%的结果。

网络安全是首批开放领域。Argon可自主发现、验证和修复漏洞,Wiz已在Scan for Good计划中使用它,并曾发现全球医院医疗软件泄露敏感个人信息的关键漏洞。模型在CWE-bench v1中以68%并列第一,在内部多语言漏洞测试及Wiz黑盒渗透测试中,也在攻击面识别、漏洞发现和概念验证生成方面优于3.8 Flash Cyber。

扩大开放前,谷歌还将加强防滥用、提示注入防御、对齐偏差监测和运行环境加固,并监测模型思维链与行动,必要时中止越出用户意图的任务。相关监测已用于训练过程,但公司提醒不要直接将结果反馈训练,以免模型学习规避监控。

发布策略引发部分用户讨论:有人认为高能力模型应严格控制访问范围,也有人质疑跑分领先却没有公开API,普通开发者仍需等待名单。对企业和开发者而言,开放时间、接口稳定性与使用门槛,正成为衡量模型实际价值的重要因素。

Gemini大模型企业AI网络安全软件工程

本文基于公开渠道信息整理,内容可能存在不准确或遗漏之处,不代表本站立场,如内容涉及侵权或错误,请联系我们处理。

阅读原文