Google DeepMind正式公布下一代前沿大模型Gemini 4 Argon,具备长程推理与深度思考能力,最大输出Token上限大幅提升至100万,在软件工程、企业级知识处理及网络安全防御等复杂任务中实现突破。
Google DeepMind 宣布推出全新前沿大模型 Gemini 4 Argon。该模型专为处理复杂的长流程工作流而设计,能够维持深度推理,在实际软件工程、法律与金融等企业级知识工作,以及网络安全防御领域展现出前沿性能。
目前,Gemini 4 Argon 正通过 Fairwind 计划 向部分受信任的网络安全防护人员分阶段开放。在定价方面,Argon 的起售价为每百万输入 Token 2 美元,每百万输出 Token 10 美元,缓存输入 Token 享受 95% 的折扣。
Gemini 4 Argon 已经开始支持 Google 内部的实际业务流,在专业编程、深度研究和工程提效方面发挥作用:
为了支持耗时更长、更复杂的任务,Gemini 4 Argon 将单次最大输出 Token 限制从上一代的 6.4 万大幅提升至 100 万 Token。这使模型能够在单一路径中完成深入思考与多轮长文生成,单次调用即可解决高难度复杂问题。

在软件工程基准 DeepSWE v1.1 上,Argon 取得了 77.9% 的 SOTA 成绩;在衡量金融、编程、法律与税务综合经济影响的 Vals Index 上同样位居榜首;在 Zapier 评估核心业务执行能力的 AutomationBench 上,Argon 以 51.3% 的得分位列第一。此外,在长视频理解基准 LVBench 上,该模型取得了 91.7% 的优异表现。


Gemini 4 Argon 具备自主发现、验证并修复严重软件漏洞的能力。在漏洞修复基准 CWE-bench v1 上,Argon 以 68% 的高分并列第一。在 Google 内部跨 20 种编程语言的漏洞测试以及 Wiz 的黑盒渗透测试基准中,Argon 在攻击面发现、漏洞验证及概念验证(PoC)生成方面均展现出显著飞跃。

云安全厂商 Wiz 已在其“Scan for Good”公益项目中部署 Argon,并在全球医院所使用的医疗软件中成功发现了一处此前大模型未能检测出的严重信息泄露漏洞。
在全面开放前,Google 正在四大核心维度推进安全防护建设:
Gemini 4 Argon 后续将逐步向 API 付费开发者、企业客户及 Google AI Ultra 订阅用户开放。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断