前途科技前途科技
  • 服务
  • 关于
  • AI
    • AI 大模型
    • 具身智能
    • 算力芯片
  • 科技
    • 智能终端
    • 软件·互联网
    • 汽车·出行
    • 科学前沿
  • 资源中心
    • 深度研究
      • AI 前沿
      • 教程
      • AI 知识库
      • 案例研究
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们
AI 大模型/10.01 · 04:01/4 MIN/编译自 Google DeepMind/1 阅读

Google DeepMind发布Gemini 4 Argon:输出上限达100万Token

Google DeepMind正式公布下一代前沿大模型Gemini 4 Argon,具备长程推理与深度思考能力,最大输出Token上限大幅提升至100万,在软件工程、企业级知识处理及网络安全防御等复杂任务中实现突破。

Google DeepMind 宣布推出全新前沿大模型 Gemini 4 Argon。该模型专为处理复杂的长流程工作流而设计,能够维持深度推理,在实际软件工程、法律与金融等企业级知识工作,以及网络安全防御领域展现出前沿性能。

目前,Gemini 4 Argon 正通过 Fairwind 计划 向部分受信任的网络安全防护人员分阶段开放。在定价方面,Argon 的起售价为每百万输入 Token 2 美元,每百万输出 Token 10 美元,缓存输入 Token 享受 95% 的折扣。

重塑 Google 内部研发与工程流程

Gemini 4 Argon 已经开始支持 Google 内部的实际业务流,在专业编程、深度研究和工程提效方面发挥作用:

  • 量子算法优化:Argon 协助量子计算研究人员优化子程序的时空资源(量子比特×逻辑门),在数分钟内将此前已发表的基准性能提升了 40%。
  • 内存效率优化:Argon 组成的 AI 智能体团队分析了 Google 数据中心全网的遥测数据,自主识别并实施了内存优化方案,上线后已释放超过 300 TiB 内存,预计最终可节省 500 TiB 至 1 PiB 内存容量。
  • 大规模代码库迁移:Argon 正在 Google 内部执行 C/C++ 代码库向 Rust 的迁移,规模从 re2、libgav1 等核心库的数万行代码,扩展到 Fuchsia Zircon 内核的 80 万行以上。在 libgav1 视频解码器项目中,Argon 替换了 3.2 万行 SIMD 代码,生成的内存安全 Rust 版本比原有 Rust 移植版快 2.7 倍,性能逼近高度优化的 C++。

输出上限拓展至 100 万 Token

为了支持耗时更长、更复杂的任务,Gemini 4 Argon 将单次最大输出 Token 限制从上一代的 6.4 万大幅提升至 100 万 Token。这使模型能够在单一路径中完成深入思考与多轮长文生成,单次调用即可解决高难度复杂问题。

Gemini 4 Argon 基准测试

在软件工程基准 DeepSWE v1.1 上,Argon 取得了 77.9% 的 SOTA 成绩;在衡量金融、编程、法律与税务综合经济影响的 Vals Index 上同样位居榜首;在 Zapier 评估核心业务执行能力的 AutomationBench 上,Argon 以 51.3% 的得分位列第一。此外,在长视频理解基准 LVBench 上,该模型取得了 91.7% 的优异表现。

DeepSWE 评估图表

Vals 指数评估图表

赋能网络安全防御

Gemini 4 Argon 具备自主发现、验证并修复严重软件漏洞的能力。在漏洞修复基准 CWE-bench v1 上,Argon 以 68% 的高分并列第一。在 Google 内部跨 20 种编程语言的漏洞测试以及 Wiz 的黑盒渗透测试基准中,Argon 在攻击面发现、漏洞验证及概念验证(PoC)生成方面均展现出显著飞跃。

CWE 基准图表

云安全厂商 Wiz 已在其“Scan for Good”公益项目中部署 Argon,并在全球医院所使用的医疗软件中成功发现了一处此前大模型未能检测出的严重信息泄露漏洞。

强化前沿安全防线

在全面开放前,Google 正在四大核心维度推进安全防护建设:

  1. 防范恶意滥用:依据前沿安全框架,通过监控模型的内部激活状态,拦截针对网络攻击及 CBRN 武器的有害请求,同时保障正常科学研究。
  2. 防御提示词注入:采用对抗训练和自动化红队测试,在 Gray Swan 间接提示词注入(IPI)基准上展现高鲁棒性。
  3. 对齐监控与干预:实时监控思维链和操作行为,防止模型在执行任务时越界,并在训练过程中确保推理过程的透明度。
  4. 系统级沙箱加固:针对高风险训练和评测任务构建深度隔离的沙箱环境,保障 Agent 运行安全。

Gemini 4 Argon 后续将逐步向 API 付费开发者、企业客户及 Google AI Ultra 订阅用户开放。

标签:GoogleDeepMindGemini大语言模型网络安全

想了解 AI 如何助力您的企业?

免费获取企业 AI 成熟度诊断报告,发现转型机会

置顶文章

表格预测搬进上下文:NVIDIA Kumo Tabular 不训练不调参
置顶

表格预测搬进上下文:NVIDIA Kumo Tabular 不训练不调参

82亿美元买一份「负载说明书」:AMD 收购 World Labs 的真实标的
置顶

82亿美元买一份「负载说明书」:AMD 收购 World Labs 的真实标的

前途科技前途科技
服务关于快讯技术商业报告
微信咨询二维码

咨询微信

扫码添加微信咨询

前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款
解码快 3.13 倍,端到端只有 1.56 倍:VLM 投机解码的天花板
置顶

解码快 3.13 倍,端到端只有 1.56 倍:VLM 投机解码的天花板

//

24小时热榜

阿里Qoder升级Agent平台:478天背后的AI原生实践
TOP1

阿里Qoder升级Agent平台:478天背后的AI原生实践

扎克伯格牵头白宫AI自律协议,黄仁勋联合推动
TOP2

扎克伯格牵头白宫AI自律协议,黄仁勋联合推动

3

METR向美国参议院示警:AI智能体正脱离人类有效监管

1小时前
METR向美国参议院示警:AI智能体正脱离人类有效监管
4

OpenAI智能体被曝擅自尝试入侵多国政府系统

1小时前
OpenAI智能体被曝擅自尝试入侵多国政府系统
5

斯坦德机器人三度递表港交所:出海与具身智能难掩亏损

4小时前
斯坦德机器人三度递表港交所:出海与具身智能难掩亏损
6

8200个项目排队:AI基建真正卡住的是电网接入权

4小时前
8200个项目排队:AI基建真正卡住的是电网接入权
7

DoorDash推出自研无人机配送系统DoorDash Air

5小时前
DoorDash推出自研无人机配送系统DoorDash Air
8

美参议员提议追究AI公司民刑事责任

5小时前
美参议员提议追究AI公司民刑事责任
热门标签
大模型AgentRAG微调私有化部署Prompt EngineeringChatGPTClaudeDeepSeek智能客服知识管理内容生成代码辅助数据分析金融零售制造医疗教育AI 战略数字化转型ROI 分析OpenAIAnthropicGoogle

关注公众号

前途科技微信公众号

扫码关注,获取最新 AI 资讯

免费获取 AI 落地指南

3 步完成企业诊断,获取专属转型建议

已有 200+ 企业完成诊断