多位独立测试者在盲测平台LMArena上发现疑似谷歌下一代旗舰大模型Gemini 4 Pro的测试检查点。该模型套用轻量模型名称进行匿名测试,推理速度据称翻倍,最大输出达25.6万Token,预计年底前正式发布。
9月26日,盲测平台 LMArena 上出现了一个疑似谷歌下一代旗舰大模型 Gemini 4 Pro 的测试检查点(checkpoint)。该模型套用了已发布的轻量模型“Gemini 3.8 Flash”的标签进行匿名盲测。此前数日,Google DeepMind 刚刚确认 Gemini 4 已进入后训练阶段,意味着该模型有望在年底前正式亮相。

开发者 Pankaj Kumar 最早注意到了这一检查点,并表示其推理速度极快,“几乎比其他旗舰模型快2倍”,且展现出了极高的设计水准。该模型借用了谷歌于9月2日推出的 Gemini 3.8 Flash 之名——利用已有轻量模型的名称进行盲测,是大模型厂商在 LMArena 上进行匿名测试的常见做法。
这一发现并非孤例。早在9月中旬,就有测试者透露 Gemini 4 Pro 的测试版本在内部流转。测试者称其内部代号为“Argon”,单次最大输出限制达到 25.6 万 Token,是上一代上限的4倍。随后在9月17日与19日,也有多个不同版本的 Flash 标签检查点被社区捕获。
在9月23日举行的 The Information AI Agenda 峰会上,Google DeepMind 高级副总裁 Koray Kavukcuoglu 证实,Gemini 4 目前正处于早期后训练阶段,公司的目标是在“远早于年底”的时间点发布该模型。他补充提到,谷歌工程师已在内部编程平台 Antigravity 上试用该模型,相关的安全测试也在同步推进。
不过,谷歌官方并未证实 LMArena 上的检查点是否属于 Gemini 4,也未确认 Argon 这一代号。在此之前,谷歌最近一次官方提及该模型是在7月21日,当时 Google DeepMind 宣布启动了“针对 Gemini 4、史上规模最大的一次预训练”。
开发者分析认为,如果检查点的迭代速度保持当前节奏,谷歌有可能在10月上旬至中旬正式推出 Gemini 4 Pro。届时,该模型将直面 Anthropic 的 Claude Opus 5.5 以及 OpenAI 的新一代模型。Kavukcuoglu 表示,谷歌计划先公布早期的后训练成果,随后进行快速迭代,而非等待打磨出一个终极版本后再推向市场。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断