Elon Musk透露,xAI下一代2万亿参数大模型Grok 4.6将于下周完成初始训练,性能全面超越前代Grok 4.5,旨在对标Moonshot AI最新发布的2.8万亿参数模型Kimi K3,同时保持更低的推理成本。
Elon Musk 在7月18日透露,xAI 的下一代大语言模型——一个2万亿参数的系统,预计命名为 Grok 4.6——将于下周完成初始训练。这是对 Moonshot AI 两天前发布 Kimi K3 的直接回应。
Musk 表示,新模型在所有指标上都优于基于1.5万亿参数基础模型(内部代号 V9)的 Grok 4.5。他补充说,2T 模型可能在性能上超越 Kimi K3,同时保持接近 Grok 4.5 的生成速度和 token 效率。
Moonshot AI 于7月16日发布了 Kimi K3,参数量达2.8万亿,成为迄今为止最大的开源权重 AI 模型。这家北京初创公司选择在上海世界人工智能大会之前发布,完整模型权重计划于7月27日公开发布。
根据 Artificial Analysis 的测试,Kimi K3 在智能基准测试中得分为57,而 Grok 4.5 为54。不过,Grok 4.5 每任务成本约为0.31美元,仅为 Kimi K3(0.94美元)的三分之一。Musk 为2T 模型设定的目标是在保持成本优势的同时缩小性能差距。
BBC 报道称,Artificial Analysis 的独立评估显示 Kimi K3 在 Web 界面工程中取得最高分,性能与领先的美国模型相当。Business Insider 则指出 Moonshot AI 对 K3 的 API 定价低于 OpenAI 和 Claude。
2T 模型只是 xAI 更大规模路线图中的一步。Grok 4.5(1.5万亿参数)目前已在 SpaceX 和 Tesla 进行私人测试,Musk 于6月28日宣布,称其性能“接近 Claude Opus,某些情况下甚至超越”。
此外,xAI 在其 Colossus 2 超级集群上训练了更大的系统,包括6万亿和10万亿参数的变体,代号 Grok 5。截至7月中旬,该集群上同时训练着7个模型。
同时,xAI 继续开发 Grok Build,一个于5月发布的编码智能体,可在终端运行并将任务委派给并行子智能体。该工具于7月13日达到 v0.2.101,仍对订阅 xAI 每月300美元 SuperGrok Heavy 套餐的用户开放测试版。
免费获取企业 AI 成熟度诊断报告,发现转型机会