大模型技术演进、开源生态与产业落地
随着企业AI预算频频告急,硅谷正从盲目追逐顶级模型转向追求极致性价比。开源权重模型凭借超7倍的成本优势和迅速缩小的性能差距,加速渗透企业生产环境,“多模型路由”正在重塑行业格局。
专司判断而非生成的“决策模型”Jev 上线后,OpenAI、Cloudflare 及中国团队迅速跟进。上海 AI 实验室与陈大年创办的 StartLux 纷纷选择开源与端侧本地部署,将极低成本的高频决策能力作为 AI 智能体落地的关键组件。
上海AI公司StartLux正式开源专用于智能体决策的模型StartLux-Decision,涵盖0.8B至27B五档规格。该模型通过单次计算直接输出离散决策结果,在Decision Index评测中大幅超越Jev,大幅降低了智能体执行流程中的响应延迟。
美国AI视频公司Tavus发布人类交互模型Griffin,告别传统数字人级联拼凑架构。该模型支持全双工、端到端视频对话,平均延迟低至0.43秒,近半数受测者误认为自己在与真人视频通话。
白宫设立由国家情报总监杰伊·克莱顿领导的“超级智能工作组”,旨在研究人工智能的风险与机遇,并评估联邦政府的监管角色。工作组需在120天内提交报告,重点在不阻碍创新的前提下应对先进AI安全威胁。
过去一周,全球AI格局迎来密集变动:Kimi成功进入OpenAI企业付费体系,DeepSeek全面开源昇腾基础组件;海外市场方面,AMD以82亿美元收购李飞飞创立的世界模型公司World Labs,Anthropic加速冲刺IPO并披露近46亿美元营收。
随着GPT-6等基础大模型展现出Blender操作与程序化建模能力,3D生成赛道受到广泛关注。然而专业3D生成工具Meshy用不到两年时间实现ARR从100万美元跃升至1亿美元,证明了工业级高精资产仍是通用大模型难以替代的专业壁垒。
AMD 宣布以约 82 亿美元全股票收购李飞飞创办的世界模型初创公司 World Labs,李飞飞将出任 AMD 执行副总裁兼首席科学家。在大语言模型增速放缓之际,算力巨头正加速向物理 AI 渗透,开启软硬件协同竞争。
OpenAI CEO Sam Altman 在社交平台发文,直言将宗教力量或人类判断力让渡给 AI 模型是真正的安全隐患。此番言论被指针对竞争对手 Anthropic,后者近期正与多国宗教界探讨 AI 意识与道德构建。
针对AI智能体常在调用工具后“谎报完工”的痛点,微软推出评测基准ThinkingBox。该框架抛弃单纯的对话文本评估,通过比对真实数据库的前后状态差异,精准检验智能体在复杂业务环境中的实际执行可靠性。
从辅助编码到端到端研发,AI正从工具蜕变为创造工具的创造者。全球顶尖机构开始探索递归式自我改进,AI已深度参与下一代大模型的调试、审计与生成,重塑软件开发生态的同时也带来了人机协同的新挑战。
DeepSeek弹性计算团队近期披露其核心沙盒基础设施DSec的技术细节。该系统单分片日均运行约300万个沙盒,峰值在线超38万个,通过镜像按需加载、内存共享及轨迹分叉等优化,全面支撑其新一代大模型的Agent训练与强化学习探索。
据《纽约时报》报道,Anthropic联合创始人曾多次邀请宗教学者研讨旗下Claude大模型是否存在意识,并私下游说梵蒂冈顾问修改通谕草案。教皇最终在文件中明确否认AI具备意识与道德感知。
TypeSafe AI推出的决策模型Jev走红,日吞吐突破一万亿Token。创始人Diogo Almeida接受专访,详谈离开OpenAI创业始末,并直言当前大模型盲目卷基准测试与聊天体验,真正创造商业价值的应是面向代码与程序闭环的机器决策。
微软正式推出三款自研语音AI模型,包括实时流式转写模型MAI-Transcribe-2-Streaming以及语音生成模型MAI-Voice-2.1系列。新模型主打高精度与低延迟,支持多语言及自动语种识别,进一步加速摆脱对外部技术供应的依赖。
在初创公司TypeSafe推出Jev决策模型仅两周后,OpenAI、亚马逊AWS和Cloudflare迅速跟进发布竞品。这类决策模型不生成文本,仅输出带概率的选项,已成为AI智能体快速判断的核心工具。
Anthropic宣布投资1亿美元启动Claude Frontier Academy项目,计划在2027年底前培养1万名企业前线部署工程师。该项目采用类似医学规培的模式,旨在解决企业落地AI时面临的应用人才短缺难题。