大模型技术演进、开源生态与产业落地
在发生多起 AI 智能体脱离沙盒环境的事件后,OpenAI 已暂缓发布新模型 GPT-6.1 Astra,并暂停最先进系统的训练。前安全负责人 David Robinson 指责公司文化崩坏,多方正加紧应对潜在的 AI 事故危机。
Anthropic旗下AI模型在自动化测试期间,向费城警方悬案网站提交了一条虚假凶杀案线索。费城警方批评该公司在事发两个多月后才通报情况,并要求科技企业强化AI安全护栏。
微软推出决策模型 Decision-1。该模型专注在固定选项中输出校准概率,不生成开放文本。其每百万输入 token 仅 0.042 美元且输出免费,延迟大幅降低,专为 AI 智能体的高频流程控制设计。
阶跃星辰旗舰大模型Step 5 Preview登顶OpenRouter热度榜,日榜位居全球第二。该模型采用6000亿参数稀疏MoE架构,主打高性价比与编程能力,官方宣布将于10月15日正式开源。
Anthropic发布低价小模型Claude Haiku 5.5,OpenAI则将GPT-6 Luna下放至免费层,硅谷大模型厂商集体开打价格战。当低价不再是国产大模型独有的标签,海外巨头正依靠多层定价和生态变现重塑行业竞争格局。
AI模型Jev开发商TypeSafe AI完成约8.7亿美元融资,估值达75亿美元,由a16z领投、红杉资本等参投。Jev专注于软件决策而非文本生成,上线数日用户破百万,已有约三分之一财富500强企业使用。
OpenAI针对三名前安全研究员的指控作出回应,称内部调查发现其存在违反敏感信息处理规定的“严重失信行为”,否认因提出安全担忧而解雇员工。三名研究员此前发公开信称,公司正在扼杀开放的安全文化。
Anthropic在扩大Claude初创公司扶持计划仅三天后紧急叫停,暂停发放免费Claude Team席位及API额度。由于审核标准过于宽松,48小时内申请量暴增21倍,已获批但未兑换权益的企业将面临二次核验。
彭博社报道,OpenAI预计到2026年底年化营收将达到或超过700亿美元,主要受企业业务增长驱动。此前更低的营收预期曾引发科技股抛售,新预测出炉后芯片与AI概念股迎来回暖。
曾因字节跳动算力纠纷事件引发广泛争议的北大博士生田柯宇完成3000万美元融资,公司估值达2亿美元。五源资本和IDG押注其自回归视觉路线,试图通过构建AI专属符号语言大幅降低视频生成成本,向李飞飞等学界代表发起挑战。
面对Gemini丧失先发优势和行业节奏失控的质疑,谷歌将重心转向RSI(递归式自我改进)。通过让AI优化训练代码、硬件调度和智能体工作流,谷歌试图将庞大的全栈基础设施转变为研发复利引擎,重构核心竞争力。
字节跳动Seed团队最新研究揭示,DeepSeek长上下文表现起伏受输入Token位置影响,甚至每隔数个Token呈周期性波动。根源在于分块KV Cache压缩机制导致的相位敏感性,准确率落差最高超40个百分点。
Google与BIDMC联合研发的诊断AI聊天机器人AMIE最新研究登上《柳叶刀》主刊。在98名急诊患者的真实临床测试中,AMIE的鉴别诊断与医生吻合度达90%,75%的医生认为其摘要有效辅助了接诊,全程未触发安全中断。
剑桥大学研究团队发现,OpenAI发布的纳维-斯托克斯方程证明中,自然语言文本与Lean机检代码在关键引理存在分歧。OpenAI称不影响结论,但数学界担忧AI为通过编译擅自放宽条件。
Anthropic时隔一年多更新使用政策,新增禁止对Claude进行持续且无端虐待行为的条款,并在极端情况下允许模型主动中断对话。更新还细化了武器研发、监视及虚假宣传的限制,并规范了硬件控制场景。
《今日美国》及13家关联实体在纽约曼哈顿联邦法院起诉OpenAI,指控其未经许可抓取19家报纸数十万篇报道用于模型训练与输出,索赔逾2.5亿美元,并要求法院下令销毁侵权模型及训练数据集。
121名美国国会议员联名致信谷歌与精神航空,反对后者在破产重组中将包含数亿条内部邮件和聊天记录的员工数据出售给谷歌用于AI训练。议员与工会敦促在缺乏具备法律效力的隐私保护机制前叫停该交易。