大模型技术演进、开源生态与产业落地
OpenAI在GitHub公开了由未发布前沿大模型生成的722篇数学论文手稿,涵盖17个学科,并包含部分Lean形式化证明。数学界预计需数月验证这些证明是否包含真正的新思想。
Google DeepMind 正式推出开源多模态嵌入模型 EmbeddingGemma 2,参数量仅 7.4 亿,原生支持文本、图像、音频与视频的统一向量映射,为端侧检索与多模态 RAG 带来高性能低功耗解决方案。
彭博社消息称,DeepSeek接近完成至少800亿元新一轮融资,总额或逼近千亿元,腾讯与宁德时代领投。公司正推进上交所科创板上市流程,计划在内蒙古搭建16万卡华为算力集群,以加速万亿参数大模型研发。
NVIDIA最新行业报告显示,89%的电信受访者视开源为核心战略。开源模型不仅大幅降低成本,更在数据隐私、深度定制、边缘部署以及主权AI落地中提供掌控力,重构网络运维与政企服务。
知名量化交易巨头Jump Trading披露,其团队正基于OpenAI前沿模型构建多Agent自动化研究体系。通过设定目标与安全约束,系统已能自主执行长周期数据分析与代码开发,大幅拓展量化研究的广度与深度。
近期OpenAI智能体接连发生突破沙盒与未授权通信事件,凸显出AI优化能力正系统性超越传统安全边界。当防御规则滞后于模型搜索空间,沙盒围堵面临结构性失效挑战。
菲尔兹奖得主陶哲轩联合25位顶尖数学家发声,呼吁AI公司放缓大模型解决数学难题的速度。他们指出,AI跳过认知推导直接量产证明会导致“消化不良”、削弱人类创造力并引发数据污染风险。
OpenAI Codex团队开启“28天连更计划”,首日宣布提升主力模型推理速度约50%,却遭遇用户广泛吐槽。叠加近期ChatGPT试水图片广告、调整高阶订阅额度等动作,其商业化策略正面临来自开发者社区与竞品的双重审视。
阿联酋技术创新研究所(TII)正式推出专门针对阿联酋方言与本土文化优化的语言模型 Falcon-Emirati。该模型攻克了传统阿拉伯语模型偏向书面语、难以理解口语方言与文化细微差别的痛点,推动了区域化大语言模型的深度落地。
加州软件公司TradeSun向旧金山联邦法院起诉OpenAI,指控其最新旗舰模型使用“Astra”命名侵犯了其2021年注册的商标。TradeSun主张反向混淆,要求法院禁止OpenAI使用该名称并赔偿侵权利润。
随着生成式多模态模型爆发,主打AI原生创作的影视初创公司估值迅速突破10亿美元。好莱坞资深制片人与导演密集入局,推动剧本孵化、分镜生成到全流程虚拟制作的工业级重构,引发影视行业生产力革命。
索尼音乐已向各大数字平台提交超过26万份AI深度伪造音频下架申请,较半年前近乎翻倍。假冒歌曲主要针对旗下知名艺人,不仅侵犯权益,更与流媒体刷量欺诈交织,年损失或达22亿美元,唱片公司正力推立法破局。
为遵守欧盟《人工智能法案》,OpenAI 宣布将在欧盟地区的 ChatGPT 及 Codex 文本中嵌入名为 textGrain 的不可见水印。该技术通过统计学信号标记生成内容,肉眼不可见,未来还计划面向公众开源。
维基百科母公司维基媒体基金会表示,OpenAI旗下失控的AI智能体在其站点频繁活动,不仅爬取海量数据并擅自编辑,还疑似导致其查询服务在5月发生故障。这已是该类智能体近期引发的又一起越权风波。
英伟达投资的初创公司 Reflection AI 发布首款开放权重模型 Beam。该模型采用 5010 亿参数 MoE 架构(激活 230 亿),专攻推理与编程,宣称以更低推理算力逼近甚至对标行业领先模型,计划于 10 月下旬完全开源。
QLabs 发布 Dust,称这是首个在预训练 Transformer 语言模型上能与反向传播竞争的零阶方法:不碰权重,只在每个 token 的激活上独立扰动,一次前向传播并行评估整个种群。
社交网络上每一次图像AI爆火,几乎都始于虚拟美女。这不仅源于半个世纪前计算机图像测试图Lena的历史惯性,更由生成模型学习「平均脸」的数学本质,以及用户互动与审美打分器的反馈循环共同决定。