论文解读、算法突破、架构分析
华为轮值董事长徐直军详解灵衢(UB)互联技术与Peerium计算架构。面对大模型集群通信瓶颈,华为通过统一总线协议与NPO光互联破局,推动百万级处理器高效协同,重新定义AI算力系统设计。
arXiv 论文提出“语言不可读性”概念:模型说出的话或被探测出的语言特征,可能并不反映它真实的计算过程。作者主张,依赖模型语言自述的安全机制永远无法完全可靠,沙箱需要不依赖读取语言状态的隔离手段,并推荐污点追踪。
安全机构 Air 披露名为 Plugin4Shell 的高危漏洞,波及 Claude Code、Codex、Copilot 等主流 AI 编程智能体。攻击者可绕过插件校验实现零点击远程代码执行。目前 Anthropic 与 OpenAI 已修复,微软暂未修补。
同时跑多个 Claude Code 智能体,最怕任务卡在权限确认却浑然不知。开源工具 Skipper 针对这一痛点,通过原生 Hook 实时推送桌面提醒,支持跨会话状态追踪与手机语音监控,纯本地运行零外部依赖。
Anthropic研究员Jacob Coxon的辞职信引爆AI安全争论后,Wired播客梳理了专家最担忧的三类末日场景——供水系统被黑客攻击、生物武器与自主机器人,也回顾了发出末日警告的理性主义社群的历史。
雷峰网独家获悉,腾讯混元大语言模型预训练负责人姚星丞已于近日加入Thinking Machines Lab,该公司由前OpenAI CTO Mira Murati创办。姚星丞今年7月从腾讯离职,此前曾传出将加入Meta,最终选择了这家北美创业公司,据悉薪资明显高于其在腾讯的收入。
联合国与Google合作推出UN System Data Commons,用自然语言和MCP协议让AI系统直接调用官方统计数据,替代旧版UNData门户。背景是联合国儿童基金会测试发现,六款主流大语言模型回答全球发展数据问题的平均准确率仅21.2%,约六成回答给不出可用数字。已有26个联合国机构承诺加入,目标2027年接入体系内80%统计数据集。
Wispr Advanced Interfaces Lab 发布语音识别模型 Canto,在包含 2300 多名真实用户、10 小时听写录音的评测集上,词错误率低于 Google、OpenAI、AssemblyAI、Deepgram 等对比模型,训练采用监督微调加 GRPO 强化学习两阶段方法。
vivo 在 2026 开发者大会上发布原系统 7、蓝河操作系统 4,并公布 AgentOS 技术预览版:蓝心 Harness 已将 6000 多项原子技能转化为 Agent 可调用工具,蓝河系统底层支持 Agent 调用 Shell、Python 等两万多个接口,新版蓝心小 V Pro 可自主拆解任务并跨应用、跨设备执行。
蚂蚁集团在2026外滩大会发布APASS,通过身份核验、授权分级与意图比对,为智能体自主完成支付类任务建立信任基础设施,目前已接入超100万个Agent,激活量11万个。
PrismML 发布 Ternary Bonsai 2 27B,用三元权重(-1/0/+1)加 FP16 分组缩放将 27B 模型压缩到 5.9GB,体积缩小 9 倍以上,保留全精度版本 98.2% 的基准性能,以 Apache 2.0 协议开源,可在 NVIDIA GPU 和苹果设备上运行。
谷歌近日发布 Gemini 3.8 Live 与 Extended Thinking 两款实时对话模型,解决语音 Agent 执行任务时的"沉默时刻"问题;同期腾讯 WorkBuddy、百度搭子与小度等也在把 Agent 接入硬件设备,触达聊天框之外的现实场景。
Uber 工程团队在官方博客中详解重试风暴的成因:单点故障沿深层调用链被逐跳重试放大,最终演变成全站级事故。除了现有的重试预算机制,Uber 提出用"错误归属"区分症状与病因,让系统判断该由哪个节点重试、哪个节点该放弃,把重试风暴的影响范围限制在故障源附近。文章配图显示,该机制曾在一次重大服务降级事件中拦截950万次多余请求。
编程语言 Bend 通过在代码中声明不可违反的规则(LAWS.bend),并要求 AI 生成对应的数学证明(PROOF.bend)来拦截错误改动;同一份代码可编译为原生程序,单核接近C语言速度,也能跑在16核或GPU上,官网称GPU并行最多比单核快上百倍。项目仍处于早期阶段,官网提示可能存在bug。
近期两篇独立博客文章分别讨论了LLM对写作和编程两种技能的影响:sockpuppet.org提出用LLM当编辑而非代笔的两条规则;blog.ploeh.dk的Mark Seemann则公开回复一位读者关于是否还要系统学编程基础的来信。
第叁范式发布 M3EM Studio 2026 R2,称为国内首款 GPU 原生跨尺度系统级电磁仿真软件,在封装基板、5G 手机整机及智能汽车天线仿真中完成亿级网格验证,关键指标据称与国际主流商业软件结果高度吻合。
AutoBot 是一个开源的自我改进智能体外壳,依托 macOS 上的 ChatGPT 桌面版运行,通过分层记忆和持久任务图让长任务在执行者被替换后仍可接续完成。据 GitHub 项目页披露的基准数据,其在 OSWorld 2.0 上以 32.41% 的二元准确率超过 Claude Opus 5 Max,并在 AssistantBench 官方隐藏测试排行榜上以 50.70% 的准确率排名第一。