论文解读、算法突破、架构分析
面对复杂的多步长程推理,传统Agent容易迷失在海量上下文中。Meta提出元推理框架,将决策大脑与执行单元彻底解耦,配合紧凑状态与产出物图谱,让AI算力投入获得确定性的ROI回报。
当单靠刷榜的大模型迭代逐渐放缓,AI 竞争的主战场正转向 Agent Harness。决定智能体真正上限的,不仅是底层基模能力,更是包围它的状态机、工具链与容错闭环框架。
大模型调用工具出错时,报错重试或后台静默修补都会在上下文留下错误痕迹,导致后续推理变形。其实还有第三种解法:时间旅行式篡改历史。抹掉错误记录,让它以为自己一次就做对了,推理质量反而更高。
随着AI从单纯回答问题转向智能体解决现实任务,算力重心正从GPU训练吞吐向端到端低延迟迁移。英特尔在Connection大会上提出,CPU正成为AI推理的核心调度中枢,并通过端侧异构芯片破局具身智能。
Anthropic 宣布建立生命科学实验室,并公布一项早期研究成果:约 950 个 Claude 智能体耗时 21 小时,自主发现了一种具有类似 CRISPR 特征的新型逆转录酶系统(ART),展示了 AI 加速生物学发现的强大能力。
SpaceX星舰第14次试飞将打破前13次的亚轨道惯例,首次真正进入约275公里的近地轨道,运行近10小时并绕地六圈。这次任务不仅要验证长时间在轨推进剂与姿态管理,还将首次在轨部署26颗Starlink V3卫星,标志着星舰正从飞行验证迈向真正的轨道运输。
技术博客与 Go 官方博客本周同时更新:一篇纠正关闭 channel 的常见误解并系统梳理并发机制,另一篇介绍 1.26/1.27 新增的跨平台 SIMD 实验 API,覆盖 amd64、arm64 和 wasm。
开源推理框架Colibrì在GitHub斩获超3万Star。该框架利用MoE稀疏激活特性与多层内存调度机制,直接将SSD作为模型后备存储,仅凭普通CPU和24GB内存即可运行744B参数模型,大幅降低超大模型本地运行门槛。
在云栖大会上,米哈游揭秘了其AI游戏研发与玩法落地的完整技术布局。从具备多层记忆与情绪表达的AI NPC,到内部协作研发的多Agent平台,再到用强化学习自进化的游戏闭环,米哈游正在押注千亿打造全新的动态互动体验。
推理初创公司Inferact通过手写megakernel与结合DeepSeek的DSpark推测解码框架,让16块谷歌TPU v7运行Kimi K3的速度达到每秒709 Token,比英伟达GB200快57%,相关代码已全面开源。
阿里平头哥在发布新一代真武V900芯片后,宣布进一步开源类CUDA软件栈T-Head SAIL,涵盖框架适配、算子优化与通信库。此举意在降低代码迁移门槛,让开发者与头部企业能够深度参与算子定制与底层调优。
Meta 在 Connect 大会上推出手持 AI 设备 Muse Charm;谷歌计划发射搭载 TPU 的试验卫星探索太空计算;Anthropic 内部测试揭示高阶 AI 具备更强议价能力;表演艺术家游本昌逝世。
高通推出2nm旗舰芯片第六代骁龙8超级至尊版。该平台针对端侧AI智能体彻底重构CPU、GPU和NPU架构,突破5GHz主频,支持端侧运行300亿参数MoE大模型,标志着移动计算全面迈入智能体时代。
机器人仿真正在全面转向GPU原生并行计算。NVIDIA Warp与MjWarp通过将Python代码即时编译为CUDA内核,结合MuJoCo物理引擎,实现了数万个环境的极速并行交互,大幅缩短强化学习训练周期。
从实验室首次点亮到AI工厂规模化部署,硬件验证是系统稳定的核心。NVIDIA揭示了验证团队的工程实践,展示工程师如何跨越芯片、固件与散热架构,确保Rubin等系统在极端负载下可靠运行。
Puffer 宣布与 Google Cloud 合作,由后者作为 Gateway 节点支持 Puffer UniFi 执行层并提供执行预确认。此举将企业级云服务直接嵌入以太坊原生排序架构,为解决 L2 性能与主网安全性割裂提供了新方案。
DeepSeek创始人梁文锋等署名公开最新架构论文,揭秘面向AI智能体训练的弹性计算系统DSec。系统单日可生成超300万个沙盒,峰值并发38万个,解决了智能体训练中环境开销大、资源争抢及作弊突破等系统性难题。