论文解读、算法突破、架构分析
Google 向第三方 AI Agent 开放 Google Home 生态,支持 MCP 协议的 Agent(包括 Claude、ChatGPT)可接管智能家居设备和历史事件数据,早期访问面向高级订阅用户。
Nvidia 正式推出 CUDA Rust,允许开发者用 Rust 直接编写 GPU 内核并编译为 PTX,不再需要将 Rust 包装成其他语言的调用层,覆盖 SIMT 和 Tile 两种编程模型。
一名 RTX 5090 Founders Edition 用户因显卡挡板序列号褪色至无法辨认,被英伟达拒绝保修申请;社区随后发现这是 RTX 50 系列的普遍问题,与前代产品的激光蚀刻工艺不同。
联发科发布旗舰移动芯片天玑 9600 Pro,采用台积电 2nm 首批制程,搭载 AI 原生融合架构,双超大核主频 4.55GHz,CPU 多核功耗较上代下降 61%,支持 120 帧光追游戏。
火山引擎算法工程师曾骞在 LAS 沙龙上海站总结三道最后一公里鸿沟:模型能力鸿沟、工程链路鸿沟、效果确定性鸿沟,并以具身智能、电商素材等三个案例说明生产化路径。
彭博亿万富翁指数显示,字节跳动创始人张一鸣财富突破 1050 亿美元,首次超越印度实业家阿达尼登顶亚洲首富。这是一场算法驱动的财富范式转移——亚洲最富有的人正在从重资产走向重算力。
据 The Information 消息,苹果正筹划重返服务器市场,产品配备 2 至 4 颗 M8 Ultra 芯片,正评估接入英伟达 NVLink Fusion,面向 AI 开发者、企业和政府机构,最早 2029 年上市。
Meta 正式上线 Meta One 套餐,将 Facebook、Instagram、WhatsApp 订阅与 AI 使用额度捆绑销售,个人版 7.99~19.99 美元/月,商业版最高 499 美元/月,AI 基础功能仍免费。
在AI音视频剪辑中,声音与画面的不同步累积(Voice Drift)一直是个令人头疼的工程难题。通过开源方案重构音画对齐管线,结合强制对齐算法与时域补偿,即可在保证自然听感的前提下实现毫秒级音画同步。
华为GTS算法团队针对网络运维中大语言模型的「拓扑失忆」痛点,推出可交互视觉拓扑方案NetCanvas。它为Agent提供可画线推演的外部工作记忆,双防火墙等复杂排障成功率从约10%跃升至90%,Token成本降低最高达45%。
Agent长上下文让大模型KV Cache急剧膨胀,挤占显存并拖慢首字响应。英特尔提出由CPU内存分层卸载并借助QAT硬件压缩,不仅降低最高30%存储占用,更实现首字延迟数倍优化。
OpenAI首款自研芯片创下9个月流片纪录,得益于博通工程底座与AI对RTL设计、验证的提效。面对大模型快速演进与硬件研发长周期的冲突,AI不仅重塑芯片开发范式,也在加速底层软硬件协同适配。
联发科发布旗舰芯片天玑9600 Pro,采用台积电2nm制程与全大核架构。在端侧AI智能体需要常驻后台的新需求下,芯片设计正从单核峰值性能竞赛,全面转向计算、存储与调度的系统级融合计算。
MIT工程量子系统小组将大语言模型GPT-5.6 Sol接入Codex,成功实现超导量子比特芯片的自动化校准与测量。该AI智能体可自主执行繁琐的常规测试,大幅缩短实验周期,显著解放科研生产力。
随着AI智能体从对话迈向实际行动,算力需求由纯算力堆叠转向低延迟与高能效。Arm展示了AGI CPU生态进展并发布Neoverse CSS N4,通过300瓦低功耗与统一软硬件平台,构筑AI基石。
英伟达开源工作流优化框架 SoL-Pi,利用 AI 自我迭代机制排查智能体运行中的冗余消耗。通过从 152 个自动化实验中筛选出的四大核心机制,该工具最高降低了 64% 的 Token 消耗,API 成本减少过半,每小时可为企业节省多达 13.5 美元。
在电力瓶颈制约算力扩张的背景下,NVIDIA公布AI工厂系统架构DSX的落地成果。通过电网柔性响应与智能动态调优,固定电力预算下的Token吞吐量提升24%,为算力基建破局指明方向。