论文解读、算法突破、架构分析
SpaceX星舰第14次试飞将打破前13次的亚轨道惯例,首次真正进入约275公里的近地轨道,运行近10小时并绕地六圈。这次任务不仅要验证长时间在轨推进剂与姿态管理,还将首次在轨部署26颗Starlink V3卫星,标志着星舰正从飞行验证迈向真正的轨道运输。
从实验室首次点亮到AI工厂规模化部署,硬件验证是系统稳定的核心。NVIDIA揭示了验证团队的工程实践,展示工程师如何跨越芯片、固件与散热架构,确保Rubin等系统在极端负载下可靠运行。
Puffer 宣布与 Google Cloud 合作,由后者作为 Gateway 节点支持 Puffer UniFi 执行层并提供执行预确认。此举将企业级云服务直接嵌入以太坊原生排序架构,为解决 L2 性能与主网安全性割裂提供了新方案。
DeepSeek创始人梁文锋等署名公开最新架构论文,揭秘面向AI智能体训练的弹性计算系统DSec。系统单日可生成超300万个沙盒,峰值并发38万个,解决了智能体训练中环境开销大、资源争抢及作弊突破等系统性难题。
大模型架构正在向MoE(混合专家模型)加速迁移。从GPT-4到爆火的DeepSeek-V3,MoE凭借“大容量、低算力消耗”的稀疏激活特性成为主流。本文带你拆解其底层逻辑与极简代码实现方案。
敲代码变得前所未有地容易,但交付可靠软件却更难了。本文拆解从随意复制粘贴的“氛围编码”跃迁到企业级自主Agent架构的路径,通过ADK、GitOps与MCP构建生产级可靠系统。
在AI智能体快速落地的背景下,计算架构正迎来深刻转变。由于Agent涉及大量多轮工具调用、数据预处理和任务编排,英特尔指出AI集群中CPU与GPU的配比正从1:4迈向1:1,CPU的调度与执行价值亟待重估。
面对 AI 智能体带来的海量持续推理需求,浪潮信息推出元脑 SD200 Ultra 超节点与元脑 HC2000 机组,分别主打单机承载 10 万亿参数的能力型智算,以及异构协同降本增效的容量型智算,推动算力走向规模化智能生产。
oMLX创作者兼核心维护者Jun Kim宣布加入Hugging Face。他将重点推动Apple MLX开源生态与工具链的发展,帮助开发者在苹果芯片上实现更高效的模型部署与端侧AI创新。
行业预计到2035年将部署数千万台自动驾驶车辆与工业机器人。NVIDIA正式推出物理AI全栈安全系统Halos,横跨硬件、操作系统、模型与仿真验证,帮助企业跨过具身智能规模化商用的安全合规门槛。
AI智能体具备推理与调用工具的能力,也带来了全新的安全挑战。NVIDIA提出将AI安全视为工程问题,必须在模型、编排与运行时等全栈各层建立强制边界、沙箱隔离与责任人制度,推动全行业协同防御。
大模型参数飙升暴露出显存带宽与容量的增长瓶颈,GPU频陷数据等待窘境。传统分层存储因跨层迁移损耗面临失效,软硬件协同的无分层统一架构正在重塑AI基础设施,存力成为决定AI应用上限的核心底座。
OceanBase自研数据智能体方案在国际基准测试Data Agent Benchmark中取得90.62%的准确率,位列榜首。该方案基于国产大模型GLM-5.2构建,超越了基于GPT和Claude等海外模型的多项方案,展现了数据库与AI协同处理复杂任务的能力。
清华大学、无问芯穹等联合开源具身智能体基础设施RPent。系统连接通用大语言模型与精细操作模型,形成感知、规划到纠错闭环,在基准测试中任务成功率达92.6%,提速超7倍。
估值390亿美元的人形机器人独角兽Figure AI发布Helix 2.5,展示在30个陌生住宅完成家务的能力,并宣称发现了机器人领域的Scaling Law。然而其56%的综合成功率引发业内关于模仿学习路线与泛化能力的激烈争议。
工业自动化迎轮番涨价潮,但伴随制造业智能化与具身智能机器人爆发,工控机正成为工业现场AI落地的核心算力底座。从Jetson方案到600W高端GPU扩展,边缘计算正重塑工业计算格局。
苹果iPhone 18 Pro系列曝出死机自动重启故障,官方已启动调查;长鑫科技宣布第五代技术平台正式量产,晶圆产出提升超50%;特斯拉Roadster重新开放预订,定金33.2万元;Anthropic筹备IPO前推新模型。