在2026外滩大会上,墨芯人工智能展示了自研专用稀疏推理芯片与AI计算卡。通过软硬件协同减少冗余计算,墨芯推理集群已在四大区域数据中心落地,并宣布即将发布新一代SparsePrime计算卡。
在以“共创AI新经济”为主题的2026 Inclusion·外滩大会上,墨芯人工智能作为蚂蚁集团生态合作伙伴亮相,现场展示了自研AI计算卡产品,系统呈现了利用专用稀疏推理芯片提升算力效能的技术路径。

当前,人工智能技术正加速渗透至数字空间与物理世界,推动AI产品和服务加速成型。这一趋势带动了算力消耗的爆发式增长,尤其是推理侧算力需求攀升显著。
面对高昂的计算成本与能耗压力,单纯增加硬件堆叠已难以为继。如何在同等算力预算下完成更多推理任务、提升算力能效比,成为大模型服务实现商业化规模落地的核心前提。
针对动态增长的推理负载,墨芯选择从底层计算模式切入。作为稀疏计算路线的代表企业,墨芯通过算法、软件与硬件三位一体的协同优化,利用专用稀疏推理芯片剔除无效计算,在有限芯片面积和功耗下提升有效算力产出。

商业化落地方面,墨芯基于自研芯片构建的推理集群,已在西北、西南、华东及华北四大区域的数据中心完成部署。结合区域产业结构,相关算力已被应用于智能制造、生命科学及城市治理等实际生产场景。
面对大模型推理日趋复杂的调度需求,墨芯同步透露,即将推出新一代SparsePrime®计算卡。新产品将重点优化计算架构与动态数据调度机制,进一步应对高并发、长上下文的推理场景。
除了硬件迭代,稀疏计算的规模化应用还依赖产业生态适配。
在生态布局上,墨芯已于今年7月成为工信部人工智能标准化技术委员会成员单位,参与AI基础硬件、软件栈及大模型标准的研制,旨在降低上下游开发者的适配门槛。此外,墨芯在8月发起成立了稀疏计算产学研联盟,围绕底层理论攻关与成果转化推动技术成果快速落地千行百业。
免费获取企业 AI 成熟度诊断报告,发现转型机会








关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断