Nvidia 正式推出 CUDA Rust,允许开发者用 Rust 直接编写 GPU 内核并编译为 PTX,不再需要将 Rust 包装成其他语言的调用层,覆盖 SIMT 和 Tile 两种编程模型。
2026 年 9 月,Nvidia 宣布推出 CUDA Rust,允许开发者用 Rust 直接编写 GPU 内核,编译到 PTX,而不再依赖将 Rust 包装成对其他语言内核的调用层。
Nvidia 表示,AI 系统层——包括推理引擎、服务基础设施、驱动和 Agent 运行时——越来越多地用 Rust 编写,因为 Rust 能在不牺牲性能的前提下,在编译阶段消除整类 bug。
Nvidia 的多个项目已经走上这条路:
唯一的例外是 GPU 内核本身——此前可以用 Rust 发起内核调用,但内核代码必须用另一种语言写。CUDA Rust 填上了这个缺口。
CUDA Rust 同时支持 CUDA 既有的两种编程模型:
Rust 在 AI 基础设施层的渗透正在加速:从推理框架(如 vLLM 的 Rust 组件)到 Agent 调度层,许多性能敏感的底层代码在向 Rust 迁移。CUDA Rust 让这一迁移路径延伸到最底层的 GPU 内核,减少了"Rust 层 + 外语内核"的复杂调用边界。
Nvidia 表示将在 2027 年及以后持续完善 CUDA Rust。目前 CUDA C++ 和 CUDA Python 仍是成熟的生产工具链,CUDA Rust 还在成长期,不建议立即替换生产级内核代码。
免费获取企业 AI 成熟度诊断报告,发现转型机会

关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断