Liquid AI在Hugging Face开源多模态决策模型open-d1系列。该模型专为边缘计算场景设计,兼顾轻量化参数与实时推理,使机器人与嵌入式设备无需依赖云端即可完成多模态环境感知与自主决策。
Liquid AI 近日在 Hugging Face 正式开源了其最新的多模态决策模型系列——open-d1。该模型专为边缘设备打造,旨在让低算力、低功耗的终端硬件直接具备实时环境理解与自主决策能力。
当前主流的多模态大模型大多依赖云端数据中心的大规模 GPU 集群运行。然而,在无人机航行、工业质检、服务机器人以及各类嵌入式物联网场景中,网络延迟、带宽消耗和隐私限制使得云端推理难以满足实时交互的要求。
open-d1 的核心目标正是解决这一矛盾。Liquid AI 将自身在高效动态架构领域的积累融入该模型,使其在极低的参数规模下,依然保持出色的视觉-语言联合推理能力,能够在资源受限的边缘计算单元上实现低延迟本地运行。
与传统侧重对话生成的通用视觉语言模型不同,open-d1 的设计初衷是驱动物理世界的感知与行动:
目前,open-d1 的模型权重与部署代码已全量上线 Hugging Face。开发者可以将其直接部署在各类边缘开发板、车载计算平台或机器人主控设备上,快速搭建离线可用的具身感知原型。
业内分析认为,随着端侧模型从简单的分类检测走向具备因果推理与复杂决策的多模态架构,open-d1 这类开源轻量模型的推出,将进一步降低具身智能与智能边缘硬件的研发门槛。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断