Hugging Face 宣布 Baseten 成为 Inference Providers 的最新服务商。开发者可通过统一 API 调用 Baseten 托管的开源模型,获得生产级 GPU 推理能力,省去自建基础设施的麻烦。
Hugging Face 今天宣布,机器学习推理平台 Baseten 正式加入 Hugging Face Inference Providers,成为该生态的最新合作伙伴。这意味着开发者可以通过 Hugging Face 的统一 API,直接调用 Baseten 托管的开源模型,无需单独配置底层基础设施。
简单来说,Inference Providers 是 Hugging Face 推出的一套标准化推理接口。过去,开发者想在应用里使用开源模型,通常需要自己租 GPU、部署服务,还要处理扩容和运维。现在通过统一 API,可以快速接入多家供应商的推理能力,按需付费,灵活切换。Baseten 加入后,用户的选择又多了一个。
Baseten 一直专注高性能模型推理服务,底层基于 Kubernetes 和 GPU 集群构建。它的特色包括冷启动快、自动扩缩容、细粒度监控,以及稳定的生产级 SLA。对开发者而言,这意味着从测试到上线,模型推理环节可以更放心地交给专业服务。对 Hugging Face 来说,Baseten 的加入丰富了供应商生态,也让不同场景下的推理需求有了更匹配的选择。
目前,双方已经在部分热门模型上完成集成,开发者可以在 Hugging Face 的 Inference Providers 页面找到 Baseten 并开始使用。具体接入方式、模型列表和计费细节,可参考 Hugging Face 官方博客。对于正在做 AI 应用开发、又不想被基础设施绑定的团队来说,这是一个值得关注的新选择。
Hugging Face 近年一直在推动模型与推理层的解耦,让开源模型更容易落地到实际产品中。Baseten 的加入正是这一趋势的延续。接下来,可以期待更多推理供应商进入生态,为开发者提供更多样化的性能与成本平衡。
原文链接:Hugging Face
本文由前途科技编辑整理
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断