钛媒体旗下平台 TiToken 推出算力优化产品 BackBy。针对文档分类、信息抽取等非即时任务,BackBy 将其调度至低价异步路径,助力企业在保障核心交互体验的同时,显著降低大模型的综合调用成本。
在 2026 ITValue Summit 数字价值大会上,钛媒体集团旗下产品 TiToken 正式推出算力优化服务 BackBy。TiToken 定位于多词元聚合与解决方案平台,其海外服务平台为 Opensand。整套平台集成了多模型 Token 中转、BackBy 算力优化以及 FDE(Forward Deployed Engineering)应用交付能力。

大语言模型落地过程中,许多业务场景并非都需要秒级即时响应。例如,智能客服问答和人工核对环节需要极低的延迟,适合走实时链路;而后台文档的字段抽取、批量分类以及长文本摘要等任务,具有较高的等待容忍度,更适合以批处理方式运行。
BackBy 的核心逻辑在于任务分流:将可容忍延迟的后台处理转入低价路径,避免为非即时任务支付昂贵的实时并发费用。在具体执行上,开发者可直接在 API Playground 中进行模式配置。任务提交后,BackBy 会自动调度至模型厂商的原生 Batch 批处理或其他合格低价通道,全流程负责路径分配、状态跟踪、结果回传及用量核算。
企业可通过交付报告(Delivery Report)实时查看所支持的非实时模型、各时间窗口报价及履约准时率。接入流程通常从特定非即时任务切入,通过样本与交付标准比对,验证处理质量、完成时限及实际节省的总费用。
BackBy 的底层依托 TiToken 与 Opensand 的算力聚合能力。其中,TiToken 覆盖国内主流基础模型,Opensand 则提供上百种出海模型支持,全线兼容 OpenAI API 标准,开发工具可无缝接入。平台负责底层新增模型的适配,调用端无需改动业务代码。
在模型性能测试中,平台对多家中转平台进行了对比测评。以 Claude 模型 claude-opus-4-7 为例,基于 Claude 官方 API 对比测算,Opensand 取得了 100% 的调用成功率,首字延迟(P95)为 3.75 秒,表现优于同期同类平台。
在交付层面,平台推行 FDE 模式,直接基于企业现有业务数据和业务流开发落地系统,目前已在三个典型场景投入使用:
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断