随着AI深入业务流程,高昂的Token账单引发企业成本焦虑。微软、Meta等大厂纷纷削减内部模型调用额度,行业面临价值评估体系滞后与投资回报率难以核算的双重挑战。
随着人工智能进入深水区,如何在AI上避免“花冤枉钱”,成了全球企业共同面对的现实难题。
近期,科技巨头砍削AI预算的动作频出。据报道,微软此前曾计划为员工使用Anthropic的Claude模型投入超过10亿美元年度预算,如今已被压缩三分之一以上,云与AI部门的人均配额更是从每月10万美元锐减至约1万美元。另一家巨头Meta也将其内部Claude Code的使用人数直接减半,从约6万人缩减至3万人。在国内,多家头部互联网公司和半导体大厂也因收紧Token额度引发内部讨论。

成本管控已成为当下企业AI部署的新常态。相关行业调研显示,超过六成的企业已在项目审批或实际运营中建立起AI成本监控机制。然而,“节流”并不直接等同于“增效”。
当前企业普遍存在价值评估与成本管控脱节的矛盾。数据显示,仅有约12%的企业能持续将AI创造的实际价值与对应成本进行对照评估。德勤中国近期的报告也表明,尽管企业AI进入生产部署阶段的比例已升至64.4%,但无法明确核算AI项目ROI(投资回报率)的企业比例却从35.8%攀升至44.4%。
多数企业能够清楚看到AI究竟消耗了多少资金,却很难量化这些算力开销究竟带来了多少净利润提升。在成效评估上,超过八成的企业仍将重点放在“处理速度”与“工时节约”等表层指标,仅有约两成企业能够将成效直接关联到收入增长和客户获取。如果节省下来的工时没有重新注入到高价值业务中,单纯的效率提升并不能直接转化为经营成果。
成本控制难度陡增的另一个核心原因,在于AI落地载体的升级。企业已不再满足于让员工用AI写邮件、做PPT,而是开始部署自主性更强的AI智能体(Agent),让其嵌入核心业务系统,独立执行跨系统、多步骤的任务。
这种演进放大了AI的能力边界,却也导致Token消耗呈线性甚至指数级上升。过去由人工触发的交互频次变成由自动化业务流驱动,Token消耗量暴增,企业的预算管理压力骤增。部分技术团队开始探索以“单次任务成功交付成本”为核心指标,引入实时监控与预算熔断机制。
与此同时,Agent的权限治理同样棘手:权限开放过小,智能体无法有效完成复杂业务链路;权限开放过大,又容易带来无法预期的安全隐患和失控的接口调用开销。
企业兑现AI价值的关键,正从单纯追求基础模型的参数与智商,转向企业流程的重塑与组织协同。
行业领先团队正尝试建立分层评估体系,根据效率型、经营型和战略型任务分别设定回报周期与核算指标。专业机构建议,企业在引入Agent时需同步搭建治理驾驭层,将权限控制、调用编排、业务问责和经济性模型纳入底层设计,打通从Token开销到业务价值产出的闭环,才能让AI投入真正转化为可持续的商业回报。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断