DeepSeek 上线 V4.1 Flash 并大幅降价,再次掀起大模型额度狂欢。从 OpenAI 的“重置之神”到国内厂商的降价卷王,大厂正通过“赛博义父”式的额度恩赐与极致性价比,打响争夺开发者生态的暗战。
在 DeepSeek 测试 V4.1 Flash 中间版仅两天后,该模型便正式上线。
V4.1 Flash 是一个总参数 552B 的 MoE 模型,采用 Causal-Encoder-Decoder 非对称架构,输入激活仅为 8B、输出激活 16B,原生支持多模态视觉理解。通过 KV Cache 压缩,该模型将显存需求降至上一代的四分之一,社区实测输出速度达到 300 至 500 tokens/秒。虽然轻量且快速,其性能却全面超越 V4 Pro,GPQA Diamond 评测达到 90.9。
伴随性能提升的是大幅降价:闲时缓存命中输入降至 0.02 元/百万 Token,未命中 1 元,输出 4 元,比此前下调不少。DSH 负责人崔添翼随后宣布,V4 Pro 的请求将全面自动路由至性能更高、速度更快的 V4.1 Flash,计费也按 Flash 执行。由于 Pro 原本价格是 Flash 的 3 倍,这一变动直接为开发者省下了大笔调用成本。
在开发者群体中,这类动辄赠送额度或主动降价的大厂产品操盘手,被形象地冠以“赛博义父”之名。从海外到国内,一场围绕额度与定价的生态暗战早已全面打响。
大模型圈的“赛博义父”文化最初源于海外,走的是高频互动的“恩赐派”路线,核心打法是不定期发放额度重置福利。其中最具代表性的人物,是 OpenAI 的 Codex 负责人蒂堡特·索蒂奥(Thibault Sottiaux,社区常称 Tibo)。
Tibo 曾参与 DeepMind 的 AlphaGo 基建,加入 OpenAI 后接手 Codex。2025 年底系统故障频发期间,他通过补偿额度安抚用户,随后演变为常态化的营销仪式。Codex 活跃用户每突破一个百万大关,Tibo 就会在社交平台上宣布全员重置额度,甚至多次取消 5 小时调用速率限制。社区为此专门搭建了监控网站,记录显示他已重置额度数十次。

2026 年 6 月,Codex 进一步推出“库存重置”(Banked Reset)机制,将重置券直接存入用户账户,赋予其 30 天内自由选择兑换窗口的灵活性,有效锁定了开发者的长期留存。
在 Google 阵营,负责 AI Studio 和 Gemini API 的洛根·基尔帕特里克(Logan Kilpatrick)则被称为“白嫖大使”。洛根将 AI Studio 的免费调用额度大幅放宽,Gemini 3 Pro 的每日免费额度一度达到 250 次,折合单月免费算力价值超百美元。此外,Google 针对学生群体赠送 12 个月的 AI Pro 订阅,并向新绑卡用户发放有效期 3 个月的 300 美元云服务额度,以几乎零门槛的方式迅速做大开发者基数。
Anthropic 的开发者体验负责人雷蒂亚·哈莉(Lydia Hallie)同样深谙此道。在社区抱怨 Claude 限额过紧时,她一边推出官方免费课程,一边在竞品发布新品的敏感节点主动重置 Claude Max 用户周限额,用实打实的计算资源对冲流失风险。
如果说海外巨头擅长营造福利氛围,国内大模型厂商走的则是截然相反的“定价派”路线:不搞复杂的抽奖和兑换券,直接以技术迭代把 API 价格打穿。
DeepSeek 创始人梁文锋推崇理性透明的商业逻辑,以模型开源结合极限低价重塑市场预期。尽管期间由于算力供需波动经历过价格调整,但随着 V4.1 Flash 的面世,官方不仅把调用单价重新压至极低水平,更直接通过底层路由为老模型用户自动“升配降费”。

另一家代表厂商智谱同样在开发者生态上激进扩张。从早期的 GLM-4 Flash 免费档,到今年初宣布永久免费、不限 Token 上限的 GLM-4.7 Flash,智谱持续压低入门门槛。此前在开源社区引发热议的匿名模型“牛来”(即 GLM-5.3-Flash),在以百万级上下文和多模态性能登顶第三方榜单后全面开源,并将商业化定价定在旗舰模型的十分之一。
国内厂商的共同逻辑在于,将“极致便宜”沉淀为产品的核心竞争力,宁可在短期内压缩利润空间,也要把开发者牢牢吸附在自身的生态之中。
看似慷慨的“赠送”与“补贴”,本质上是一场精密的商业博弈。
对厂商而言,额度重置类似于健身房会员机制:大部分用户根本无法完全消耗已购买的算力峰值。重置动作只是释放了本就存在闲置冗余的边际算力,边际成本极低,却能在开发者心中建立巨大的心理账户收益。相比动辄数亿美元的传统品牌广告,将算力转化为福利直接注入账户,用户感知度和转化效率要高得多。
更重要的是,额度已经成为狙击对手的战略武器。每当友商发布新架构、新模型试图吸引眼球,竞争对手往往会在数小时内发起全员额度重置或无限制访问,以最直接的方式打断用户的迁移冲动。
两派路线的差异,折射出海内外市场发展阶段的不同。OpenAI 和 Anthropic 拥有稳固的高客单价订阅基础,恩赐派打法能在不破坏基本盘定价体系的前提下维系开发者粘性;而国内大模型厂商尚处于争夺开发者心智和生态入口的关键期,缺乏深厚的订阅沉淀,唯有依托底层架构创新带来的降本空间,以破坏式定价抢夺增量市场。
当技术性能的代差逐渐收窄,如何让开发者用得起、留得下,正成为决定大模型竞争下半场走向的胜负手。
免费获取企业 AI 成熟度诊断报告,发现转型机会








关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断