深度求索上线DeepSeek V4.1 Flash模型,大幅压缩缓存成本;苹果发布首款折叠屏遭罗永浩与三星吐槽;OpenAI因算力紧缺暂停高阶订阅新增;马斯克The Boring Company获30亿美元融资。

深度求索正式发布全新架构的小尺寸模型 DeepSeek V4.1 Flash,原生具备多模态视觉理解能力。新架构主打更高能力上限、更快推理速度与更大吞吐量,可平滑扩展至更大参数规模。
该模型为 552B 参数的 MoE 架构,采用非对称的 Causal-Encoder-Decoder 结构,输入激活仅 8B,输出激活 16B,成本显著低于同尺寸模型。经更大规模强化学习训练后,其基准测试成绩超越了包括 DeepSeek V4 Pro 在内的旗舰模型。


新模型大幅优化了存储占用:相比前代,对 HBM 需求降至 1/4,对 SSD 需求降至 1/8。相对于初代模型,KV Cache 压缩至原来的 1/437,有效降低了高频调用场景下的开销。
目前该模型已在官方 API 上线,调用名称已统一为 deepseek-flash。

苹果发布旗下首款折叠屏手机 iPhone Duo 后引发行业热议。罗永浩公开表示,该机的折叠形态、屏下摄像头、矮胖比例、内外屏接力及悬停铰链等设计并无实质创新。他同时批评苹果为掩饰折痕而采用雾面屏,反而导致屏下前摄透光受损、局部打磨突兀。

老对手三星也在社交平台连续发文调侃,称苹果是在“重新加热剩饭”,并调侃其命名与多邻国吉祥物 Duo 撞名。

受 GPT-6 Astra 带来的巨大计算压力影响,OpenAI 首席产品官宣布暂时关闭每月 200 美元的 Pro 20X 新增订阅通道。官方表示此举旨在保障现有付费用户的稳定访问,目前 100 美元档位及 API 服务仍正常开放,团队正加速扩容计算资源。

免费获取企业 AI 成熟度诊断报告,发现转型机会








关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断