清华大学副教授代季峰创立的 Naive AI 在成立短短7个月内完成三轮融资,总额达4亿美元,估值突破14.2亿美元。这家低调的创企凭借深厚的学术积淀与工程能力,主打后训练与智能体研发,吸引了红杉、腾讯等顶级机构。
一家几乎没有任何对外宣发的初创公司,在成立仅7个月的时间里完成了三轮融资,累计融资金额高达4亿美元,投后估值达到14.2亿美元。
这家公司名为 Naive AI(工商注册名为北京智衍慧生科技有限公司)。在其官网上,除了一个招聘邮箱和一句简短的英文标语外,几乎看不到任何产品介绍或团队合影。然而,在顶级投资机构眼中,这家公司的吸引力源自其核心创始团队——由清华大学电子工程系副教授代季峰率领的8人科研与工程团队。

代季峰的科研履历堪称豪华。2014年博士毕业后,他加入被誉为“中国 AI 黄埔军校”的微软亚洲研究院(MSRA)视觉计算组,师从已故计算机视觉学者孙剑。在 MSRA 期间,他作为核心成员接连斩获 ImageNet 与 MS COCO 竞赛冠军,并提出了重塑目标检测底层逻辑的“可变形卷积”(Deformable Convolution),该算法后来成为 PyTorch 等深度学习框架的标准算子。

正是在 MSRA,代季峰结识了中科大联培博士朱锡洲。朱锡洲后来成为代季峰最长期的科研搭档,两人合力提出了被学术界与工业界广泛引用的 Deformable DETR,在谷歌学术上的引用量突破1.2万次。

2019年,代季峰与朱锡洲转战商汤科技。在这里,团队吸纳了专注 AI Infra(底层算力架构)的南洋理工博士孙鹏。孙鹏曾主导大规模分布式训练优化,在512张 GPU 集群上将 ImageNet 训练时间压缩至90秒。算法创新与大规模工程底座的结合,初步构筑了这支团队的完整能力闭环。
商汤期间,负责自动驾驶感知的陈韫韬也加入其中。陈韫韬曾任职于图森未来与辉羲智能,后来推出了专注于交互式世界模型的数据集 DrivingDojo。与此同时,代季峰团队在自动驾驶端到端算法领域取得关键突破,其参与的 UniAD 斩获了 CVPR 2023 最佳论文奖。

2022年,代季峰回归清华大学任教,并加入上海人工智能实验室(上海 AI Lab)。在这里,团队阵容进一步扩大:

在经历早期与产业资本的合作探索后,代季峰于2026年2月正式成立 Naive AI。与多数从零训练基础大语言模型的初创公司不同,Naive AI 选择了独特的差异化路线:放弃高成本的基础预训练,专注于开源基座的结构优化、中期训练与强化学习(即后训练路线),全力攻关 Agentic AI(智能体)与持续学习。
近期,Naive AI 正式推出了首款开源模型 Naive-N0.5-Flash。该模型采用 309B 参数的 MoE(混合专家)架构,激活参数为 15.5B,原生支持百万 Token 上下文窗口。该模型基于开源底座 MiMo-V2.5 进行深度后训练,主打代码生成与 AI 自主研发任务,验证了团队“以低算力换取高效率”的技术理念。
从成员背景看,这支8人核心团队的论文总引用量已超过24万次,平均年龄不足35岁。投资方包括红杉中国、腾讯、博裕资本、IDG资本、经纬创投等多家一线机构。在通用人工智能探索进入深水区的当下,这支兼具底层算力调优、视觉多模态算法与工程实战经验的本土青年团队,正在成为大模型赛道中不可忽视的硬核力量。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断