百度文心一言内测后,李彦宏复盘产品研发与竞争格局。他坦言文心一言目前相当于ChatGPT 1月份水平,存在客观差距,但强调唯有率先发布才能靠用户反馈驱动飞轮;同时指出创业公司不宜死磕基础模型,应聚焦垂直行业应用。
文心一言开启内测后,围绕其能力和差距的讨论持续升温。在与多位行业人士的对谈中,百度创始人、董事长兼首席执行官李彦宏复盘了文心一言发布前后的技术抉择、国际竞争态势,以及大模型生态下的创业路径。
「我们差不多是 ChatGPT 今年 1 月的水平,但大家早就忘了 1 月份它是什么样子。」李彦宏坦言,文心一言目前确实不完美,与 GPT-4 存在差距,但先发优势和快速迭代至关重要。
针对外界传闻的「40 天冲刺」,李彦宏表示百度早在 2019 年就推出了文心 1.0,长期深耕语言大模型。ChatGPT 发布后,内外部压力剧增。在发布前两个月的高压期,他最终拍板文心一言必须在 3 月推出。
李彦宏解释,即便首发版本有瑕疵,唯有尽快走向市场,才能借由高频反馈实现快速演进。很多用户由于环境限制无法直接使用 ChatGPT,市场需求极其旺盛。在产品内测后,每日收到的反馈中有三分之二指出了问题,但这恰恰是驱动产品进化的动力。依靠用户真实反馈来驱动技术迭代,远胜于闭门造车。

谈及与 OpenAI 的技术追赶,李彦宏回顾了研发过程中的起伏:内部评测曾一度接近早期 ChatGPT,但随着对方版本快速迭代,差距一度再次拉大。如今文心一言基本处于 ChatGPT 年初的水平。
面对竞争,百度依赖「芯片层、框架层、模型层、应用层」的四层架构实现端到端优化。昆仑芯片、飞桨框架与文心一言相互协同,提升了整体计算与训练效率。此外,文心一言还具备两项关键能力:一是检索增强生成(RAG),结合百度二十多年的搜索引擎积淀,有效降低了大模型的「幻觉」现象;二是知识增强,通过融入超 5500 亿条知识图谱,在中文事实、文化语境以及特定任务处理上具备针对性优势。
李彦宏透露,百度内部的搜索、小度、贴吧、文库等业务正全面集成文心一言能力,大模型不仅是一笔巨额算力投入,更将通过业务赋能与商用化带来直接收益。

大语言模型的兴起重塑了云计算的底层逻辑。过去云计算主要销售 CPU、GPU 和存储等基础算力,而在 AI 时代,大模型正成为新型操作系统的基础设施,应用将直接基于模型构建。
针对创业公司的机会,李彦宏明确表示:初创团队不应再去碰基础大模型。当前头部大厂在算力、数据和资金上的投入极高,创业公司缺乏这些要素,去重复造轮子胜算极低。相比之下,以下两个方向潜力巨大:

关于开源与闭源的路线竞争,李彦宏认为这最终由市场选择决定。开发者关注的是效果与性价比,闭源模型若想维持生存,必须在性能上显著领先开源模型。大模型在越过千亿参数门槛后展现出的「智能涌现」,本质上是人类对物理世界的理解被高度压缩进模型的结果。随着数据飞轮的转动,大模型生态的竞争壁垒正日益加深。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断