视频创作平台 Pollo AI 深度集成 OpenAI 多模态模型,推出 Pollo Agent 及商品图转视频广告等功能。借助大模型推理与图像生成能力,该平台帮助超 2600 万用户快速将抽象创意转化为高质感营销视觉与成片。
即使在生成式 AI 快速普及的今天,创作者和营销人员在不同工具与模型之间来回切换时,仍常面临操作繁琐、难以获得理想效果的困境。
Pollo AI 的成立初衷正是打破这一壁垒,让缺乏专业制作经验的用户也能轻松把灵感转化为成熟的图像和视频。Pollo AI 创始人兼首席执行官 Bill Zhu 表示:“我们希望像 Canva 改变设计行业那样重塑视频创作,让更多普通人都能轻松上手,而不仅限于专业创作者。”目前,Pollo AI 已服务超过 2600 万用户,广泛应用于视频短片、广告以及各类视觉素材的制作。
团队早期的突破在于视频模板,目前已有 30% 的创作任务从这些模板或流行工作流中发起。在此基础上,Pollo AI 近期推出了全新产品 Pollo Agent。该智能体依托 OpenAI 的前沿模型(包括 GPT-6 Astra 和 GPT-Image-2.5),为用户提供端到端的引导式视频创作流程。
在创作过程中,Pollo Agent 能够解析用户提供的模糊构想和参考图像,自主构思故事线、镜头流与分镜头脚本。Pollo AI 首席技术官 Peter Zhou 指出,OpenAI 模型在理解抽象、模糊的创意输入方面表现出众,其多模态能力尤为关键,其中 GPT-5.6 在此类任务中表现亮眼。此外,API 的高稳定性与稳定的更新节奏也是团队看重的重要因素。
为了平衡推理深度、响应速度与调用成本,Pollo AI 采取了模型分流策略:由 GPT-5.6 负责请求路由,而复杂的叙事构建和分镜修改则交由 GPT-6 Astra 处理。这种组合让系统能够依据用户的提示词复杂度动态分配算力。数据显示,这一架构让用户在挑选和切换模型上花费的时间减少了 50% 以上,得以将更多精力集中在创意本身。
在图像生成环节,团队对候选模型在输出质量、一致性、风格跨度、速度与成本等维度进行了全面评测,最终选定 GPT-Image-2.5 负责海报、分镜板和营销视觉的生成。Peter Zhou 表示,涉及各类角色与复杂文字排版的图像生成任务,团队均优先调用 GPT-Image-2.5。
除内容创作者用于制作 AI 微短剧外,越来越多的品牌商家也开始使用 Pollo AI 快速制作营销素材。其营销套件中的“商品图转视频广告”(Photo to Video Ads)功能,能够基于一张静态产品图和简短提示词,在数分钟内生成契合社交媒体投放的短视频,大幅缩减了传统制作周期。
例如,一位用户希望为一款香水制作具备高级感的广告,但手头仅有一张普通产品照,且无力承担昂贵的实拍预算。借助该工具,用户在几分钟内便获得了一条约 15 秒的成片:画面自动生成了天鹅绒质感背景、柔和的聚光灯与瓶身特写,镜头在深红布景的衬托下平稳收尾,精准传递了奢侈品调性。
另一家珠宝品牌则借助 Pollo Agent 和 GPT-Image-2.5,实现了高概念影棚拍摄的效果。在生成的视觉大片中,佩戴品牌饰品的模特倚靠在猎豹身旁,暗色帷幔与暖调光影交织,既突出了珠宝细节,又兼顾了艺术质感,制作成本和周期远低于传统线下拍摄。

在创意延展方面,某饮料品牌希望为其白桃汽水打造富有童趣与想象力的广告画面。通过 Pollo Agent 与 GPT-Image-2.5,原本单一的饮料瓶身被自然融入到包含火车、小蜥蜴与晶莹水滴的微缩雪景之中,形成了极具视觉冲击力的营销海报。

Pollo AI 计划在未来一年内推动 AI 视频成为日常内容创作的标准组件。在团队看来,关键在于持续降低从灵感构思到成品输出的门槛,让生成效果更具确定性。
Bill Zhu 认为,内容创作领域的 AI 变革,最终将青睐那些能从一开始就提供标准化流程、减少反复试错、并围绕底层模型建立极简工作流的产品。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断