3月11日至12日,据The Information报道,OpenAI计划将Sora的视频生成能力直接整合进ChatGPT。这意味着,未来用户可以在ChatGPT对话框里用一句话生成视频,就像今天生成图片一样方便。这一动作被视为OpenAI应对Sora独立应用增长乏力的关键转向。
事件详情:视频生成走进9亿人的对话框
根据报道,整合方案的核心要点包括:
- 入口升级:Sora的文本生成视频能力将成为ChatGPT的内置功能,用户通过文字提示即可生成视频,与现有的图像生成工具体验类似;
- 用户规模跃升:ChatGPT目前拥有约9亿周活跃用户,而Sora独立应用的用户量与之相差两个数量级,整合意味着视频生成能力一夜之间触达全球最大的AI用户池;
- 双轨并行:OpenAI计划保留独立的Sora应用,ChatGPT整合版与独立版将同时存在,分别服务轻量尝鲜用户和重度创作者;
- 时间表未定:目前尚无明确的上线日期和定价方案,OpenAI官方也未对此置评。
值得注意的是,Sora独立应用自2025年9月上线后表现远不及预期:到2026年1月,其安装量下滑了约45%,并跌出了美国App Store总榜前100名。把王牌能力收拢到超级入口,被视为止损与突围的必然选择。
背景分析:超级入口的虹吸效应
OpenAI的产品哲学在2026年愈发清晰:ChatGPT正在从一个聊天机器人,进化为”一切AI能力的总入口”。此前,图像生成、深度研究、智能体操作电脑等能力都是先独立验证、再收编进ChatGPT的老路,Sora只是最新一个。
这种策略背后是残酷的流量现实。在应用商店里,一个独立的视频生成App要与TikTok、Instagram、CapCut等短视频巨头争夺用户注意力,获客成本极高;而在ChatGPT内部上线,9亿周活用户天然就是冷启动流量,边际获客成本几乎为零。
竞争格局也在倒逼这一决策。谷歌的Veo、Meta的视频生成工具、可灵等国内外对手都在加速迭代,视频生成正从”炫技Demo”进入”日常工具”阶段。谁先把视频生成做到”随手可用”,谁就可能定义下一代内容创作入口。
影响展望:视频生成大众化的双刃剑
如果整合落地,最直接的影响是视频生成能力的真正大众化。今天,视频生成仍是少数创作者的玩具;明天,任何一个ChatGPT用户都能为PPT配一段演示视频、为孩子睡前故事生成动画。这种”能力平权”将催生全新的内容形态,也可能重塑短视频平台的供给结构。
但硬币的另一面同样锋利:深度伪造与虚假信息的风险将随用户基数同步放大,版权争议(训练数据中影视素材的使用)可能迎来新一轮诉讼;更现实的是成本——有测算称Sora相关推理成本到2030年可能累计超过2250亿美元,如此烧钱的业务如何定价、是否向免费用户开放,都是OpenAI必须回答的问题。
无论如何,Sora走进ChatGPT标志着AI视频正式告别”独立应用时代”,进入”基础设施时代”。视频,将和文字、图片一样,成为大模型最基础的输出模态之一。
对内容行业而言,Sora进入ChatGPT可能重演当年“AI绘画进对话框”的一幕:先是尝鲜者的狂欢,然后是模板化内容的泛滥,最后是真正懂叙事的人脱颖而出。工具门槛消失后,稀缺的永远是创意本身。而对短视频平台来说,真正的冲击不在供给端,而在“创作-分发”链条的重构——当每个人都能在聊天框里造出一条短视频,平台的护城河将从“谁能做内容”转向“谁能分发好内容”。