
数据来源: 腾讯研究院《从GPT到Sora谈AIGC与传媒变革》(主讲人:王鹏 | 腾讯研究院 资深专家,教授级高工)
传媒行业作为专业承载物与表达方式高度匹配新技术的领域,正面临生产与交互方式的根本性变革。当前行业核心痛点在于:
针对行业痛点,OpenAI 于 2024年2月 推出 Sora 模型,采用 Transformer+Diffusion 技术架构,通过时空patch实现视觉数据的统一压缩与处理。
主流视频生成模型参数对比:
模型 | 开发团队 | 推出时间 | 核心特点 | 生成视频长度 |
|---|---|---|---|---|
Gen-2 | Runway | 2023年6月 | 影视级构图运镜,最高4K画质 | 4~16秒 |
Pika1.0 | PIKA Labs | 2023年11月 | 语义理解能力强,画面一致性较佳 | 3~7秒 |
Sora | OPENAI | 2024年2月 | 突破性语义理解、复杂场景模拟、一致性 | 60秒 |
Sora支持多种输入方式,包括自然语言输入(结合GPT-4进行文本扩展)、图像输入,并具备自由调整构图、一句话改变视频背景的编辑扩展能力。
应用Sora及AIGC工具能够直接降低运营成本(Ops Cost)并提升开发效率,具体关键业务指标如下:
此外,Sora构建了3维一致的空间场景,可直接生成Minecraft游戏场景,Midjourney首席执行官 David Holz 判断未来可能实现 30帧/秒 的高分辨率实时生成。
基于Sora的多模态能力,内容行业已在以下场景展开应用:
Sora不仅是视频生成器,更是通向 AGI(通用人工智能) 的触角。其核心竞争力在于:
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。