
TechWeb
中国互联网科技商业资讯与创投报道
OpenAI推出的文本生成视频模型
Sora是OpenAI推出的文本生成视频模型,用户只需输入一段自然语言描述即可生成具有丰富视觉细节和场景连贯性的高清视频片段。
作为目前公开可用的视频生成产品中效果最好的之一,Sora代表了AI视频创作从概念到落地的关键突破。
该模型于2024年2月由OpenAI首次对外展示,立即在全球范围内引发了巨大的关注。
与Runway和Pika等此前已有的AI视频工具以较短的片段和比较受限的场景生成为主不同,Sora能够生成长达一分钟且含有复杂的人物动作和多变的摄影机运动的视频片段。
核心功能包含 4 个板块,按需取用:
输入自然语言描述生成富细节的高清视频片段
上传静态图片作为起始帧延伸出动态画面
用文字精细设定场景光照与镜头运动
保持主体与物理细节在长片段中的一致性
和同类站点相比,它的差异化价值在于:
与Runway的多模态编辑、视频特效、Gen-2的实时预览上的优势不同,Sora的核心飞跃在于对物理世界的理解和场景的一致性——一个杯子掉到地上碎掉的视频中碎片会自然地散落而不是凭空消失。
对比Pika Labs在短视频创作和社区生态上的丰富,它在长视频的连贯性和复杂场景的还原度上有着质变级别的优势。
把 Sora 放进你的日常,可以这样用:
按需求搭配收藏,获取更立体的信息视角:
在多模态视频编辑、特效、后期制作工具上有着最完整的工作流程
Pika Labs在短视频的快速生成和用户社区生态上有独到的特色