OpenAI于今日正式发布了其视频生成模型Sora,该模型能够根据文本描述生成长达60秒的高质量视频,标志着AI视频生成技术迈入新阶段。Sora不仅支持复杂场景和角色动态,还能实现多镜头切换,展现出强大的语义理解和视觉表现能力。
据悉,Sora基于扩散型变换器架构,通过时空补丁技术将视频与图像统一处理,实现了对物理世界规律的模拟。OpenAI表示,Sora目前已在部分创意领域开放测试,未来将逐步扩展至更多应用场景,同时强调将确保技术的安全与负责任使用。
长按识别二维码