字节跳动近日宣布开源AnimateDiff-Lightning,这是一个基于扩散模型的视频生成模型,能够根据文本描述生成高保真、时间上连贯的视频片段。该模型在保持高效推理的同时,显著提升了视频生成的视觉质量和动态效果。

AnimateDiff-Lightning采用了一种轻量化的架构设计,优化了计算资源消耗,使得在消费级GPU上也能实现快速生成。字节跳动表示,该模型已在多个基准测试中达到领先水平,未来有望应用于创意内容制作、广告营销和虚拟现实等领域。

目前,AnimateDiff-Lightning的代码和预训练模型已托管在GitHub上,供研究者和开发者免费使用。字节跳动希望通过开源推动视频生成技术的普及和创新,并鼓励社区共同探索其潜在应用场景。