Stability AI推出Stable Video Diffusion,可根据图像中生成视频短片
11月24日消息,据外媒报道,在OpenAI庆祝山姆·奥特曼(Sam Altman)回归之际,它的竞争对手也在人工智能竞赛中加大了赌注。就在Anthropic发布了Claude 2.1以及Adobe收购Rephrase之后,Stability AI宣布发布Stable Video Diffusion,标志着它进入了备受追捧的视频生成领域。
稳定视频扩散(SVD)仅用于研究目的,包括两个最先进的人工智能模型——SVD和SVD-XT,可以根据图像中生成视频短片。该公司表示,它们都能产生高质量的输出,达到甚至超过其他人工智能视频生成器的性能。
作为研究预览的一部分,Stability AI已经开源了图像到视频的模型,并计划利用用户的反馈来进一步完善它们,最终为它们的商业应用铺平道路。
根据该公司的一篇博客文章,SVD和SVD-XT是潜在扩散模型,它们将静止图像作为条件帧,并从中生成576 X 1024的视频。这两种型号都能以每秒3到30帧的速度生成内容,但输出时间相当短:最多只能持续4秒。稳定人工智能指出,SVD模型经过训练,可以从静止图像中生成14帧,而后者可以达到25帧。
为了创建稳定的视频扩散,该公司采用了一个大型的、系统策划的视频数据集,其中包括大约6亿个样本,并用它训练了一个基本模型。然后,该模型在一个较小的、高质量的数据集(包含多达一百万个片段)上进行微调,以处理下游任务,如文本到视频和图像到视频,从单个条件图像预测一系列帧。
稳定人工智能表示,用于训练和微调模型的数据来自公开的研究数据集,尽管确切来源尚不清楚。
更重要的是,在详细介绍SVD的白皮书中,作者写道,该模型还可以作为微调具有多视图合成能力的扩散模型的基础。这将使它能够生成一个对象的多个一致的视图只用一个单一的静止图像。
该公司在其博客文章中补充说,所有这些最终可能会在广告、教育和娱乐等领域产生广泛的应用。
X
-
微博认证登录
-
QQ账号登录
-
微信账号登录
企业俱乐部
Copyright (C) 1997-2026 Chinabyte.com, All Rights Reserved
