文本生成视频
根据文本提示创建视频输出,适用于以文本驱动的生成工作流。
Stable Video 是 Stability AI 的生成式视频模型,可根据文本提示创建视频。支持可配置帧率、短视频输出,并通过基于许可证的访问流程进行自托管部署。
Stable Video Diffusion 是 Stability AI 基于 Stable Diffusion 构建的生成式视频模型。产品页将其定位为可根据文本提示生成视频的模型,重点在于直接创建视频,而不是编辑或后期制作工具。
网站强调了三项核心能力:文本到视频生成、可配置帧率以及快速产出。它还说明该模型可在自托管许可证下部署到你自己的基础设施上,因此适合希望在自有环境中运行视频生成的团队。
根据文本提示创建视频输出,适用于以文本驱动的生成工作流。
可生成 14 帧或 25 帧,并支持在每秒 3 到 30 帧之间控制帧率。
网站称视频可在 2 分钟或更短时间内创建,表明生成短片的周转较快。
提供自托管部署路径,方便团队在自己的环境中运行该模型。
通过网站上的“获取许可证”号召性用语提供基于许可证的访问流程。
当你需要早期视觉概念或快速的运动草稿时,可根据提示文本生成短视频片段。
当团队需要对环境或部署设置进行本地控制时,可在自己的基础设施内运行该模型。
在时间与片段长度对实验很重要时,可选择特定帧率生成短格式视频输出。
用于需要快速周转的视频工作流,并且网站所述两分钟或更短的处理时间具有参考意义。
Stable Video Diffusion 被描述为一款生成式视频模型,可根据文本提示创建视频输出。所提供的页面文本未说明更广泛的输入模式或工作流变体。
来源说明它可以生成 14 帧和 25 帧,并支持在每秒 3 到 30 帧之间自定义帧率。
页面写明它可在 2 分钟或更短时间内创建视频,但没有提供硬件要求、排队行为或对所有工作负载的保证。
网站说明你可以在自己的基础设施上通过自托管许可证部署 Stable Video Diffusion,以便进行高级自定义。
所提供文本中的定价和许可证页面表明这是一个基于许可证的流程,但在收集到的内容中并未公开明确的商业条款或价格金额。