文字轉影片生成
根據文字提示建立影片輸出,適合以文字驅動的生成工作流程。
Stable Video 是 Stability AI 的生成式影片模型,可根據文字提示建立影片,支援可設定幀率、短片輸出與授權制自架部署。
Stable Video Diffusion 是建立在 Stable Diffusion 之上的 Stability AI 生成式影片模型。產品頁將其呈現為一款可根據文字提示生成影片的模型,重點在於直接製作影片,而非編輯或後製工具。
網站強調三項核心能力:文字轉影片生成、可設定幀率與快速產出。它也說明該模型可在自架授權下部署到你自己的基礎架構上,因此對於希望在自有環境中執行影片生成的團隊具有相關性。
根據文字提示建立影片輸出,適合以文字驅動的生成工作流程。
可產生 14 幀或 25 幀,並支援 3 到 30 幀/秒之間的幀率控制。
網站聲稱可在 2 分鐘內或更短時間建立影片,顯示生成片段的周轉時間較短。
提供自架部署路徑,讓團隊可在自己的環境中執行模型。
透過網站上的「取得授權」行動呼籲,提供授權制存取流程。
當你需要初步視覺概念或快速的動態草稿時,可根據提示文字生成短影片片段。
當團隊需要對環境或部署設定保有本地控制時,可在自有基礎架構中執行模型。
在時序與片長對實驗很重要時,可選擇特定幀率產生短格式影片輸出。
適合需要快速周轉的影片工作流程,尤其當網站所述的兩分鐘內處理時間具有參考價值時。
Stable Video Diffusion 被描述為一款生成式影片模型,可依文字提示建立影片。提供的頁面文字未說明更廣泛的輸入模式或工作流程變化。
來源指出它可以生成 14 幀與 25 幀,並支援 3 到 30 幀/秒之間的可自訂幀率。
頁面表示它可在 2 分鐘或更短時間內建立影片,但未提供硬體需求、佇列行為或對所有工作負載的保證。
網站說明你可以在自己的基礎架構上,以自架授權部署 Stable Video Diffusion,方便進行進階自訂。
提供文字中的定價與授權頁面顯示其採用授權制流程,但在已收集內容中未公開明確的商業條款或價格金額。