画像から動画の生成
1 枚の画像とテキストスクリプトから話す動画を生成し、写真をリップシンクと顔の動きを備えた話すキャラクターとしてレンダリングします。
写真、スクリプト、音声から対話型アバター動画、ビデオポッドキャスト、プレゼン動画を作成できるAI動画プラットフォーム。感情制御、音声クローン、多言語音声、グリーンスクリーン出力に対応。
VisionStory は、写真、スクリプト、音声を対話型アバター動画、ビデオポッドキャスト、プレゼンテーション、関連するキャンペーンコンテンツに変換できる AI 動画プラットフォームです。サイトでは、1 枚の画像とテキストから、感情、声、背景をコントロールしながら、臨場感のある話す動画をすばやく作成する方法として紹介されています。
この製品は、従来の撮影なしで構造化された動画コンテンツを必要とするクリエイター、マーケター、教育者、チーム向けです。ページでは、画像から動画の生成、ポッドキャストの再利用、PowerPoint から動画への出力、グリーンスクリーンレンダリングのワークフローに加え、無料枠から有料利用、エンタープライズ向けオプションまで拡張できるサブスクリプションプランが示されています。
1 枚の画像とテキストスクリプトから話す動画を生成し、写真をリップシンクと顔の動きを備えた話すキャラクターとしてレンダリングします。
明るい、怒り、歌う、マーケティング、ニュースなどの感情プリセットを選んで、生成動画のトーンを調整できます。
30 以上の言語でスクリプトをローカライズし、AI 音声を使用できます。ホームページでは音声クローンと 200 以上の音声も強調されています。
アップロードした音声からビデオポッドキャストを作成し、話者の役割や背景を追加して、ストーリーボードベースのポッドキャスト動画を生成できます。
動画に単色の緑背景を生成することで、CapCut などのツールで後編集しやすいグリーンスクリーン背景を有効にできます。
プランに応じて、より長いレンダリングや高解像度書き出しに対応します。上位プランでは最大 10 分の動画や 1080p または 2K 出力が利用できます。
ポートレート、セルフィー、キャラクター画像を短い解説動画、SNS 投稿、ブランドメッセージ向けの話す動画に変換します。ワークフローは、1 枚の画像とスクリプトをアップロードし、メッセージに合った感情を選ぶことを中心にしています。
録音をアップロードし、話者の役割を割り当て、背景を選択して、ストーリーボードベースのエピソード動画を生成することで、ポッドキャスト音声を視覚形式に再利用します。
PowerPoint 素材をアップロードし、ナレーション風の音声と動きを加えることで、スライドデッキをアバター主導の動画コンテンツに変換し、プレゼンテーションや研修に活用できます。
複数言語で発話を翻訳または生成し、クローン音声やプラットフォーム音声を使って一貫した配信を行うことで、同じメッセージのローカライズ版を作成できます。
編集ソフトに差し込めるグリーンスクリーン動画素材を作成し、広告、製品紹介、ストーリーテリング、その他のキャンペーン用途に利用できます。
ユーザーが画像または写真をアップロードし、スクリプトを追加すると、VisionStory が臨場感のある表情と音声を備えた話す動画を生成します。AI 動画ページでは、1 枚の画像とテキストを話す動画に変換すると説明されています。
機能ページでは、動画のトーンに合わせて、明るい、怒り、歌う、マーケティング、ニュースなどの感情プリセットを選べると説明されています。
ビデオポッドキャストページは、MP3 および WAV 形式のアップロード音声ファイルに対応しており、Google NotebookLM の出力から生成されたポッドキャストについても記載しています。ユーザーは写真を追加し、背景を選び、役割を割り当ててから、ストーリーボードと最終動画を生成できます。
Green Screen は Pro プラン以上で利用できます。ページでは、後編集用に単色の緑背景を追加すると説明されており、使用には動画 1 分あたり 1 追加クレジットが必要で、最低 1 クレジットが課金されます。
価格ページには、無料プラン、有料サブスクリプション階層、エンタープライズオプションが表示されています。また、商用利用は Pro 以上のプランで提供されており、ビデオポッドキャストページでは最終的なビデオポッドキャスト生成に Pro プラン以上が必要と記載されています。