自動認識と字幕生成
動画の音声を認識し、話された内容を自動で字幕に変換します。ページ上の説明では、中国語、英語、広東語、日本語、韓国語など複数言語に対応しています。
绘影字幕は、動画字幕制作ツールで、自動認識による字幕追加、字幕翻訳、字幕タイムラインの自動一致、リアルタイム字幕などの機能を提供します。主な仕組みは、動画内の人の声を認識して音声を字幕に変換し、その後オンライン編集、スタイル調整、書き出しを行えるようにすることです。
公式サイトの説明によると、製品はWeb上で直接利用でき、モバイルAppも提供されています。また、オープンAPIを通じて字幕認識機能を既存の業務シーンに組み込むことも可能です。大量の動画字幕を扱うクリエイター、教育コンテンツ制作、ライブ配信や会議の字幕、海外向け動画制作などの場面を想定しています。
動画の音声を認識し、話された内容を自動で字幕に変換します。ページ上の説明では、中国語、英語、広東語、日本語、韓国語など複数言語に対応しています。
認識後に字幕翻訳を行うことができ、中英、中日などの二言語字幕を生成し、さらに多くの言語の組み合わせにも対応します。
字幕テキストと動画を取り込むと、タイムラインを自動で一致させることができ、既存の原稿を使って素早くタイミング調整したい場面に適しています。
字幕の内容とスタイルをオンラインで編集し、字幕の見た目や位置を調整したうえで、完成動画として書き出すか、SRT字幕ファイルをダウンロードできます。
字幕認識APIを公開しており、既存の業務システムやワークフローに字幕認識機能を組み込みやすくなっています。
リアルタイム字幕機能を提供しており、会議のライブ配信、同時通訳、講座・研修などのリアルタイム表示が必要な場面に適しています。
字幕のない動画をアップロードして話している内容を自動認識し、字幕の初稿を作成してから、Web上で校正して完成動画を書き出します。
中国語や英語などの元音声動画を別言語の字幕に翻訳し、海外向け公開に適した二言語コンテンツを作成します。
すでに作成済みの字幕原稿を動画と自動で同期させ、タイムラインを素早く生成して手作業の調整を減らします。
既存の製品や業務フローに認識機能を組み込み、API経由で字幕データを返すことで、開発チームを持つ企業やプラットフォームに適しています。
会議、ライブ配信、講座・研修でのリアルタイム字幕表示に利用し、リアルタイム字幕製品と組み合わせて音声を即座に字幕化します。
はい。ページの説明では、Web上での作成に対応しており、動画または音声を取り込んだ後に認識言語を選択し、完了後はオンラインで編集・校正してから、動画を書き出すか字幕ファイルをダウンロードできます。
対応しています。ページとヘルプの説明では、まず元の動画の言語を選択し、二言語字幕が必要な場合は字幕翻訳を有効にして対象言語を選べると案内されています。
はい。オープンAPIのページでは、字幕認識APIを呼び出して字幕データを返せることが説明されており、APIドキュメントと管理コンソールも提供されています。
はい。よくある質問では、新規登録ユーザーは初回の動画作成5分以内を無料で試用でき、メールアドレス登録は除外と記載されています。
はい。FAQでは、認識は通常動画の長さに応じて課金され、その後の編集と書き出し機能は無料で利用できると説明されています。価格ページでも、長さに応じて購入するプランが案内されています。