ブラウザベースのテキスト読み上げ
ブラウザ内でテキストから直接音声を生成し、結果を音声ファイルとしてダウンロードできます。ホームページでは、短いクリップから書籍長のナレーションまで対応すると案内されています。
SpeechGenは、ブラウザ上でテキストやアップロード文書から音声を生成し、ダウンロードできるAI音声合成ツールです。150以上の言語、5,000以上の音声、MP3・WAV・FLACに対応。
SpeechGenは、ブラウザ上でダウンロード可能なナレーションを作成するためのオンライン音声読み上げ・AI音声生成ツールです。貼り付けたテキストとアップロードした文書に対応し、豊富な音声と言語のライブラリを備え、MP3、WAV、FLACなどの形式で音声を書き出せます。
この製品は、手動のナレーション作業と自動生成の両方を想定して提供されています。ユーザーは速度、ピッチ、音量、間、スタイルを調整でき、BGMや複数話者の追加も可能です。また、プログラムによる合成のためのAPIにもアクセスできます。
ブラウザ内でテキストから直接音声を生成し、結果を音声ファイルとしてダウンロードできます。ホームページでは、短いクリップから書籍長のナレーションまで対応すると案内されています。
150言語にわたる5,000以上の音声から選択でき、音声品質の階層や音声特性で絞り込めます。サイトでは音声サンプルも提供されており、生成前に विकल्पを確認できます。
DOCX、PDF、SRTファイルをアップロードするか、エディタにプレーンテキストを貼り付けられます。FAQでは、非常に長い入力にも対応できるとされており、長文の原稿や文書に便利です。
対応している音声では、読み上げ速度、ピッチ、音量、間の長さ、感情的なスタイルを調整できます。エディタとAPIの両方で、より正確な音声出力のためにこれらの設定を利用できます。
BGMを追加し、1つのファイルで複数の話者を使い、チャプターやカットマーカーでコンテンツを個別の音声出力に分割できます。これらのツールは、より構造化されたナレーションのワークフローを支援します。
APIを使って、インスタントテキスト、長文テキスト、字幕同期出力向けのエンドポイントで音声をプログラム的に合成できます。ドキュメントにはcURL、PHP、Python、JavaScriptの例が掲載されています。
原稿、ランディングページのコピー、製品説明を、修正のたびに声優を手配せずにダウンロード可能なナレーションへ変換できます。
長文コンテンツやアップロードしたファイルを含むテキスト文書から、レッスン音声、研修モジュール、ナレーション付きの教材を生成できます。
電話システムや受付フロー向けに、案内文、アナウンス、または多言語の通話対応音声を作成できます。
音声、間、任意のBGMを使って、展示案内、ツアー、ガイド付き音声体験を構築できます。
APIエンドポイントを使用して、短文、長文、または字幕ベースの合成でアプリケーション、チャットボット、コンテンツパイプライン内の音声作成を自動化できます。
SpeechGenは、貼り付けたテキストやアップロードしたファイルから、ブラウザ上で音声を生成します。ソースではプレーンテキスト、DOCX、PDF、SRTの入力に対応しているとされていますが、最適な手順はコンテンツの種類によって異なります。
サイトでは、150以上の言語と5,000以上の音声に対応していると案内されています。まず言語を選び、その後で音声を選択して音声を生成します。
Webアプリでは、MP3、WAV、FLAC、OGG、Opus、M4A、およびいくつかのWAVバリアントに書き出せます。APIドキュメントでも、出力形式としてMP3、WAV、FLAC、OGG、Opusが挙げられています。
料金ページではサブスクリプション不要の従量課金モデルが示されており、ホームページではアカウント不要で1,000文字まで無料で始められると案内されています。正確なプラン料金と制限は、提供されたソースには記載されていません。
はい。APIドキュメントによると、APIアクセスには有料アカウントが必要で、リクエストにはトークン認証とメール認証を使用します。