WhisperUI logo

WhisperUI

認証する

WhisperUIは、OpenAI Whisper搭載のWeb・デスクトップ音声文字起こしツールです。テキスト読み上げ、字幕出力、無料の書き起こし変換機能も利用できます。

WhisperUI preview

概要

WhisperUIは、OpenAIモデルを中心に構築された音声文字起こしおよびテキスト読み上げ製品です。主な文字起こしフローでは、ブラウザで音声ファイルをアップロードし、OpenAI Whisperに送信して、生成されたテキストまたは字幕出力を確認してダウンロードできます。

この製品には、WindowsとmacOSでのローカル文字起こし用デスクトップアプリに加え、書き起こしや字幕の形式変換、粗い書き出しの整形、文字起こし長の見積もりに使える無料のブラウザツール群も含まれています。料金ページではクラウドとローカルの両方のワークフローが案内されており、デスクトップアクセスとクラウド利用向けの有料サブスクリプションも用意されています。

機能

Web音声文字起こしアップロード

ドラッグ&ドロップまたはファイル選択でWebアプリから音声をアップロードし、OpenAI Whisperに送って文字起こしします。

テキストとSRTの出力

文字起こしをプレーンテキストとして書き出したり、音声ファイルを音声文字起こしワークフローからSRT字幕に変換したりできます。

ローカルデスクトップ処理

WhisperUI Desktopを使って、無制限のジョブ、ファイルサイズ制限なし、ファイル再生時間制限なしでローカル文字起こしを行えます。

Webとデスクトップでのクラウド処理

プランによって制限が異なる、ブラウザベースの処理を行いたい場合はクラウド文字起こしを選択できます。

テキスト読み上げ生成

OpenAIの音声とモデルを使って、入力したテキストから音声を生成するテキスト読み上げツールを利用できます。

無料の書き起こしユーティリティ

無料のブラウザツールを使って、SRT、VTT、TXTの変換、粗い文字起こしのクリーニング、音声の長さからの文字起こし長推定ができます。

利用例

  • 音声の文字起こし

    ブラウザベースのWhisperUI文字起こしフローを使って、アップロードした音声ファイルをメモ、確認、ダウンロード用のテキストに変換します。

  • キャプションと字幕の準備

    文字起こしをSRT字幕に変換したり、字幕ユーティリティを使ってSRT、VTT、TXT形式を相互に変換したりできます。

  • ローカルなオフライン風ワークフロー

    処理を自分のデバイス内にとどめ、ブラウザのみの制約を避けたい場合に、デスクトップマシンでローカル文字起こしを実行します。

  • 大量のデスクトップ文字起こし

    ポッドキャスト、インタビュー、講義、会議、大規模な音声アーカイブなど、長尺音声の継続的な作業にデスクトップアプリを使用します。

  • テキスト読み上げ生成

    OpenAIの音声と対応する音声出力を使って、テキスト読み上げツールで書かれたテキストから音声を生成します。

Pros and Cons

Pros

  • Web文字起こしとローカルデスクトップワークフローの両方をサポートしています。
  • 字幕出力と無料の書き起こしユーティリティツールが含まれています。
  • デスクトップアプリでは、ローカルでの文字起こしが無制限で、ローカルのファイルサイズや再生時間の上限がありません。
  • WindowsとmacOSに対応しており、Intel MacとApple Silicon Macの両方をサポートしています。
  • FAQによると、APIキーはブラウザ内にローカル保存されます。

Cons

  • Webアプリの音声文字起こしは、有効なOpenAI APIキーに依存します。
  • クラウド文字起こしではWebワークフローにアップロード制限があり、ホームページでは25 MBのファイル上限が示されています。

FAQ

WhisperUIは無料で使えますか?

WhisperUIは、一部の基本機能を無料で利用できますが、アプリを使用するには有効なOpenAI APIキーが必要で、そのキーに紐づく利用分はOpenAIに直接支払います。

どのような有料機能がありますか?

ホームページに記載されている有料機能は、複数ファイルのアップロード、1日あたりのファイルアップロード無制限、音声ファイルをSRTファイルに変換する機能です。

APIキーはWhisperUIのサーバーに保存されますか?

WhisperUIはAPIキーをブラウザ内にローカル保存します。

WhisperUIはどのファイル形式に対応していますか?

WhisperUIは、音声文字起こし用としてMP3、MP4、MPEG、MPGA、M4A、WAV、OGG、WEBMに対応しており、テキスト読み上げツールの出力形式はMP3、AAC、FLACです。

WhisperUI Desktopはどのプラットフォームをサポートしていますか?

WhisperUI Desktopは、Windows 10と11、およびIntelとApple Siliconの両方のmacOSでサポートされており、最低4GBのRAMが必要です。

Quick Facts

カテゴリ
音声からテキスト / 文字起こし
プラットフォーム
Web とデスクトップ
主なユーザー
クリエイター、研究者、学生、チーム
ソースドメイン
whisperui.com
ワークフロー
音声をアップロードし、OpenAI Whisperで文字起こしして、テキストまたは字幕を確認
デスクトップ対応
Windows 10/11 および macOS(Intel と Apple Silicon)