ローカル音声・動画の文字起こし
MP4、MP3、AAC、M4Aなどのローカルメディアファイルを、事前にファイル形式を変換せずに文字起こしに変換します。
Memo AIは、WindowsとmacOS対応のデスクトップAI文字起こしアプリ。音声・動画ファイルやリンクをテキスト化し、多言語翻訳、SRT/VTT/Markdown/Notion出力に対応。
Memo AIは、音声や動画をテキストに変換するAI搭載の文字起こしアプリです。製品サイトでは、ローカルメディアファイルだけでなくオンラインリンクの文字起こしにも対応するデスクトップツールとして位置づけられており、翻訳、字幕生成、エクスポートもサポートしています。
ソースページでは、Memo AIはWindowsとmacOSに対応したクロスプラットフォームのデスクトップアプリケーションとして説明されています。現在はベータ版で、プライバシー保護のためローカル処理を使用し、会議メモ、ポッドキャストの文字起こし、字幕翻訳、ローカルファイル変換などのワークフローに対応しています。
MP4、MP3、AAC、M4Aなどのローカルメディアファイルを、事前にファイル形式を変換せずに文字起こしに変換します。
YouTube、Apple Podcasts、Xiaoyuzhou、Google Podcastsのリンクに対応し、YouTubeやポッドキャストのリンクを文字起こしします。
90以上の言語で翻訳と文字起こしが可能で、ホームページでは中国語、英語、日本語への対応が明記されています。
デバイス上で音声認識をローカル実行し、サイトではデータがデバイス外に出ないこと、アプリがオフラインで動作することが明記されています。
文字起こしの要約を生成し、AIアシスタントのプロンプトをカスタマイズし、SRT、VTT、Markdown、Notionなどの字幕・ノート形式に出力します。
対応ハードウェアではGPUアクセラレーションを使用でき、Windows PCやApple Silicon搭載Macで文字起こしを高速化します。
録音した会議、インタビュー、会話が中心のセッションをテキスト化し、参加者が議論を確認したり、アクションアイテムを抽出したりできるようにします。
ローカルのポッドキャストや動画ファイルを文字起こしに変換し、その後、編集や公開のワークフロー向けに字幕やMarkdownとしてエクスポートします。
対応しているYouTubeやポッドキャストのリンクをMemo AIに貼り付け、メディアを事前にダウンロードして形式変換することなく文字起こしを作成します。
多言語音声、ローカライズされた学習素材、または言語をまたぐレビューを扱う際に、複数言語にわたって字幕や文字起こしを翻訳します。
プライバシーに配慮した素材を対象に、ローカル処理とオフライン動作が必要なときに、個人のWindowsまたはMacマシン上でデスクトップアプリを使用します。
Memo AIは、音声および動画ファイルをテキストに文字起こしするために設計されており、YouTubeやポッドキャストのURLに対するリンクベースの文字起こしにも対応しています。
ガイドによると、Memo AIはWindowsとmacOSで動作します。ダウンロードページには、少なくとも8 GBのメモリを備えたWindows 10以降に加え、Apple SiliconおよびIntelプロセッサ搭載のMacへの対応が記載されています。
ソースに記載されているエクスポート形式には、SRT、VTT、Markdown、Notionがあります。製品ページには字幕エクスポートも利用できると記載されています。
Memo AIはまだベータ版で、ダウンロードページとガイドページのどちらにも、アクセスには招待コードが必要な場合があると記載されています。料金ページには無料の基本プランと有料プランも記載されています。
料金ページによると、Memo Basicは永久無料で、Memo BelieverとMemo Proは有料オプションです。Memo Proは年額プラン、Memo Believerは買い切りのライフタイムアクセスとして記載されています。