音声テキスト変換(Voice to Text)とは?
音声テキスト変換とは、ディクテーション、ボイスメモ、口頭のメモといった、その人自身が話した言葉を、読んで編集し再利用できる文字テキストに変換することです。録音された会話ではなく、通常はひとりの話者がデバイスに向かって話す状況を指します。ここでは二つのワークフローが混同されがちです。話すと同時に文字が表示されるライブディクテーションと、まず録音してから後でファイルを変換する録音後の文字起こしです。このページは後者を扱います。
音声テキスト変換は、タイプするより速くアイデアを書き留めるために使われます。散歩しながら製品アイデアを話す創業者、下書きを口述する書き手、自分あてに口頭でリマインダーを残す人などです。スマートフォンやパソコンの録音アプリでメモを録音し、その音声ファイルをここにアップロードすると、句読点の付いたきれいなテキストが返ってきます。タイムスタンプをクリックすれば任意の箇所を再生できます。このツールはブラウザのマイクで聞き取ることはなく、話している最中にテキストを生成することもありません。
音声テキスト変換のポイント
| 入力 | 自分で録音した音声・動画ファイル(30以上の形式)または対応リンク。ここでは録音せず、アップロードします |
|---|---|
| 話者ラベル | 対応。ただしボイスメモの多くは話者ひとりです |
| タイムスタンプ | 単語単位。任意の行をクリックするとその箇所を再生 |
| 検索 | メモ内、およびライブラリ全体をキーワードで検索 |
| AI処理 | 要約、重要な引用、アクション、決定事項、リスク、期限(無料アカウント) |
| エクスポート | TXTとJSONは無料。PDF・DOCX・SRT・VTTは有料プラン |
| 言語 | 90以上。エディターから翻訳可能(アカウントが必要) |
| 無料枠 | 50MB、登録不要。24時間以内に削除。AIの学習には使用しません |
| ライブディクテーション | 非対応。まずデバイスで録音してからアップロードします。話している最中に文字は表示されません。 |
あなたのペースについてくる文字起こし
ボイスメモをきれいなテキストに
スマホのボイスメモ、WhatsAppやTelegramのボイスメッセージ、口述のアイデア、インタビュー録音——AIがすべてを句読点付きの正確な、すぐ使えるテキストに変換します。


音声を再生しながらテキストを確認
再生に合わせてテキストがハイライト。文をクリックすればその瞬間へジャンプ。20分のボイスメモに埋もれたアイデアも数秒で見つかります。
あなたの言葉を、どこでも使える形に
文字起こししたボイスメモを普段のツールへ。整ったドキュメント、プレーンテキスト、タイムスタンプ付き字幕で出力。NotionやGoogle Docsへの直接コピーも。

音声テキスト変換で得られるもの
創業者がスマホの録音アプリに製品アイデアを口述し、そのファイルをアップロードした例です。抜粋とAIが返す内容を示します。
これは説明用の例です。AIは決まったテンプレートを埋めるのではなく、録音で実際に話された内容を要約します。そのため出力はあなた自身の言葉を反映します。
音声テキスト変換・音声認識・ボイスメモの違い
ここでの音声テキスト変換とは、口述したメモ、声に出したアイデア、自分あてのリマインダーなど、あなた自身が話した内容を文字テキストにすることです。方式はアップロードが先です。デバイスの録音アプリでメモを録音してから、その音声をアップロードします。ツールがブラウザ経由で録音することはなく、話している最中にリアルタイムで文字を生成することもありません。ライブディクテーションと録音後の文字起こしは別のワークフローで、これは後者です。
インタビュー、会議、ポッドキャストなど、ひとり以上の話者を含む録音済みメディア全般を変換したい場合は、より広い用途を扱うSpeech to Text(音声認識)のページが該当します。音声テキスト変換は、あなた自身が話した内容をとらえる、話者ひとりのより限定的なケースです。
録音がすでにスマートフォンのボイスメモとして存在する場合は、Voice Memo to Textのページで、そのファイルを録音アプリから書き出してアップロードする手順を説明しています。スマートフォンのボイスメモのライブラリと自動で同期する機能はありません。音声がどこにあっても、ファイルを選んでアップロードするのはあなたです。

3ステップで音声をテキストに
音声録音をアップロードするだけ——インストール不要。
ボイスメモや音声ファイル(MP3、WAV、M4A、OGGなど30形式以上)をドラッグ&ドロップ、リンクを貼り付け、または録音ボタンを押して話すだけ。
文字起こしエンジンが数分で正確なテキストに変換。句読点、タイムスタンプ、話者ラベル付きです。
内蔵エディタで整えて、PDF、TXT、DOCX、SRT、VTTでダウンロード——どこへでもコピーできます。
TranscribeThisの他のツール
よくある質問
音声をテキストに変換するには?
音声録音をアップロードすると、AIが数分で句読点とタイムスタンプ付きのテキストに変換します。結果を編集し、任意の形式で書き出せます——当社サーバーで処理、インストール不要。
このツールは無料ですか?
はい。50MBまでのファイルなら登録不要で無料です。有料プランではより長い録音や大量処理、高度な機能が使えます。
WhatsAppやTelegramのボイスメッセージも文字起こしできますか?
できます。ボイスメッセージを音声ファイルとして保存・転送し(OGG、OPUS、M4Aなど対応)、アップロードすれば数分でテキストになります。
ボイスメモを録音して文字起こしできますか?
スマホやパソコンの録音アプリでメモを録音し、そのファイルをここにアップロードしてください——数分で句読点とタイムスタンプ付きの文字起こしが得られます。TranscribeThisはアップロードされた録音を文字起こしします。話している最中にリアルタイムで文字起こしはしません。
文字起こしの精度はどのくらいですか?
クリアな録音で最大99%。背景ノイズ、マイクからの距離、強い訛りはそれを下げます。音源の近くで録ることが何よりも効きます。
対応言語は?
90ヶ国語以上を自動判定。完成した文字起こしのワンクリック翻訳にも対応しています。
変換したテキストはダウンロードできますか?
はい。PDF、TXT、DOCX、SRT、VTTで出力でき、NotionやGoogle Docsに直接コピーもできます。
録音のプライバシーは守られますか?
ファイルは通信中も保存中も暗号化され、無料プランでは24時間以内に自動削除。AIモデルの学習に使われることはありません。
