SCRIBE(スクライブ)GRAB(グラブ)ツールを開く →

ポッドキャストの文字起こし 無料、全エピソード

アカウント不要。1日の利用回数制限なし。他のサービスでは1日に3ファイルまでしか提供せず、「無制限」と謳っていますが、ここでは最大60分までのファイルを好きなだけ処理できます。

ポッドキャストのエピソードをアップロードするだけで、きれいで正確な 文字起こしを作成できます。 そのため、番組の概要、ブログ記事、検索可能なアーカイブ、アクセシビリティ向上などに最適です。アカウント不要、透かしなし、1分あたりの料金もかかりません。

シンプルな文字起こしと字幕はここから。話者ラベル、音声のミュート処理、翻訳、焼き付けられた字幕、および90MBを超えるファイルは、フル機能版で利用できます。 フル機能版.

今すぐオーディオを文字起こし →
なぜポッドキャストを文字起こしするのか?

文字起こしを行うことで、60分のエピソードがGoogleが実際に読み取り、評価できるコンテンツに変わります。番組の概要、引用画像、再利用可能なブログ記事、検索可能な過去のエピソードアーカイブを作成でき、聴覚障害のある方にも番組を楽しんでいただけるようになります。

録音から文字起こしへ

エピソードの音声ファイル(MP3、WAV、M4A)または動画ファイルをアップロードします。ScribeGrabはour speech modelを使用して音声を文字起こしし、完全なテキストと字幕ファイルをお届けします。1回のアップロードで最大60分、1.5GBまでのエピソードに対応しています。

  1. エピソードをMP3(または一般的なオーディオ/ビデオ形式)としてエクスポートします。
  2. ScribeGrabを開き、ファイルをドラッグ&ドロップします。
  3. GPU上で文字起こしが完了するまで数分待ちます。
  4. 文字起こしされたテキストをTXT形式でダウンロードし、必要に応じてキャプション用にSRT/VTT形式でもダウンロードできます。
インタビュー:会話を引用可能なテキストに変換

インタービューは、複数の話者が参加する音声データです。質問と回答が交互に行われます。お好みの方法(ハンディレコーダー、スマートフォンのボイスメモアプリ、または録音した通話)で録音し、ここにオーディオファイルをアップロードします。返されるのは、会話全体をテキスト化したもので、そこから引用文を取り出して記事に挿入したり、ソーシャルメディア用の引用画像を作成したりできます。

音声がはっきりとしていて、発言者が交代しながら質疑応答を行うような録音であれば、非常に正確に文字起こしできます。問題となるのは、複数の人が同時に話してしまうような場合です。インタビューでそのような場面が多い場合は、文字起こしの内容をよく確認してから引用するようにしてください。ScribeGrabは、すべての発言を連続したテキストとして書き出します。誰がどの部分を発言したかを示すラベルは付かないため、複数の人が参加する録音の場合、発言者名を自分で追加する必要があります。

会議:ZoomやTeamsの録音から議事録を作成

最初に明確にしておきたいのは、ScribeGrabはリアルタイムの通話に参加したり、Zoom、Teams、またはMeetアカウントに接続したりすることはできません。ScribeGrabが行うのは、録音された音声の文字起こしです。 会議後、 すべての主要なプラットフォームで録音ファイルを保存できます。 録音 Zoom、Teams、Google Meetで録音すると、通話終了時にMP4またはM4Aファイルが作成されます。そのファイルをダウンロードしてここにアップロードすると、会議全体のテキストデータが得られます。

その後、文字起こしされた内容は検索可能な議事録になります。決定事項やタスクを確認したり、誰が何に同意したかを確認したりできます。また、数か月後にビデオ全体を再生する代わりに、アーカイブを検索することもできます。会議は、複数の発言者、人が途中で割り込んで話す、マイクの品質が一定でないなど、最も扱いにくい種類の音声です。そのため、文字起こしされた内容は、あくまでも最初のドラフトとして扱い、そこから作成した構造化された議事録を校正するようにしてください。

講義や学習用録音

学生や自主学習者は、同じ手順で1時間の講義を、実際に内容を確認できる議事録に変換できます。講義を録音(または学校が提供する録音を使用)し、ファイルをアップロードすると、完全なテキストデータが得られます。その後、重要な部分を強調表示したり、講師が一度だけ言及した用語を検索したり、セクションを自分のノートに貼り付けたりすることができます。単一の発言者が演壇で話す状況は、最も正確な文字起こし結果を得られる可能性が高いです。騒がしい講堂や遠くのマイクを使用する場合は、校正することをお勧めします。

文字起こししやすいものとそうでないもの

音声がクリアなスタジオ録音は、非常に正確に文字起こしできます。複数のゲストが同時に話したり、背景音楽が大きい場合は、どのツールでも文字起こしが難しくなるため、これらのエピソードを簡単に校正することをお勧めします。どれくらい正確になるか知りたいですか?当社の記事「AIによる文字起こしの精度」をご覧ください。 AIによる文字起こしの実際の精度はどの程度なのか、そして 音声をテキストに変換 あらゆる形式に対応した一般的なワークフローです。

よくある質問

本当に全エピソード無料で利用できますか?

はい。1日あたりの上限や分ごとの料金は一切なく、ファイルあたり最大60分、1.5GBまでご利用いただけます。広告によってGPUの稼働を維持しています。

ノートとして使えるテキストを入手できますか?

完全なトランスクリプトをTXT形式で、さらにSRT/VTT形式の字幕として提供します。TXTファイルをノートやCMSに貼り付けて、必要に応じて編集してください。

複数の人が同時に話している場合はどうなりますか?

Whisperはクリアな音声に対して非常に優れた性能を発揮しますが、激しいクロストーク(重なり合った会話)の場合は、どの文字起こしツールにとっても難易度が高くなります。そのため、その部分は必ず確認してください。

Zoom/Teamsの通話を録音または参加できますか?

いいえ。ScribeGrabは会議アカウントに接続したり、ライブ通話を録音したりする機能はありません。プラットフォームの「録画」ボタンを使用して通話を録画し、通話後に生成されたMP4/M4Aファイルをダウンロードしてから、このサイトにアップロードして文字起こしを行ってください。

誰が何を言ったのかを識別できますか?

発言内容はすべて連続したテキストとして出力されますが、発言者名でタグ付けはされません。複数人のインタビューや会議の場合、発言者のラベルを手動で追加する必要があります。

音声ファイルを保存しますか?

いいえ。ファイルは処理後すぐに削除され、結果も45分以内に消去されます。詳細は プライバシーポリシー をご覧ください。.

その他の便利な情報: YouTube動画を文字起こし · MP3ファイルをテキストに変換 · 話している人を特定してラベル付け · 音声をテキストに変換