SCRIBEGRABツールを開く →

音声内の話者を識別 無料

アカウント不要。1日の利用回数制限もありません。他のサービスでは、1日に3ファイルまでしか処理できず、「無制限」と謳っていますが、ここでは最大60分までのファイルを好きなだけ処理できます。

会話の書き起こしにおいて、誰が何を言ったのかを識別できない場合、それは完全な書き起こしとは言えません。ScribeGrabは、聞き取れる音声をグループ化し、各行の先頭に 話者1、話者2 と自動的に表示します – テキストと字幕の両方で。

シンプルな文字起こしと字幕はここから。話者ラベル、音声のミュート処理、翻訳、焼き込み字幕、および90MBを超えるファイルは、フル機能版で利用できます。 フル機能版.

今すぐオーディオを文字起こし →
スピーカー識別によって何が得られるか

これは「ダイアリゼーション」とも呼ばれます。単に誰であるかを認識するのではなく、 その人が誰なのかを 特定するのではなく、この声とあの声が異なる人物のものであることに気づき、それぞれの発話箇所を記録します。その結果として得られるのは、壁のようなテキストではなく、脚本のように読みやすいトランスクリプトです。

録音からトランスクリプトへの変換はここで行います

各発話区間を「音声フィンガープリント」(ECAPA-TDNN埋め込み)に変換し、それらのフィンガープリントをクラスタリングします。互いに近い位置にある声は、同一人物として扱われます。各行がどのクラスタに属するかによってラベルが決まり、そのラベルがTXT、SRT、VTTファイルに書き込まれます。

自動的に実行されます。起動するための設定はなく、事前に何かを指示する必要もありません。部屋に何人の人がいるかを含め、すべて自動で処理します。

どこまで処理するか(正直に言うと)

誰の名前も知りません。あなたの声を聞いたことがないので、「サラ」ではなく「スピーカー1」と表示します。各人物が最初に発したセリフを読み、テキストエディタでラベルを置き換えてください。

転写自体には影響はありません。もし音声を聞き分けて区別できない場合は、通常通りラベルなしの転写結果が得られます。

以下の形式に対応

スピーカーラベルは他のデータと同様にアップロードされるため、録音された通話はラベル付きで、字幕付きで出力されます。 また、不適切な言葉は自動的に処理されます。 必要に応じて共有できます。詳細はこちらをご覧ください。 インタビューの転写 および ZoomやTeamsの録画.

よくある質問

何か設定を変更する必要がありますか?

いいえ。二つ以上の異なる音声が聞こえる場合、ラベルは自動的に追加され、転写および両方の字幕形式に反映されます。

実際の名前を使用しますか?

いいえ。事前に誰が誰であるかを指定しない限り、どのツールもそうすることはできません。スピーカー1、スピーカー2というように表示されるので、それぞれの最初の行を見つけて、テキストエディターでラベルを置き換えてください。

最大何人の話者の音声を処理できますか?

2人から8人までです。それ以上の人数だと、音声グループ分けの精度が低くなり、誤った情報を表示するよりもラベルを表示しない方が良いと判断します。

なぜトランスクリプトにラベルが表示されないのですか?

音声が1つしか検出されなかったか、または8つを超えるグループの音声が検出された可能性があります。これは、録音があまりにもノイズが多く、あるいは複数の音が重なり合って、正確なグループ分けができなかったことを意味します。トランスクリプト自体は完全です。

話者識別機能は無料で利用できますか?

はい、ここにある他のすべてのツールと同様に、アカウント登録も、1日の上限もなく、透かしも入らず、処理後すぐにファイルは削除されます。