无需注册账户,每日使用次数不限。其他平台每天只提供三个文件,却声称是无限量。这里的文件时长可达 60 分钟,您可以随时使用。
如果您无法分辨谁说了什么,那么对话的文本记录就只算作半个完整的文本记录。ScribeGrab 会将它听到的声音进行分组,并在 说话者 1、说话者 2 的前面添加标签——自动添加到文本和字幕中。
在这里即可获得纯文本的字幕和副标题。发言者标签、静音处理、翻译、嵌入式字幕以及超过 90MB 的文件都包含在 功能更强大的工具中。.
现在开始转录音频 →它也被称为“说话人分段”:它不是识别“谁”,而是识别出这段声音和那段声音属于不同的人,并标记出每个人分别在什么时候讲话。最终结果是一份您可以像阅读剧本一样轻松阅读的文本稿,而不是一堆杂乱无章的文字。 它可以区分说话人,但不会识别具体身份。 它会注意到这段声音和那段声音属于不同的人,并标记出每个人分别在什么时候讲话。最终结果是一份您可以像阅读剧本一样轻松阅读的文本稿,而不是一堆杂乱无章的文字。
每段语音都会被转化为“声音指纹”——一种 ECAPA-TDNN 嵌入式数据——然后将这些指纹进行聚类:彼此接近的声音会被视为同一个人。每段语音所属的类别决定了它的标签,并将该标签写入 TXT、SRT 和 VTT 文件中。
它会自动运行。无需设置或提前告知任何信息,包括房间里有多少人。
它无法知道任何人的名字。它以前从未听过您的声音,因此会显示“说话者 1”,而不是“莎拉”:请阅读每个人说的第一句话,然后在文本编辑器中替换标签。
无论如何,原始文本都不会受到影响:如果无法可靠地区分不同的声音,您将获得普通的、不带标签的文本记录。
讲话者标签与所有其他内容一同从上传的文件中提取,因此录制的通话可以返回带有标签和字幕。 同时,会过滤掉脏话。 如果您需要分享,请参阅以下内容。 转录访谈 以及 Zoom 或 Teams 录音.
不需要。如果听到两个或多个不同的声音,标签将自动添加到文本记录和两种字幕格式中。
不会,而且没有工具可以在不知道谁是谁的情况下做到这一点。您会得到“讲话者 1”、“讲话者 2”等标签;找到每个讲话者的第一句话,然后在您的文本编辑器中替换这些标签。
最多八个。超过这个数量,语音分组的准确性就无法保证,因此它会省略标签,而不是进行不准确的猜测。
要么它只听到了一个声音,要么它听到了超过八组的声音,这意味着录音过于嘈杂或声音重叠过多,无法可靠地进行分组。但文本记录本身仍然完整。
是的,就像这里的所有其他工具一样:无需注册账户、没有每日使用限制、没有水印,并且您的文件在处理完毕后会立即删除。