SCRIBEGRAB

Преобразуйте любое аудио или видео в текст и субтитры

Бесплатно, без регистрации, без водяных знаков. На расшифровку часа аудиозаписи уходит примерно две минуты.

Нет под рукой файла? Вставьте ссылку на YouTube ниже Субтитры можно перевести на 16 языков.

Или вставьте ссылку
Загрузка…

Вставьте ссылку на YouTube и через секунду вы получите результат — даже если в видео нет субтитров, мы всё равно сделаем транскрипцию, что является проблемой для большинства других инструментов. Интервью, лекции, подкасты, голосовые заметки: файлы до 60 минут каждый, без регистрации, без водяных знаков.

От записи к тексту

1. Загрузите файл

Любой распространенный аудио- или видеоформат. Транскрипция начинается немедленно: без регистрации, без электронной почты, без ограничений на количество запросов в день.

2. Инструмент создаёт текст

Модель распознавания речи (Whisper) выполняет транскрипцию на наших графических процессорах, автоматически определяет язык и указывает, кто говорит, когда присутствует несколько голосов, обычно намного быстрее, чем в реальном времени.

3. Скачать

Получите обычный текст в формате TXT и субтитры с временными метками в форматах SRT и VTT. Загруженные вами файлы автоматически удаляются.

17 секунд, ничего не вырезается: запись загружается и возвращается в виде текста, готового к скачиванию в форматах TXT, SRT и VTT.
АУДИО транскрибировать transcript.txt 00:00 Добро пожаловать обратно на канал. 00:04 Сегодня мы тестируем три недорогих микрофона.
Речь на входе, чистый текст с временными метками на выходе: расшифровка сохраняет отметку времени для каждой строки.

Три типа записи

ДЛЯ АВТОРОВ КОНТЕНТА

Субтитры для видео

SRT/VTT-субтитры для YouTube, Reels и TikTok: обеспечьте доступность контента и расширьте аудиторию без оплаты за каждую минуту.

ДЛЯ РАБОТЫ И УЧЁБЫ

Интервью и лекции

Превратите записанные интервью, совещания и лекции в текст с возможностью поиска, который можно цитировать и просматривать. Разделите запись по участникам, чтобы видеть, кто что сказал.

ДЛЯ ПОДКАСТОВ

Сопроводительные материалы

Полная расшифровка каждого эпизода для заметок и SEO: каждое слово из вашего эпизода будет проиндексировано.

Вопросы о транскрипции

Это действительно бесплатно?

Да: не требуется регистрация, нет водяных знаков, плата не взимается поминутно или с ограничением по времени использования, и этот бесплатный инструмент — не пробная версия, он не имеет срока действия и использует ту же модель, что и все остальные инструменты на этом сайте. Реклама позволяет поддерживать работу GPU. Есть одна дополнительная опция ежемесячный тариф за 5 евро с возможностью добавления заметок о встрече, указания имен говорящих, экспортом в Word и увеличенными лимитами. Это позволит вам получить больше возможностей для работы с вашей расшифровкой, но не улучшит качество самой расшифровки.

Что происходит с моим файлом?

Он обрабатывается на нашем собственном сервере и удаляется сразу после завершения обработки; результаты стираются в течение 45 минут. Ничего не сохраняется, не передается и не используется для обучения. Подробнее см. в разделе Политика конфиденциальности.

Насколько точна транскрипция?

Мы используем нашу модель распознавания речи, одну из лучших моделей распознавания речи с открытым исходным кодом. Четкая речь расшифровывается очень точно; сильный акцент, перекрестные разговоры, фоновый шум или плохое качество записи затрудняют работу любого инструмента. Всегда проверяйте результат.

Отображает ли он говорящего?

Да. Когда инструмент обнаруживает более одного голоса, он автоматически разделяет расшифровку на реплики каждого говорящего, до восьми человек, и для этого не нужно ничего включать. Именно это делает запись интервью или встречи читаемой, а не просто длинным блоком текста. Метки определяются искусственным интеллектом, поэтому при перекрестных разговорах или очень похожих голосах рекомендуется быстро проверить их.

Можно ли убрать из аудиозаписи нецензурные слова?

Да. Перед загрузкой установите флажок «Также создать чистую версию или версию с субтитрами», и вы получите второй файл, в котором каждое нецензурное слово будет заменено звуковым сигналом, заглушено или удалено Кроме того, по желанию можно убрать междометия типа «эм» и длинные паузы. Сначала вы увидите полный список с указанием времени, и сможете оставить любое слово. Подробнее о замене нецензурных слов и удалении лишних слов.

Какие языки и форматы файлов поддерживаются?

Около 100 языков, определение языка происходит автоматически (или вы можете выбрать язык вручную). Аудио- и видеофайлы: MP3, WAV, M4A, FLAC, OGG, MP4, MOV, MKV, WEBM и другие форматы, до 2 ГБ и продолжительностью до 60 минут.

Можно ли получить субтитры для видео?

Да, загрузите видео напрямую и скачайте файл SRT или VTT. Добавьте файл SRT рядом с вашим видео или загрузите его на YouTube в качестве субтитров.

Можно ли добавить субтитры непосредственно в само видео?

Да. Instagram, TikTok, WhatsApp и большинство телевизоров не распознают отдельные файлы субтитров, поэтому перед загрузкой установите флажок «Также создать чистую версию или версию с субтитрами», выберите один из трех стилей (Классический, в рамке или Большой) и скачайте MP4-файл с текстом , встроенным в изображениеНе нужно устанавливать дополнительное программное обеспечение, не будет водяных знаков, а ваш исходный файл останется без изменений. Полное руководство: Как добавить субтитры к любому видео.

Нужно разделить песню на отдельные дорожки (вокал, барабаны, бас и инструментал)?

Вот наш другой инструмент: StemGrab он разделяет вокал, ударные, бас и инструментальную часть, и тоже совершенно бесплатен.

В каких случаях точность обработки снижается?

При чистой записи речи одного человека на английском языке модель правильно распознаёт примерно девяносто восемь слов из ста — мы зафиксировали 1,94% ошибок в словах при обработке чистой речи. Наибольшее влияние оказывают три фактора. Перебивание, когда два человека говорят одновременно, потому что модели приходится выбирать, чей голос обрабатывать. Расстояние от микрофона, так как телефон на дальнем конце стола записывает больше окружающего шума, чем голоса. И необычный словарь: имена, названия брендов, профессиональный жаргон и аббревиатуры определяются по контексту, поэтому незнакомая фамилия может быть распознана как что-то, что просто звучит похоже. Сильные акценты обрабатываются лучше, чем можно было бы ожидать; фоновая музыка — хуже.

Почему нет ежедневного лимита, в отличие от других бесплатных сервисов транскрипции?

Распознавание речи требует вычислительных ресурсов графического процессора (GPU), и большинство бесплатных сервисов арендуют эти ресурсы у облачного провайдера за каждую минуту аудио — именно поэтому существуют ограничения в три файла в день и двадцать минут. У нас есть собственное оборудование: те же видеокарты используются для наших других инструментов в Нидерландах, поэтому дополнительная запись обходится нам в стоимость электроэнергии, а не в счёт. Реклама на странице покрывает эти расходы. Поэтому файлы могут быть до девяноста минут и два гигабайта каждый, сколько угодно, без регистрации или адреса электронной почты.

Популярные способы использования ScribeGrab