Suelta una grabación y recibe una transcripción limpia más subtítulos SRT y VTT listos para usar. Pega un enlace de YouTube y lo tienes en un segundo, o suelta un archivo — entrevistas, clases, podcasts, notas de voz — y se transcribe automáticamente en una GPU real — una hora de audio tarda unos dos minutos. ¿Ese video no tiene subtítulos? Lo transcribimos igual, que es justo donde la mayoría de las herramientas se rinden. Archivos de hasta 90 minutos cada uno, sin cuenta, sin marca de agua.
Lo que ves en esta página es la herramienta completa, no una versión de prueba. El pase no cambia la transcripción ni la hace mejor — añade lo que haces con la transcripción después.
Esta es la herramienta completa, no una prueba. El mismo modelo y la misma transcripción que con el pase — aquí no hay nada desactivado.
Gestionado por Polar, nuestro proveedor de pagos — ellos se encargan del cobro y del IVA. Aquí no hay cuenta: tu pase se guarda en este navegador.
Cualquier formato de audio o video habitual. La transcripción empieza al instante: sin cuenta, sin correo, sin límite diario.
Un modelo de reconocimiento de voz (Whisper) lo transcribe en nuestra GPU, detecta el idioma automáticamente y marca quién habla cuando hay más de una voz, normalmente mucho más rápido que en tiempo real.
Llévate la transcripción en TXT y los subtítulos con códigos de tiempo en SRT y VTT. Tu archivo subido se borra automáticamente.
Subtítulos SRT/VTT para YouTube, Reels y TikTok: accesibilidad y alcance, sin pagar por minuto.
Convierte entrevistas, reuniones y clases grabadas en texto que puedes buscar, citar y hojear, separado por hablante para ver quién dijo qué.
Una transcripción completa por episodio para las notas del episodio y el SEO: cada palabra de tu episodio, indexable.
Sí: sin cuenta, sin marca de agua, sin cobro por minuto ni límite diario, y la versión gratuita no es una prueba — no caduca y usa el mismo modelo que todo lo demás de aquí. La publicidad mantiene la GPU en marcha. Hay un único extra opcional: un pase mensual de €5 con notas de reunión, nombres reales de los hablantes, exportación a Word y límites más altos. Te da más cosas que hacer con tu transcripción, no una transcripción mejor.
Se procesa en nuestro propio servidor y se borra en cuanto termina; los resultados desaparecen en 45 minutos. No se guarda nada, ni se comparte, ni se usa para entrenar. Consulta la Política de privacidad.
Usamos Whisper large-v3, uno de los mejores modelos abiertos de reconocimiento de voz. El habla clara se transcribe con mucha precisión; los acentos marcados, las voces superpuestas, el ruido de fondo o las grabaciones de mala calidad son difíciles para cualquier herramienta. Dale siempre un repaso rápido.
Sí. Cuando oye más de una voz, divide la transcripción en turnos de palabra automáticamente, hasta ocho hablantes, sin activar nada. Eso es lo que hace legible una entrevista o la grabación de una reunión, en vez de un bloque de texto interminable. Las etiquetas las estima la IA, así que con voces superpuestas o muy parecidas conviene revisarlas.
Sí. Marca “Crear también una versión limpia o subtitulada” antes de subir el archivo y recibirás un segundo archivo con cada palabrota tapada con un pitido, silenciada o cortada — y, si quieres, también las muletillas (“eh”) y los silencios largos. Primero ves la lista completa con las marcas de tiempo y puedes dejar cualquier palabra tal cual. Más sobre censurar palabrotas y quitar muletillas.
Unos 100 idiomas, detectados automáticamente (o elige uno). Audio y video: MP3, WAV, M4A, FLAC, OGG, MP4, MOV, MKV, WEBM y más, hasta 2 GB y 90 minutos.
Sí, sube el video directamente y descarga el archivo SRT o VTT. Deja el SRT junto a tu video o súbelo a YouTube como subtítulos.
Sí. Instagram, TikTok, WhatsApp y la mayoría de televisores ignoran un archivo de subtítulos aparte, así que marca “Crear también una versión limpia o subtitulada” antes de subir el archivo, elige uno de los tres estilos (Classic, Boxed o Big) y descarga un MP4 con el texto incrustado en la imagen. Sin instalar ningún editor, sin marca de agua, y tu archivo original se queda intacto. Guía completa: cómo añadir subtítulos a cualquier video.
Esa es nuestra herramienta hermana: StemGrab separa voz, batería, bajo e instrumental, también gratis.