No es necesario crear una cuenta. Sin límite diario.Otros te ofrecen tres archivos al día y lo llaman ilimitado. Aquí puedes subir archivos de hasta 60 minutos, tantas veces como quieras.
Una transcripción de una conversación es solo la mitad si no puedes identificar quién dijo qué. ScribeGrab agrupa las voces que escucha y coloca Orador 1, Orador 2 al principio de cada línea, automáticamente, tanto en el texto como en los subtítulos.
Transcripción y subtítulos sencillos, justo aquí. Las etiquetas del orador, la eliminación de palabras malsonantes, la traducción, los subtítulos incrustados y los archivos de más de 90 MB están disponibles en la versión completa de la herramienta.
Transcribe audio ahora →También se conoce como diarización: no se trata de reconocer quién es, sino de detectar que esta voz y aquella voz pertenecen a dos personas diferentes, e indicar dónde habla cada una. El resultado es una transcripción que puedes leer como un guion en lugar de un bloque de texto.
Cada fragmento de voz se convierte en una "huella digital" (un embedding ECAPA-TDNN), y esas huellas digitales se agrupan: las voces que están muy próximas entre sí se consideran como pertenecientes a la misma persona. El grupo al que pertenece cada línea determina su etiqueta, y esa etiqueta se escribe en los archivos TXT, SRT y VTT.
Funciona de forma autónoma. No hay ninguna configuración que activar ni nada que indicarle por adelantado, incluido el número de personas que hay en la sala.
No puede conocer el nombre de nadie. Nunca ha oído tu voz antes, así que dice "Orador 1", no "Sarah": lee la primera frase que dice cada persona y reemplaza las etiquetas una vez en tu editor de texto.
La transcripción en sí no se ve afectada: si las voces no se pueden distinguir de forma fiable, simplemente obtendrá la transcripción normal sin etiquetas.
Las etiquetas de los oradores se generan a partir de la misma carga que el resto del contenido, por lo que una llamada grabada puede devolverse etiquetada, con subtítulos y con las palabrotas silenciadas si necesita compartirla. Consulte también la transcripción de una entrevista y una grabación de Zoom o Teams.
No. Si se escuchan dos o más voces distintas, las etiquetas se añaden automáticamente en la transcripción y en ambos formatos de subtítulos.
No, y ninguna herramienta puede hacerlo sin que se le indique quién es quién de antemano. Obtendrá "Orador 1", "Orador 2", etc.; busque la primera línea de cada uno y reemplace las etiquetas en su editor de texto.
De dos a ocho. Si hay más, la agrupación de voces no es lo suficientemente fiable como para mostrarla, por lo que omite las etiquetas en lugar de hacer una suposición incorrecta.
O bien solo detectó una voz, o bien detectó más de ocho grupos, lo que significa que la grabación era demasiado ruidosa o tenía demasiados solapamientos para poder agruparlas con precisión. La transcripción en sí sigue estando completa.
Sí, como todo lo demás aquí: no requiere cuenta, no hay límite diario, no se añade ninguna marca de agua y tu archivo se elimina inmediatamente después del procesamiento.