SCRIBEGRABAbre la herramienta →

Identifica los oradores en el audio Gratis

No es necesario crear una cuenta. Sin límite diario.Otros te ofrecen tres archivos al día y lo llaman ilimitado. Aquí puedes subir archivos de hasta 60 minutos, tantas veces como quieras.

Una transcripción de una conversación es solo la mitad si no puedes identificar quién dijo qué. ScribeGrab agrupa las voces que escucha y coloca Orador 1, Orador 2 al principio de cada línea, automáticamente, tanto en el texto como en los subtítulos.

Transcripción y subtítulos sencillos, justo aquí. Las etiquetas del orador, la eliminación de palabras malsonantes, la traducción, los subtítulos incrustados y los archivos de más de 90 MB están disponibles en la versión completa de la herramienta.

Transcribe audio ahora →
Lo que realmente ofrece la identificación de oradores

También se conoce como diarización: no se trata de reconocer quién es, sino de detectar que esta voz y aquella voz pertenecen a dos personas diferentes, e indicar dónde habla cada una. El resultado es una transcripción que puedes leer como un guion en lugar de un bloque de texto.

Del archivo de audio a la transcripción aquí mismo

Cada fragmento de voz se convierte en una "huella digital" (un embedding ECAPA-TDNN), y esas huellas digitales se agrupan: las voces que están muy próximas entre sí se consideran como pertenecientes a la misma persona. El grupo al que pertenece cada línea determina su etiqueta, y esa etiqueta se escribe en los archivos TXT, SRT y VTT.

Funciona de forma autónoma. No hay ninguna configuración que activar ni nada que indicarle por adelantado, incluido el número de personas que hay en la sala.

Dónde se detiene (y por qué)

No puede conocer el nombre de nadie. Nunca ha oído tu voz antes, así que dice "Orador 1", no "Sarah": lee la primera frase que dice cada persona y reemplaza las etiquetas una vez en tu editor de texto.

La transcripción en sí no se ve afectada: si las voces no se pueden distinguir de forma fiable, simplemente obtendrá la transcripción normal sin etiquetas.

Compatible con

Las etiquetas de los oradores se generan a partir de la misma carga que el resto del contenido, por lo que una llamada grabada puede devolverse etiquetada, con subtítulos y con las palabrotas silenciadas si necesita compartirla. Consulte también la transcripción de una entrevista y una grabación de Zoom o Teams.

Preguntas frecuentes

¿Tengo que activar algo?

No. Si se escuchan dos o más voces distintas, las etiquetas se añaden automáticamente en la transcripción y en ambos formatos de subtítulos.

¿Utilizará los nombres reales de las personas?

No, y ninguna herramienta puede hacerlo sin que se le indique quién es quién de antemano. Obtendrá "Orador 1", "Orador 2", etc.; busque la primera línea de cada uno y reemplace las etiquetas en su editor de texto.

¿Cuántos oradores puede procesar?

De dos a ocho. Si hay más, la agrupación de voces no es lo suficientemente fiable como para mostrarla, por lo que omite las etiquetas en lugar de hacer una suposición incorrecta.

¿Por qué mi transcripción no tiene etiquetas?

O bien solo detectó una voz, o bien detectó más de ocho grupos, lo que significa que la grabación era demasiado ruidosa o tenía demasiados solapamientos para poder agruparlas con precisión. La transcripción en sí sigue estando completa.

¿La identificación de oradores es gratuita?

Sí, como todo lo demás aquí: no requiere cuenta, no hay límite diario, no se añade ninguna marca de agua y tu archivo se elimina inmediatamente después del procesamiento.