SCRIBEGRABAbra a ferramenta →

Identifique os participantes em um áudio Gratuito

Sem necessidade de conta. Sem limite diário.Outros oferecem apenas três arquivos por dia e dizem que é ilimitado. Aqui, você pode usar até 60 minutos de áudio quantas vezes quiser.

Uma transcrição de uma conversa é apenas metade se você não conseguir identificar quem disse o quê. O ScribeGrab agrupa as vozes que ouve e coloca Participante 1, Participante 2 no início de cada linha — automaticamente, tanto no texto quanto nas legendas.

Transcrição e legendas simples, tudo aqui. Identificação de falantes, remoção de palavras, tradução, legendas fixas e arquivos com mais de 90 MB estão disponíveis na ferramenta completa.

Transcreva áudio agora →
O que a identificação de oradores realmente oferece

Também é chamada de diarização: não se trata de reconhecer quem é, mas sim de identificar que esta voz e aquela voz pertencem a duas pessoas diferentes, e marcar onde cada uma delas está falando. O resultado é uma transcrição que você pode ler como um roteiro, em vez de um bloco de texto confuso.

Do áudio à transcrição, aqui mesmo

Cada trecho da fala é transformado em uma "impressão digital" da voz — um embedding ECAPA-TDNN —, e essas impressões digitais são agrupadas: vozes que se assemelham são tratadas como sendo da mesma pessoa. O grupo ao qual uma determinada frase pertence define seu rótulo, e esse rótulo é inserido nos arquivos TXT, SRT e VTT.

Ele funciona sozinho. Não há configurações para ativar nem nada a ser informado antecipadamente, incluindo o número de pessoas na sala.

Onde ele realmente para

Ele não pode saber o nome de ninguém. Nunca ouviu sua voz antes, então diz "Orador 1", e não "Sarah": leia a primeira frase que cada pessoa diz e substitua os rótulos no seu editor de texto.

A transcrição em si não é afetada: se as vozes não puderem ser distinguidas de forma confiável, você simplesmente obterá a transcrição normal, sem rótulos.

Funciona bem com

Os rótulos dos falantes são gerados no mesmo processo de upload que o restante do conteúdo, portanto, uma chamada gravada pode retornar com os rótulos aplicados e legendas, e com as palavras impróprias removidas, caso você precise compartilhá-la. Veja também a transcrição de uma entrevista e uma gravação do Zoom ou Teams.

Perguntas frequentes

Preciso ativar alguma configuração?

Não. Se duas ou mais vozes distintas forem detectadas, os rótulos serão adicionados automaticamente na transcrição e em ambos os formatos de legenda.

A ferramenta usará os nomes reais das pessoas?

Não, e nenhuma ferramenta pode fazer isso sem que você informe previamente quem é quem. Você receberá "Falante 1", "Falante 2" e assim por diante; encontre a primeira linha de cada um e substitua os rótulos no seu editor de texto.

Quantos interlocutores ele consegue identificar?

De dois a oito. Acima disso, o agrupamento de vozes não é preciso o suficiente para ser útil, então ele omite as etiquetas em vez de fazer suposições incorretas.

Por que minha transcrição não tem etiquetas?

Ou ele identificou apenas uma voz, ou identificou mais de oito grupos, o que significa que a gravação estava muito ruidosa ou com muita sobreposição para permitir um agrupamento confiável. A própria transcrição permanece completa.

A identificação de interlocutores é gratuita?

Sim, como tudo o mais aqui: sem necessidade de conta, sem limite diário, sem marca d'água e seu arquivo é excluído logo após o processamento.