Sem necessidade de conta. Sem limite diário.Outros oferecem apenas três arquivos por dia e dizem que é ilimitado. Aqui, você pode usar até 60 minutos de áudio quantas vezes quiser.
Uma transcrição de uma conversa é apenas metade se você não conseguir identificar quem disse o quê. O ScribeGrab agrupa as vozes que ouve e coloca Participante 1, Participante 2 no início de cada linha — automaticamente, tanto no texto quanto nas legendas.
Transcrição e legendas simples, tudo aqui. Identificação de falantes, remoção de palavras, tradução, legendas fixas e arquivos com mais de 90 MB estão disponíveis na ferramenta completa.
Transcreva áudio agora →Também é chamada de diarização: não se trata de reconhecer quem é, mas sim de identificar que esta voz e aquela voz pertencem a duas pessoas diferentes, e marcar onde cada uma delas está falando. O resultado é uma transcrição que você pode ler como um roteiro, em vez de um bloco de texto confuso.
Cada trecho da fala é transformado em uma "impressão digital" da voz — um embedding ECAPA-TDNN —, e essas impressões digitais são agrupadas: vozes que se assemelham são tratadas como sendo da mesma pessoa. O grupo ao qual uma determinada frase pertence define seu rótulo, e esse rótulo é inserido nos arquivos TXT, SRT e VTT.
Ele funciona sozinho. Não há configurações para ativar nem nada a ser informado antecipadamente, incluindo o número de pessoas na sala.
Ele não pode saber o nome de ninguém. Nunca ouviu sua voz antes, então diz "Orador 1", e não "Sarah": leia a primeira frase que cada pessoa diz e substitua os rótulos no seu editor de texto.
A transcrição em si não é afetada: se as vozes não puderem ser distinguidas de forma confiável, você simplesmente obterá a transcrição normal, sem rótulos.
Os rótulos dos falantes são gerados no mesmo processo de upload que o restante do conteúdo, portanto, uma chamada gravada pode retornar com os rótulos aplicados e legendas, e com as palavras impróprias removidas, caso você precise compartilhá-la. Veja também a transcrição de uma entrevista e uma gravação do Zoom ou Teams.
Não. Se duas ou mais vozes distintas forem detectadas, os rótulos serão adicionados automaticamente na transcrição e em ambos os formatos de legenda.
Não, e nenhuma ferramenta pode fazer isso sem que você informe previamente quem é quem. Você receberá "Falante 1", "Falante 2" e assim por diante; encontre a primeira linha de cada um e substitua os rótulos no seu editor de texto.
De dois a oito. Acima disso, o agrupamento de vozes não é preciso o suficiente para ser útil, então ele omite as etiquetas em vez de fazer suposições incorretas.
Ou ele identificou apenas uma voz, ou identificou mais de oito grupos, o que significa que a gravação estava muito ruidosa ou com muita sobreposição para permitir um agrupamento confiável. A própria transcrição permanece completa.
Sim, como tudo o mais aqui: sem necessidade de conta, sem limite diário, sem marca d'água e seu arquivo é excluído logo após o processamento.