Solte uma gravação aqui e receba uma transcrição limpa mais legendas SRT e VTT prontas para usar. Cole um link do YouTube e receba o texto em um segundo, ou solte um arquivo — entrevistas, aulas, podcasts, gravações de voz — e ele é transcrito automaticamente numa GPU de verdade — uma hora de áudio leva cerca de dois minutos. O vídeo não tem legenda? A gente transcreve mesmo assim, e é aí que a maioria das ferramentas desiste. Arquivos de até 90 minutos cada, sem conta, sem marca d'água.
O que está nesta página é a ferramenta inteira, não uma versão de teste. O passe não muda a transcrição nem deixa o texto melhor — ele acrescenta o que você faz com a transcrição depois.
Esta é a ferramenta inteira, não um teste. Mesmo modelo e a mesma transcrição que com um passe — nada aqui está desligado.
Processado pela Polar, nosso provedor de pagamento — eles cuidam do pagamento e dos impostos. Sem conta aqui: seu passe fica guardado neste navegador.
Qualquer formato comum de áudio ou vídeo. A transcrição começa na hora: sem conta, sem e-mail, sem limite diário.
Um modelo de reconhecimento de fala (Whisper) transcreve na nossa GPU, detecta o idioma automaticamente e marca quem está falando quando há mais de uma voz, normalmente bem mais rápido que o tempo real.
Pegue a transcrição em texto puro no TXT e as legendas com marcação de tempo em SRT e VTT. Seu upload é apagado automaticamente.
Legendas SRT/VTT para YouTube, Reels e TikTok: acessibilidade e alcance, sem pagar por minuto.
Transforme entrevistas, reuniões e aulas gravadas em texto pesquisável que dá para citar e ler por cima, separado por falante para você ver quem disse o quê.
Uma transcrição completa por episódio para as notas do episódio e para SEO: cada palavra do seu episódio, indexável.
Sim: sem conta, sem marca d'água, sem cobrança por minuto nem limite diário, e a ferramenta grátis não é um teste — ela não expira e roda o mesmo modelo que todo o resto aqui. Os anúncios é que mantêm a GPU ligada. Existe um extra opcional: um passe mensal de €5 com ata de reunião, nomes reais dos falantes, exportação para Word e limites maiores. Ele te dá mais coisas para fazer com a sua transcrição, não uma transcrição melhor.
Ele é processado no nosso próprio servidor e apagado assim que termina; os resultados somem em até 45 minutos. Nada é guardado, compartilhado ou usado para treinamento. Veja a Política de Privacidade.
Usamos o Whisper large-v3, um dos melhores modelos abertos de reconhecimento de fala. Fala clara sai com precisão altíssima; sotaques carregados, gente falando por cima, ruído de fundo ou gravações ruins são difíceis para qualquer ferramenta. Sempre dê uma revisada rápida.
Sim. Quando ele ouve mais de uma voz, divide a transcrição por falante automaticamente, até oito falantes, sem precisar ligar nada. É isso que deixa uma entrevista ou a gravação de uma reunião legível, em vez de um bloco enorme de texto. As identificações são estimadas por IA, então quando todo mundo fala junto ou as vozes são muito parecidas, dê uma conferida.
Sim. Marque “Fazer também uma versão limpa ou legendada” antes de enviar e você recebe um segundo arquivo com cada palavrão bipado, mutado ou cortado — e, se quiser, também os “hum” e os silêncios longos. Primeiro você vê a lista completa com os horários e pode deixar qualquer palavra no lugar. Mais sobre bipar palavrões e remover vícios de linguagem.
Cerca de 100 idiomas, detectados automaticamente (ou escolha um). Áudio e vídeo: MP3, WAV, M4A, FLAC, OGG, MP4, MOV, MKV, WEBM e mais, até 2 GB e 90 minutos.
Sim, envie o vídeo direto e baixe o arquivo SRT ou VTT. Deixe o SRT na mesma pasta do vídeo ou suba ele no YouTube como legenda.
Sim. Instagram, TikTok, WhatsApp e a maioria das TVs ignoram um arquivo de legenda separado, então marque “Fazer também uma versão limpa ou legendada” antes de enviar, escolha um dos três estilos (Classic, Boxed ou Big) e baixe um MP4 com o texto queimado na imagem. Sem instalar editor, sem marca d'água, e seu arquivo original fica intacto. Guia completo: como adicionar legendas a qualquer vídeo.
Essa é a nossa ferramenta irmã: o StemGrab separa vocais, bateria, baixo e instrumental, também de graça.