SCRIBEGRAB

Trasforma qualsiasi file audio o video in testo e sottotitoli

Gratuito, senza registrazione, senza filigrana. Un'ora di audio richiede circa due minuti.

Non hai un file a portata di mano? Incolla un link di YouTube qui sotto. I sottotitoli possono essere tradotti in 16 lingue.

oppure incolla un link
Caricamento in corso…

Incolla un link di YouTube e lo riceverai in pochi secondi; inoltre, se il video non ha i sottotitoli, li trascriviamo comunque, cosa che la maggior parte degli altri strumenti non fa. Interviste, lezioni, podcast, memo vocali: file fino a 60 minuti ciascuno, senza registrazione obbligatoria e senza filigrana.

Dalla registrazione alla trascrizione

1. Carica un file

Qualsiasi formato audio o video comune. La trascrizione inizia immediatamente: non è richiesta alcuna registrazione, né indirizzo e-mail, né limite giornaliero.

2. Lo strumento lo elabora

Un modello di riconoscimento vocale (Whisper) lo trascrive sul nostro server GPU, rileva automaticamente la lingua ed etichetta chi sta parlando quando ci sono più voci, solitamente in tempi molto più rapidi rispetto al tempo reale.

3. Scarica

Ottieni la trascrizione semplice come file TXT e i sottotitoli con indicazione temporale nei formati SRT e VTT. Il tuo caricamento viene eliminato automaticamente.

17 secondi, senza tagli: una registrazione viene inserita ed esce come trascrizione, con i file TXT, SRT e VTT pronti per il download.
AUDIO trascrivi transcript.txt 00:00 Benvenuti al canale. 00:04 Oggi mettiamo alla prova tre microfoni economici.
Registrazione vocale in ingresso, testo pulito con indicazione temporale in uscita: la trascrizione conserva un timestamp per ogni riga.

Tre tipi di registrazione

PER I CREATORI

Sottotitoli per video

Sottotitoli SRT/VTT per YouTube, Reels e TikTok: accessibilità e maggiore visibilità, senza costi al minuto.

LAVORO E STUDIO

Interviste e lezioni

Trasforma interviste, riunioni e lezioni registrate in testo ricercabile che puoi citare e consultare rapidamente, suddividendolo per oratore in modo da poter vedere chi ha detto cosa.

PODCAST

Note dello show

Trascrizione completa per ogni episodio, utile per le note dello spettacolo e per l’ottimizzazione SEO: ogni parola pronunciata nel tuo episodio sarà indicizzata.

Domande sulla trascrizione

È davvero gratuito?

Sì: non è richiesta la registrazione di un account, non ci sono filigrane, costi al minuto o limiti giornalieri, e lo strumento gratuito non è una versione di prova: non scade e utilizza lo stesso modello degli altri strumenti disponibili. La pubblicità consente di mantenere attivi i server. È disponibile un’opzione aggiuntiva Un abbonamento mensile da 5 € che include la trascrizione delle note delle riunioni, l’identificazione dei nomi reali degli oratori, l’esportazione in formato Word e limiti più elevati. Ti offre maggiori possibilità di utilizzo con la tua trascrizione, non una trascrizione migliore.

Cosa succede al mio file?

Viene elaborato sui nostri server e cancellato immediatamente dopo; i risultati vengono eliminati entro 45 minuti. Nulla viene memorizzato, condiviso o utilizzato per l’addestramento. Consulta la Politica sulla privacy.

Quanto è preciso?

Utilizziamo our speech model, uno dei migliori modelli open source per il riconoscimento vocale. Un discorso chiaro viene trascritto con grande precisione; accenti marcati, sovrapposizioni di voci, rumore di fondo o registrazioni di scarsa qualità rendono più difficile l’elaborazione per qualsiasi strumento. È sempre consigliabile effettuare una rapida revisione.

Indica chi sta parlando?

Sì. Quando rileva più di una voce, suddivide automaticamente la trascrizione in turni di parola, fino a otto oratori, senza che sia necessario attivare alcuna impostazione. Questo rende leggibile una registrazione di un’intervista o di una riunione, invece di presentarla come un unico blocco di testo. Le etichette vengono stimate dall’intelligenza artificiale, quindi, in caso di sovrapposizioni di voci o voci molto simili, è consigliabile controllarle rapidamente.

È possibile eliminare le parolacce?

Sì. Spunta la casella "Crea anche una versione senza parolacce o con sottotitoli" prima di caricare il file e riceverai un secondo file in cui ogni parolaccia sarà oscurata, silenziata o rimossa Inoltre, se lo desideri, potrai eliminare le intercalari ("ehm") e le lunghe pause. Visualizzerai l'elenco completo con i relativi timestamp e potrai lasciare qualsiasi parola. Per maggiori informazioni su come oscurare le parolacce, e come rimuovere le parole di riempimento.

Quali lingue e formati di file sono supportati?

Circa 100 lingue, rilevate automaticamente (o puoi selezionarne una). Audio e video: MP3, WAV, M4A, FLAC, OGG, MP4, MOV, MKV, WEBM e altri, fino a 2 GB e 60 minuti.

Posso ottenere i sottotitoli per un video?

Sì, carica direttamente il video e scarica il file SRT o VTT. Inserisci il file SRT accanto al tuo video oppure caricalo su YouTube come didascalia.

È possibile inserire i sottotitoli direttamente nel video?

Sì. Instagram, TikTok, WhatsApp e la maggior parte dei televisori ignorano un file di sottotitoli separato, quindi spunta la casella "Crea anche una versione senza parolacce o con sottotitoli" prima di caricare il file, scegli uno dei tre stili (Classico, a riquadro o grande) e scarica un file MP4 con il testo sovrapposto all'immagineNon è necessario installare alcun editor, non ci sono watermark e il tuo file originale rimane intatto. Guida completa: Come aggiungere i sottotitoli a qualsiasi video.

Hai bisogno di dividere una canzone in tracce separate?

Ecco il nostro strumento complementare: StemGrab separa la voce, la batteria, il basso e gli strumenti, ed è gratuito.

In quali casi l'accuratezza diminuisce?

Su una registrazione chiara di una persona che parla inglese, il modello riesce a trascrivere correttamente circa novantanove parole su cento; abbiamo rilevato un tasso di errore del 1,94% in condizioni ottimali. Tre fattori influiscono maggiormente: sovrapposizione delle voci, quando due persone parlano contemporaneamente, perché il modello deve scegliere una voce; distanza dal microfono, poiché un telefono posto all'estremità opposta di un tavolo durante una riunione registra più rumore ambientale che la voce. E vocabolario insolito: nomi propri, marchi, termini tecnici e abbreviazioni vengono dedotti dal contesto, quindi un cognome mai sentito prima viene interpretato in base a come suona. Gli accenti marcati vengono gestiti meglio di quanto ci si aspetti; la musica di sottofondo viene gestita peggio.

Perché non c'è un limite giornaliero quando altri servizi di trascrizione gratuiti lo impongono?

Il riconoscimento vocale richiede potenza di calcolo della GPU e la maggior parte dei servizi di trascrizione gratuiti noleggiano tale potenza da un servizio cloud per ogni minuto di audio, il che spiega perché esistono limiti di tre file al giorno e venti minuti. Noi possediamo l'hardware: le stesse schede grafiche alimentano gli altri nostri strumenti nei Paesi Bassi, quindi una registrazione aggiuntiva comporta un costo per l'elettricità anziché una fattura, e la pubblicità sulla pagina copre tale costo. Ecco perché i file possono avere una durata massima di novanta minuti e una dimensione massima di due gigabyte ciascuno, in quantità illimitata, senza necessità di creare un account o fornire un indirizzo e-mail.

Modi popolari per utilizzare ScribeGrab