SCRIBEGRAB

Ubah audio atau video apa pun menjadi teks & subtitel

Gratis, tanpa pendaftaran, tanpa tanda air. Satu jam audio membutuhkan waktu sekitar dua menit.

Tidak punya file? Tempelkan tautan YouTube di bawah ini. Teks dapat diterjemahkan ke dalam 16 bahasa atau tempelkan tautan

Dapatkan transkrip
Mengunggah…

Tempelkan Tautan YouTube dan hasilnya akan muncul dalam hitungan detik — dan jika video tersebut tidak memiliki teks terjemahan, kami tetap membuat transkripsinya, yang merupakan keunggulan dibandingkan sebagian besar alat lainnya. Wawancara, kuliah, podcast, catatan suara: file hingga 60 menit per file, tanpa perlu akun, tanpa tanda air.

Dari rekaman menjadi teks tertulis

1. Unggah file

Format audio atau video apa pun yang umum digunakan. Transkripsi dimulai secara otomatis: tidak perlu akun, tidak perlu email, tidak ada batasan harian.

2. Alat ini akan membuat transkripsinya

Model pengenalan suara (Whisper) melakukan transkripsi di GPU kami, mendeteksi bahasa secara otomatis dan menandai siapa yang berbicara ketika ada lebih dari satu suara, biasanya jauh lebih cepat daripada waktu nyata.

3. Unduh

Dapatkan teks transkripsi dalam format TXT dan teks terjemahan dengan kode waktu dalam format SRT dan VTT. File yang Anda unggah akan dihapus secara otomatis.

17 detik, tanpa ada bagian yang dipotong: rekaman diunggah dan dikembalikan sebagai teks transkripsi, dengan TXT, SRT, dan VTT siap untuk diunduh.
AUDIO buat transkripsi transkrip.txt 00:00 Selamat datang kembali di saluran ini. 00:04 Hari ini, kami akan menguji tiga mikrofon dengan harga terjangkau.
Input suara, output teks bersih yang diberi kode waktu: transkrip menyimpan stempel waktu untuk setiap baris.

Tiga jenis rekaman

UNTUK PARA PEMBUAT KONTEN

Subtitel video

Subtitel SRT/VTT untuk YouTube, Reels, dan TikTok: meningkatkan aksesibilitas dan jangkauan tanpa membayar per menit.

UNTUK KERJA & BELAJAR

Wawancara & kuliah

Ubah rekaman wawancara, rapat, dan kuliah menjadi teks yang dapat dicari sehingga Anda dapat mengutip dan menelusurinya dengan cepat, serta dipisahkan berdasarkan pembicara agar Anda tahu siapa yang mengatakan apa.

PODCAST

Catatan acara

Transkrip lengkap untuk setiap episode yang dapat digunakan sebagai catatan acara dan untuk keperluan SEO: setiap kata dalam episode Anda akan terindeks.

Pertanyaan tentang transkripsi

Apakah benar-benar gratis?

Ya: tidak perlu membuat akun, tidak ada tanda air, tidak ada biaya per menit atau batasan harian, dan alat gratis ini bukanlah versi uji coba—alat ini tidak kedaluwarsa dan menggunakan model yang sama dengan semua fitur lainnya di sini. Iklan membantu menjaga agar GPU tetap berfungsi. Ada satu opsi tambahan Langganan bulanan seharga €5 yang mencakup catatan rapat, nama pembicara asli, ekspor ke Word, dan batasan yang lebih tinggi. Ini memberi Anda lebih banyak pilihan untuk melakukan sesuatu dengan transkrip Anda, bukan menghasilkan transkrip yang lebih baik.

Apa yang terjadi pada file saya?

File diproses di server kami sendiri dan dihapus segera setelah selesai; hasilnya akan dihapus dalam waktu 45 menit. Tidak ada yang disimpan, dibagikan, atau digunakan untuk pelatihan. Lihat Kebijakan Privasi.

Seberapa akuratkah alat ini?

Kami menggunakan our speech model, salah satu model pengenalan suara sumber terbuka terbaik. Ucapan yang jelas akan ditranskripsikan dengan sangat akurat; aksen yang kuat, percakapan silang, kebisingan latar belakang, atau rekaman berkualitas buruk akan lebih sulit untuk diproses oleh alat apa pun. Selalu lakukan pemeriksaan singkat setelah transkripsi selesai.

Apakah alat ini menunjukkan siapa yang berbicara?

Ya. Ketika alat mendeteksi lebih dari satu suara, alat akan membagi transkrip menjadi giliran pembicara secara otomatis, hingga delapan pembicara, tanpa perlu pengaturan tambahan. Inilah yang membuat rekaman wawancara atau rapat dapat dibaca alih-alih hanya berupa blok teks panjang. Labelnya diperkirakan oleh AI, jadi jika ada percakapan silang atau suara yang sangat mirip, periksa kembali dengan cepat.

Bisakah kata-kata kasar disensor?

Ya. Centang “Buat juga versi yang sudah diedit atau diberi teks” sebelum Anda mengunggah, dan Anda akan mendapatkan berkas kedua dengan setiap kata kasar yang disensor, dibisukan, atau dipotong — ditambah, jika Anda mau, kata-kata pengisi seperti "um" dan jeda panjang juga bisa dihilangkan. Anda dapat melihat daftar lengkapnya beserta waktu munculnya terlebih dahulu dan memilih kata mana saja yang ingin tetap ada. Informasi lebih lanjut tentang menyensor kata-kata kasar dan menghapus kata-kata pengisi.

Bahasa dan jenis berkas apa saja yang didukung?

Sekitar 100 bahasa, terdeteksi secara otomatis (atau Anda dapat memilihnya). Audio dan video: MP3, WAV, M4A, FLAC, OGG, MP4, MOV, MKV, WEBM, dan lainnya, hingga 1.5 GB dan 60 menit.

Bisakah saya mendapatkan teks untuk sebuah video?

Ya, unggah video secara langsung dan unduh berkas SRT atau VTT. Letakkan berkas SRT di samping video Anda atau unggah ke YouTube sebagai teks.

Bisakah Anda menyisipkan teks ke dalam video itu sendiri?

Ya. Instagram, TikTok, WhatsApp, dan sebagian besar TV tidak mengenali berkas teks terpisah, jadi centang “Buat juga versi yang sudah diedit atau diberi teks” sebelum Anda mengunggah, pilih salah satu dari tiga tampilan (Klasik, Berbingkai, atau Besar), dan unduh MP4 dengan teks yang disisipkan ke dalam gambarTidak perlu menginstal perangkat lunak pengeditan, tidak ada tanda air, dan berkas asli Anda tetap utuh. Panduan lengkap: cara menambahkan teks terjemahan ke video apa pun.

Apakah Anda perlu memisahkan sebuah lagu menjadi beberapa bagian audio?

Ini adalah alat kami yang lain: StemGrab memisahkan vokal, drum, bass, dan instrumen, juga gratis.

Di mana letak ketidakakuratan sebenarnya?

Pada rekaman yang jelas dari satu orang yang berbicara dalam bahasa Inggris, model ini berhasil mengenali sekitar sembilan puluh delapan kata dari seratus kata dengan benar — kami mengukur 1,94% kesalahan kata pada ucapan yang jernih. Tiga hal menjadi penyebab utama masalah. Percakapan silang, di mana dua orang berbicara secara bersamaan, karena model harus memilih salah satu suara. Jarak dari mikrofon, karena ponsel di ujung meja rapat akan menangkap lebih banyak suara ruangan daripada suara manusia. Dan kosakata yang tidak biasa: nama, merek, jargon, dan singkatan ditebak berdasarkan konteks, sehingga nama keluarga yang belum pernah dilihat sebelumnya akan menghasilkan sesuatu yang hanya terdengar mirip. Aksen yang kuat ditangani dengan lebih baik daripada yang diperkirakan kebanyakan orang; musik latar belakang ditangani dengan kurang baik.

Mengapa tidak ada batasan harian sementara alat transkripsi gratis lainnya membatasi Anda?

Pengenalan ucapan membutuhkan waktu pemrosesan GPU, dan sebagian besar alat transkripsi gratis menyewa waktu tersebut dari layanan cloud per menit audio — yang merupakan alasan mengapa ada batasan tiga file per hari dan dua puluh menit. Kami memiliki perangkat kerasnya: kartu grafis yang sama digunakan untuk menjalankan alat kami yang lain di Belanda, sehingga rekaman tambahan membutuhkan biaya listrik daripada tagihan, dan iklan di halaman mencakup biayanya. Itulah sebabnya ukuran file dapat mencapai sembilan puluh menit dan dua gigabyte setiap file, sebanyak yang Anda inginkan, tanpa akun atau alamat email.

Cara populer menggunakan ScribeGrab