Kein Konto. 10 Aufnahmen pro Tag. Andere geben Ihnen drei Dateien pro Tag und nennen es unbegrenzt. Dateien bis zu 60 Minuten hier, und es wird um Mitternacht zurückgesetzt.
Laden Sie eine Aufnahme hoch, erhalten Sie die Wörter als Textdatei und als Untertitel, und das Audio wird gelöscht, sobald die Transkription vorliegt.
Sie lassen eine Aufnahme fallen, eine Grafikkarte in meinem Haus läuft es durch Unser Sprachmodell, und Sie erhalten ein Klartext-Transkript plus zeitcodierte SRT- und VTT-Untertitel zurück. Kein Konto, kein Wasserzeichen, 10 Aufnahmen pro Tag, kein Minutenmeter in der Ecke.
Der Teil "Mein Haus" ist wörtlich. Ich bin eine Person mit einer Maschine, und ich habe auch gebaut StemGrab und PicReviver, die auf den gleichen zwei Karten laufen. Wenn alle drei beschäftigt sind, wartet Ihre Datei in einer Schlange hinter jemandes Lied. Das ist der ehrliche Grund, warum ein Transkript manchmal sofort ist und manchmal eine Minute dauert.
Die genauen Zahlen, damit Sie es wissen, bevor Sie etwas hochladen. Jeder hier angegebene Wert ist der, den der Server tatsächlich durchsetzt.
| Kostenlos | Mit einem Pass | |
|---|---|---|
| Preis | Kostenlos. Keine Registrierung, kein Konto, keine Kreditkarte erforderlich. | 5 € für 30 Tage oder 3 € für 24 Stunden |
| Maximale Länge | 60 Minuten pro Datei | 4 Stunden pro Datei |
| Maximale Dateigröße | 1,5 GB | 1,5 GB |
| Dateien gleichzeitig | 2 | 5 |
| Warteschlange | Normal | Priorität, wenn die Karten beschäftigt sind |
| Ergebnisse werden für | 45 Minuten | 24 Stunden |
| Sprecherkennzeichnungen | Automatisch auf beiden Stufen hinzugefügt – „Sprecher 1:“, „Sprecher 2:“ in der Transkription und den Untertiteln | |
| Umbenennen der Sprecher | Nein | Ja – ersetzen Sie „Sprecher 1“ durch einen echten Namen im gesamten Dokument |
| Export im Word-Format (.docx) | Nein | Ja |
| Protokolle von Besprechungen | Nein | Ja |
| Übersetzen nach | Eine Sprache nach der anderen | Bis zu 5 gleichzeitig |
| Transkription pro Tag | 10/Tag | 50/Tag |
| Text-zu-Sprache-Konvertierung pro Tag | 10 Minuten | 60 Minuten |
| Textbearbeitungswerkzeuge pro Tag | 25.000 Zeichen | 250.000 Zeichen |
| Eingabeformate | 25 Audio- und Videoformate: MP3, WAV, FLAC, M4A, AAC, OGG, OPUS, WMA, AIFF, AIF, MP4, MOV, MKV, WEBM, AVI, M4V, MPEG, MPG, WMV, 3GP, AMR, M4B, CAF, TS, FLV | |
| Ausgabeformate | TXT, SRT, VTT | TXT, SRT, VTT, DOCX |
| Transkriptionssprachen | Etwa 100, werden automatisch erkannt | |
| Übersetzungssprachen | 16: Englisch, Spanisch, Französisch, Deutsch, Niederländisch, Portugiesisch, Italienisch, Polnisch, Türkisch, Russisch, Arabisch, Hindi, Indonesisch, Japanisch, Koreanisch und vereinfachtes Chinesisch. Zeitstempel werden beibehalten. | |
| Wo es ausgeführt wird | Auf unseren eigenen Grafikkarten in den Niederlanden. Ihre Audiodateien werden niemals an OpenAI, Google, AWS oder einen anderen Transkriptionsdienst gesendet. | |
| Ihr Upload | Gelöscht, sobald die Verarbeitung abgeschlossen ist, unabhängig vom Erfolg oder Misserfolg – und das gilt für beide Varianten. | |
| Wasserzeichen | Keines, weder bei der Ausgabe noch bei einer der Varianten. | |
Die kostenlose Version ist keine Testversion und läuft nicht ab. Was das Abonnement ermöglicht, ist eine längere Bearbeitungszeit, höhere Geschwindigkeit und zusätzliche Exportformate – die Transkription selbst basiert in jedem Fall auf demselben Modell.
Otter, Rev, Sonix und die anderen zahlen einem Cloud-Anbieter für jede Minute der Audiodateien, die sie verarbeiten, daher müssen sie Ihnen pro Minute in Rechnung stellen oder den Zugriff nach wenigen Dateien sperren. Ich habe diese Kosten nicht. Die Kreditkarten wurden gekauft und bezahlt; Ihre Stunde Audio kostet mich etwas Strom und sonst nichts.
Die Anzeigen auf der Seite decken diesen Strom und den Domainnamen ab. Es gibt auch einen optionalen Pass — 5 € für 30 Tage, 3 € für 24 Stunden — Das hebt das limit von 60 minuten auf 4 stunden, fügt lautsprecher-labels, word-export und besprechungsminuten hinzu und bringt sie in die warteschlange, wenn die karten beschäftigt sind. Der genaue Unterschied liegt in der obigen Tabelle. Was es tut nicht Do ist alles weg von der freien Ebene nehmen: die SRT war immer frei zu sein, es ist die gleiche Datei mit Zeitstempel in ihm, und kein freies Limit wurde gesenkt, um den Pass besser aussehen zu lassen.
Die Transkription funktioniert nur, wenn Sie mir Ihre Aufnahmen zur Verfügung stellen, daher sind die Regeln kurz und ich halte mich strikt daran:
Alle Details sind in der Datenschutzrichtlinie.
Klare Worte — Interviews, Vorträge, Podcasts, Sprachmemos, Screen Recordings — kommt sehr genau zurück, in rund 100 Sprachen, die es selbst erkennt. Drei Dinge schlagen es, und sie schlagen auch jedes andere System: ein Raum voller Hintergrundgeräusche, Leute, die übereinander reden, und ein sehr starker Akzent auf einem schlechten Mikrofon. Ich schrieb einen ehrlichen Guide über wie genau automatische Transkription wirklich ist Anstatt einen prozentsatz bei ihnen zu zitieren. Musik transkribiert überhaupt nicht; zum Aufteilen von Songs in Spuren verwenden Sie StemGrab.
Einen Bug gefunden, ein seltsames Ergebnis bekommen oder einfach nur etwas sagen wollen? Die Kontaktformular landet in meinem Posteingang, keine Ticketwarteschlange.
Über die Byline. Ich schreibe als Sam Ridder. Es ist ein Pseudonym: Transkription ist eine Sache, an die Leute private Aufnahmen abgeben, und ich würde es vorziehen, wenn sie das Setup beurteilen würden, das ich hier beschrieben habe, als einen Namen, den sie nachschlagen können. Jede sachliche behauptung auf dieser seite ist korrekt.