Von ShinobiTools Team · Zuletzt aktualisiert: Juli 2026
Wende Rede in Text kostenlos: ein Interview, ein Sprachmemo, ein aufgezeichneter Anruf, ein Vortrag.
Laden Sie die Aufnahme hoch, und die gesprochenen Worte werden als Text angezeigt, den Sie kopieren, durchsuchen und bearbeiten können – ohne Registrierung, ohne Wasserzeichen und ohne Gebühr pro Minute. Ein Tool, das Audiodateien in Text umwandelt – diese Seite bietet beides kostenlos, ohne Registrierung und ohne Wasserzeichen. Der reine Text kann anschließend direkt in ein Dokument eingefügt werden, sodass Ihre bisherige Arbeitsweise mit Google Docs weiterhin problemlos funktioniert – einfach das Ergebnis einfügen.
Kein Konto. 10 Aufnahmen pro Tag. Andere geben Ihnen drei Dateien pro Tag und nennen es unbegrenzt. Dateien bis zu 60 Minuten hier, und es wird um Mitternacht zurückgesetzt.
Trascript Audio jetztDie meisten "kostenlosen" Transkribatoren kappen Sie mit ein paar Minuten pro Tag oder stempeln ein Wasserzeichen auf die Ausgabe, bis Sie bezahlen. ScribeGrab läuft auf unserer eigenen GPU, also gibt es keine Cloud-Rechnung pro Minute — 10 Aufnahmen pro Tag, einzelne Dateien bis zu 60 Minuten und 1,5 GB, etwa 100 Sprachen automatisch erkannt, und Ihr Upload wird sofort gelöscht.
Sie wählen die Sprache nicht aus: Sie wird von der Aufzeichnung selbst erkannt, und das Transkript kommt in der Sprache zurück, die gesprochen wurde. Wollen Sie es in einer anderen Sprache, das ist ein separater Knopf danach, mit den Timings intakt gehalten — siehe Untertitel übersetzen.
Nennen Sie es ai Rede zu Text oder nur Transkription — Beide laufen durch das freie Werkzeug unten. Lassen Sie die Aufnahme fallen und die Wörter kommen innerhalb von Sekunden als Text zurück, bereit zum Kopieren, Suchen oder Bearbeiten.
Das Tool zur Umwandlung von Sprache in Text finden Sie in der Upload-Box oben – keine Registrierung erforderlich, keine Gebühren pro Minute. „Kostenlose Sprache-zu-Text“-Funktion ist die gleiche Upload-Box, nur mit einem kürzeren Namen. Die einfache Frage, ob das Tool „Kostenlose Sprache-zu-Text“-Funktion tatsächlich kostenlos ist, lässt sich mit Ja beantworten: keine Registrierung, keine Kreditkarte erforderlich.
Das kostenlose Angebot umfasst eine kostenlose Online-Spracherkennung. Es gibt eine kostenlose Webversion und eine kostenlose App-Version; beide laufen als Webseite im Browser und nicht als installierte Anwendung. Eine einfache Spracherkennungsfunktion führt zum selben Ergebnis. Eine kostenlose Google-Suche nach Spracherkennung bezieht sich in der Regel auf die eigene Funktion „Spracheingabe“ in Google Docs, die ein aktives Mikrofon benötigt; diese Seite funktioniert stattdessen mit einer Datei.
Unser kostenloses Online-Tool für die Spracherkennung funktioniert in jedem Browserfenster, und das gilt auch für die Spracherkennungsfunktion auf Ihrem Gerät – es ist kein separater Download erforderlich. Es gibt keine separate Desktop-App für die Spracherkennung, die Sie installieren müssten – das Browserfenster ist das Tool selbst.
Das gilt auch für die Spracherkennung auf dem iPhone oder für Apple-Aufnahmen. Sowohl die Spracherkennung für Android als auch für WhatsApp-Sprachnachrichten funktionieren, indem die Datei hochgeladen wird, um den Text zurückzuerhalten.
Dieses kostenlose Online-Tool funktioniert wie eine integrierte Spracherkennungsfunktion, nur dass es die Sprache aus einer Datei und nicht von einem Live-Mikrofon in Text umwandelt. Wenn Sie es gewohnt sind, die Ergebnisse in Google Docs einzufügen, funktioniert dies auch hier genauso, sobald die Transkription fertig ist. Auch alte Sprachaufnahmen, die mit einem Diktiergerät gemacht wurden, können problemlos transkribiert werden: Laden Sie einfach die Audiodatei hoch, unabhängig davon, womit sie aufgenommen wurde.
Für eine Tabellenkalkulation bedeutet Sprache zu Text Excel normalerweise das Einfügen des TXT-Transkripts in Zellen danach — Es gibt keinen direkten Excel-Export, nur einfachen Text, den Sie einfügen. Brauchen Sie es für E-Mail? Ein Workflow für Text-E-Mails ist derselbe: Transkribieren und kopieren Sie dann den Text in die Nachricht.
Dies gilt für Sprache zu Text für Gehörlose ebenso wie für Geschwindigkeit — Ein vollständig geschriebenes Transkript funktioniert für alle, die sich nicht auf Audio verlassen können, nicht nur für Menschen, die Zeit sparen. Die Rede-zu-Text-Engine dahinter ist unser eigenes Sprachmodell, das auf unserer eigenen GPU läuft, keine gemietete API.
Wenn es um die Frage geht, welches Tool oder welche Software die beste Spracherkennung bietet, gibt es nur eine ehrliche Antwort: Lesen Sie die Transkription selbst und beurteilen Sie das Ergebnis. Die Frage nach dem besten Spracherkennungsmodell führt zur selben Antwort. Auch bei der Suche nach der besten Spracherkennungs-App führt der Weg hierher – lesen Sie die Transkription und entscheiden Sie selbst.
Vergleiche von Spracherkennungstechnologien kommen immer wieder zu demselben Ergebnis: Die Genauigkeit hängt stärker von der Qualität der Aufnahme ab als von der Marke. Auch die Vergleichswerte für Spracherkennung bestätigen dies – und deshalb konzentriert sich unsere eigene Analyse der Genauigkeit auf die Aufnahmebedingungen und nicht auf Marketingversprechen. Wenn Sie verschiedene KI-Tools zur Spracherkennung vergleichen, ist der Vorteil dieses Tools einfach: kostenlos, keine Registrierung erforderlich, bis zu 60 Minuten pro Datei.
Wie auch immer Sie das Format einrahmen — Audio-Sprache zu Text, mp3 Sprache zu Text, oder einfach eine Aufzeichnung kostenlos transkribieren — Es ist der gleiche Upload hier. Eine Zoom-Aufzeichnung funktioniert genauso wie jede andere Datei; siehe Transkribieren eines Zoom Meetings für die Lautsprecher-Label-Version, wenn es sich um einen Anruf mit mehreren Personen handelte. Aus der eingebauten Transkription von Restream? Die gleiche Idee, ohne dass die Streaming-Plattform um sie herum gewickelt ist.
Neben dem Klartext erhalten Sie SRT und VTT, wo jede Zeile eine Start- und Endzeit trägt. Das macht es möglich, in einer zweistündigen Aufnahme direkt auf einen Moment zu springen, anstatt zu scrollen. Wenn mehrere Personen sprechen, Lautsprecheretiketten Markieren Sie, wer was gesagt hat.
Formate: MP3, WAV, M4A, FLAC, OGG, AAC und die gängigen Videodateien. Keine vorherige Konvertierung erforderlich.
Bei klarer Rede ist es fast wortperfekt. Starke akzente, leute, die übereinander reden oder ein lauter raum sind für jedes werkzeug schwieriger, also lesen sie diese einmal zurück. Wir haben eine ehrliche Aufschlüsselung von Wie genau AI Transkription wirklich ist.
Ja. 10 Aufnahmen pro Tag, keine Gebühr pro Minute, kein Wasserzeichen und kein Konto. Dateien bis zu 60 Minuten und jeweils 1,5 GB.
Etwa 100 Sprachen werden automatisch anhand der Aufnahme erkannt. Sie müssen nichts auswählen. Dies gilt für die Spracherkennung in Niederländisch oder die Transkription niederländischer Aufnahmen, genauso wie für Englisch. Deutsche Audiodateien werden ebenfalls mit derselben Spracherkennung für etwa 100 Sprachen verarbeitet. Das Gleiche gilt für spanische Audiodateien. Eine tschechische Aufnahme wird auf die gleiche Weise verarbeitet – es ist keine separate Konfiguration pro Sprache erforderlich. Bangla und Bengali funktionieren beide: eine Bangla- oder Bengali-Aufnahme wird auf die gleiche Weise transkribiert. Auch einfache englische Sprache wird erkannt, einschließlich einer kostenlosen Online-Spracherkennung für Englisch.
Ja. Reiner Text als TXT und SRT/VTT mit einer Start- und Endzeit pro Zeile.
Die Daten werden sofort nach Abschluss der Transkription gelöscht, und die Ergebnisse werden innerhalb von 45 Minuten (24 Stunden, wenn Sie ein Monatsabonnement erworben haben – dieser längere Zeitraum ist Teil der Abonnementleistung) gelöscht.
Ja – laden Sie die Audiodatei hoch und laden Sie die Wörter einige Sekunden später als TXT, SRT oder VTT herunter.
Sprache zu Text verwandelt eine Aufzeichnung in geschriebene Wörter. Text to Speech tut das Gegenteil — Es liest geschriebenen Text laut vor. ScribeGrab behandelt beides: Audio zu Text und Text zur Rede.
Ja — ScribeGrab ist kostenlose Online-Sprache zu Text ohne Konto, 10 Aufnahmen pro Tag und etwa 100 Sprachen automatisch erkannt.
ScribeGrab führt ein hochgenaues Sprach-zu-Text-Modell aus, das auf klarem Audio nahe an der menschlichen Ebene liegt, und fällt mit starkem Hintergrundrauschen, Crosstalk oder einem dicken Akzent ab. Siehe: Genauigkeitsaufschlüsselung für Zahlen nach Sprache und Audioqualität.
Ja – keine Anmeldung, kein Konto erforderlich. Laden Sie die Aufnahme oben hoch und laden Sie den Text als TXT, SRT oder VTT herunter.
Ja, es ist dasselbe, nur ein häufiger Tippfehler. Laden Sie Ihre Audio- oder Videodatei oben hoch, und ScribeGrab wandelt sie kostenlos in Text um, ohne dass ein Konto erforderlich ist.
Ja – Kantonesisch ist eine der etwa 100 Sprachen, die ScribeGrab automatisch erkennt, sodass eine kantonesische Aufnahme auf die gleiche Weise wie jede andere Sprache transkribiert wird, ohne dass eine manuelle Sprachauswahl erforderlich ist.
In den meisten Fällen können Sie Dateien nicht direkt hochladen – es handelt sich in erster Linie um Chat-Oberflächen. Diese Seite wurde speziell dafür entwickelt, dass Sie eine Audioaufnahme hochladen und kostenlos eine Transkription erhalten.
Das Diktat von Copilot lebt in den Apps von Microsoft und benötigt ein Live-Mikrofon. Diese Seite funktioniert aus einer Datei, die Sie bereits haben, kein Microsoft-Konto erforderlich.
ElevenLabs berechnet die Kosten pro Minute, sobald das kostenlose Kontingent überschritten ist; die Transkriptionsfunktion von Evernote ist in der Notiz-App und dem Konto integriert. Auf dieser Seite ist die Nutzung bis zu 60 Minuten pro Datei kostenlos, ohne Registrierung und ohne Notiz-App.
Ja — Generieren Sie hier zuerst den SRT und importieren Sie ihn dann in den Untertiteltrack von Resolve auf der Edit-Seite, wie bei jeder Standard-SRT-Datei.
Nein — Dies läuft auf unserer eigenen GPU mit unserem eigenen Sprachmodell, nicht auf einer gemieteten Cloud-API von Microsoft oder Amazon. Das ist auch der Grund, warum das freie Tier großzügig sein kann.
Buzz ist eine separate Open-Source-Desktop-App; Diese Seite ist eine kostenlose Webseite ohne Installation, die für jeden geeignet ist, der nicht zuerst ein Programm einrichten möchte.
Ja — Generieren Sie den SRT hier und importieren Sie ihn dann als Beschriftungen im Text-Panel von CapCut wie jede andere Untertiteldatei.
Zuerst die Aufnahme: Nehmen Sie die Audioaufnahme mit Ihrem Smartphone oder einer beliebigen App auf und laden Sie die Datei dann hier hoch, um den Text zu erhalten. Eine Echtzeit-Transkriptionsfunktion, bei der der Text während der Aufnahme angezeigt wird, ist nicht verfügbar.
Gerade genug, um die Datei hochzuladen — Danach wird es auf unserem Server verarbeitet, so dass eine langsame Verbindung nur die Upload-Zeit beeinflusst, nicht das Ergebnis.
Lesbare Absätze mit automatischer Interpunktion, nicht ein ununterbrochener Wortblock.
Zuerst benötigen Sie eine Audiodatei – dieses Tool funktioniert mit einer bereits vorhandenen Aufnahme, nicht mit einem Live-Mikrofon, und wandelt diese nach dem Hochladen in Text um.
In der Regel ist es genau das Gegenteil: Mit 60 Minuten und 1,5 GB pro Datei übertrifft unser Angebot die kostenlosen Nutzungslimits der meisten Wettbewerber.
Es kann ein wenig härter werden, wie jedes Sprachmodell, aber es transkribiert immer noch — Ein schnelles Korrekturlesen fängt alles Unklare.
Öffnen Sie das Tool, lassen Sie Ihre Aufnahme fallen, warten Sie ein paar Minuten und laden Sie dann den Text als TXT, SRT oder VTT herunter.
Die Anzahl der Wörter ändert nichts am Preis – das Tool ist weiterhin kostenlos. Die einzigen Einschränkungen sind die Dateigröße und die Anzahl der täglichen Aufnahmen.
Ein kontinuierliches Transkript standardmäßig — Die Organisation in separate Notizen oder Abschnitte ist danach noch ein manueller Schritt.
Ruhige oder geflüsterte Rede ist für jedes Modell schwieriger — Näher am Mikrofon und weniger Hintergrundgeräusche helfen beide.
Nein — TXT, SRT und VTT sind bei jedem Upload kostenlos, die gleichen drei Formate, für die ein kostenpflichtiges Tool berechnen würde.
Nein — Das gleiche Modell verarbeitet Interviews, Vorträge, Anrufe und Sprachmemos, ohne dass eine Einstellung für den Aufnahmetyp gewählt werden muss.
Fast — Sie nehmen das Audio immer noch zuerst auf, aber danach braucht das Hochladen und Herunterladen des Textes überhaupt keine Eingabe.
Das Grundprinzip ist dasselbe – gesprochene Wörter werden in geschriebenen Text umgewandelt –, nur dass dieses Tool mit einer bereits vorhandenen Datei und nicht mit einem Live-Mikrofon arbeitet.
Das ist genau der Use Case — Laden Sie die Aufnahme hoch und die Schreibarbeit ist bereits für Sie erledigt.
Ja, ein gemeinsames Sprachmodell läuft hinter jeder Seite auf der Website, nur mit einem anderen Wortlaut präsentiert.
Ja — hochladen, kein Konto, keine E-Mail, nur den Text ein paar Minuten später zurück.
Erst wenn der Upload beendet ist — Schließen des Tabs teilweise durch das Starten des Uploads.
Ja — Android-sprache zu text bedeutet nur, die aufnahme von ihrem android-telefon hier hochzuladen; das kostenlose transkript kommt auf die gleiche weise zurück wie von jedem anderen gerät.
Windows Speech to Text läuft hier nur im Browser-Tab — kein eingebautes Diktat von Windows — So funktioniert die gleiche Seite auch auf Mac, Linux oder einem Telefon.
Nein — Speech to Text auf Microsoft Word ist Words eigener eingebauter Diktat-Button. Diese Seite ist separat: Laden Sie eine Aufzeichnung hoch und fügen Sie das fertige Transkript anschließend in Ihr Dokument ein.
Nein – hier müssen Sie keine Chrome-Erweiterung für die Spracherkennung installieren. Öffnen Sie die Seite in einem beliebigen Browser, laden Sie die Aufnahme hoch und laden Sie die Transkription herunter.
Kein Download — Sprache zu Text für PC bedeutet hier nur, diese Seite in einem Browser auf Ihrem Computer zu öffnen, die Datei hochzuladen und das Transkript zurückzubekommen.
Wenn das Problem in der Diktierfunktion des iPhones liegt, handelt es sich um eine Einstellung, die auf dieser Seite nicht geändert werden kann. Umgehen Sie das Problem: Nehmen Sie wie gewohnt eine Sprachnotiz auf und laden Sie die Datei dann hier hoch, um eine Transkription zu erhalten.
Ja — Chromebook Speech to Text benötigt nur den Browser, der bereits eingebaut ist: Öffnen Sie die Seite, laden Sie die Aufzeichnung hoch und laden Sie das Transkript herunter, keine zusätzliche App erforderlich.
Ja — Über Sprache zu Textgeräten (Telefon, Tablet, Laptop, Chromebook) funktioniert die Seite gleich: Laden Sie eine Aufzeichnung im Browser hoch und erhalten Sie Text zurück, nichts ist pro Gerät installiert.
Dieses Tool nutzt unser eigenes Spracherkennungsmodell, das auf unserer eigenen GPU-Hardware läuft – und nicht auf einer gemeinsam genutzten API eines Drittanbieters. Die gleichen Spracherkennungsmodelle verarbeiten automatisch etwa 100 Sprachen.