Audio in Text umwandeln
Transkribieren Sie Interviews, Vorlesungen, Sprachnachrichten und Besprechungen. Das Sprachmodell Whisper läuft auf Ihrem Gerät, die Aufnahme verlässt es also nie, und nach einer einmaligen Einrichtung funktioniert es sogar offline.
Für immer kostenlos · Läuft auf Ihrem Gerät · 0 Bytes hochgeladen
Hat Fizzdoc geholfen? ★ Auf GitHub sternen — es ist kostenlos und hilft anderen, es zu finden.
Die Geschwindigkeit hängt von Ihrem Gerät ab; große Dateien dauern auf dem Handy länger. Langsam oder funktioniert nicht? Auf GitHub melden
So verwenden Sie Audio zu Text
- Eine Audio- oder Videodatei auswählen (MP3, M4A, WAV, OGG, MP4 oder WebM).
- Die gesprochene Sprache wählen oder auf automatische Erkennung lassen und Text oder Untertitel auswählen.
- Starten. Beim ersten Mal wird das Sprachmodell einmalig geladen; danach den Text lesen und herunterladen.
Auch praktisch für
- audio zu text kostenlos
- audio in text umwandeln online
- sprachaufnahme in text umwandeln
- interview oder vorlesung transkribieren
- transkription ohne upload
Privat by Design — und nachprüfbar
Ihre Dateien werden nie hochgeladen, weil es dafür keine Möglichkeit gibt.
- Es gibt keinen Upload-SchrittDateien werden innerhalb dieses Browser-Tabs gelesen und geschrieben. Es gibt keinen Server, der sie empfangen könnte.
- Der Browser erzwingt esDie Content Security Policy dieser Seite erlaubt nur Verbindungen zu dieser Website zurück, die außer der App selbst nichts ausliefert.
- Überzeugen Sie sich selbstÖffnen Sie die Entwicklertools, beobachten Sie den Netzwerk-Tab und starten Sie einen Vorgang: Keine Anfrage enthält Ihr Dokument.
- Open SourceJede Zeile Code ist auf GitHub einsehbar, basierend auf qpdf, pdf.js & pdf-lib.
Häufig gestellte Fragen
Werden meine Dateien irgendwohin hochgeladen?
Nein. Fizzdoc erledigt die Arbeit direkt in Ihrem Browser-Tab, mit Open-Source-Engines, die zu WebAssembly und JavaScript kompiliert sind. Ihre Datei wird von Ihrem Gerät gelesen, lokal verarbeitet, und das Ergebnis wird direkt wieder auf Ihrem Gerät gespeichert. Sie können das selbst überprüfen: Öffnen Sie die Entwicklertools Ihres Browsers, wechseln Sie zum Netzwerk-Tab und führen Sie einen Vorgang aus — keine Anfrage enthält Ihre Datei.
Wie genau ist es?
Fizzdoc nutzt Whisper tiny, eine kleine Version des offenen Sprachmodells von OpenAI, die komplett in Ihrem Browser läuft. Klare deutsche oder englische Sprache gelingt gut; Aufnahmen mit Rauschen, starken Akzenten und andere Sprachen werden ungenauer, lesen Sie den Text also durch, bevor Sie sich darauf verlassen.
Warum ist der erste Durchlauf langsamer?
Beim ersten Mal lädt Ihr Browser das Sprachmodell (etwa 58 MB) herunter und behält es, sodass spätere Durchläufe in Sekunden starten, auch offline. Lange Aufnahmen zu transkribieren dauert: Die Geschwindigkeit hängt von Ihrem Gerät ab, und ein Laptop ist viel schneller als ein Smartphone.
Ist Fizzdoc kostenlos?
Ja, und das bleibt so: keine Anmeldung, kein Wasserzeichen, kein Tageslimit und keine Premium-Stufe. Fizzdoc ist Open Source unter der Apache-2.0-Lizenz, sodass jeder seine eigene Kopie betreiben kann.
Weitere private Tools
- Audio schneidenMP3 oder M4A zuschneiden oder in Teile zerlegen. Vor dem Speichern anhören.
- Audio zusammenfügenMP3- oder M4A-Dateien in der gewünschten Reihenfolge zu einer zusammenfügen.
- MP3 zu TextEine MP3-Aufnahme in Text transkribieren.
- Video zu TextDie Sprache aus einem MP4- oder WebM-Video in Text transkribieren.
- Untertitel-GeneratorSRT- oder VTT-Untertitel aus einer Video- oder Audiodatei erstellen.
- PDF zusammenführenMehrere PDFs in der gewünschten Reihenfolge zu einem zusammenfügen.
- PDF teilenDie benötigten Seiten in ein neues PDF extrahieren.
- PDF drehenSeitlich liegende Seiten dauerhaft richtig herum drehen.