Audio in Text transkribieren

● 100 % in deinem Browser, sodass die Aufnahme dieses Gerät nie verlässt

Loading…

Verwandle Sprache in Text und Untertitel, wobei Whisper komplett in deinem Browser läuft. Die Aufnahme verlässt Ihr Gerät nie, was für genau die Aufnahmen, die transkribiert werden müssen, am wichtigsten ist: Interviews, Meetings, Diktat, juristische und medizinische Audioaufnahmen.

So funktioniert es

  1. Fügen Sie eine Audiodatei oder ein Video ein, und die Audiospur wird auf Ihrem Gerät entschlüsselt.
  2. Wählen Sie ein Modell: Fast (≈41 MB, einmal heruntergeladen) oder Accurate (≈77 MB).
  3. Transkribieren, den Text live erscheinen lassen und .txt, .srt oder .vtt herunterladen.

Häufige Fragen

Wird meine Datei hochgeladen?
Nein. Die Modelle und die gesamte Verarbeitung laufen in deinem Browser auf deinem eigenen Gerät. Du kannst das selbst überprüfen: Öffne die DevTools deines Browsers, schau dir den Netzwerk-Tab an und bearbeite eine Datei: Es gibt keine Uploads. Nach dem ersten Besuch funktionieren die meisten Tools auch vollständig offline.
Wie genau ist das?
Die Modelle sind OpenAIs Whisper (Tiny und Basisstufen). Bei klarer Sprache sind sie sehr gut nutzbar; Starke Akzente, Überschneiden und laute Räume zeigen Fehler auf. Die Genauigkeitsstufe ist bei schwierigem Audio deutlich besser.
Welche Sprachen funktionieren?
Die Modelle sind mehrsprachig, und die Transkription läuft derzeit auf Englisch. Weitere Sprachen sind geplant: Das Modell selbst unterstützt bereits 99.
Wie lange dauert das?
Auf einem Gerät mit unterstütztem GPU, ein paar Sekunden pro Minute Audio. Bei rein CPU-basierten Rechnern ist es langsamer, aber dennoch praktisch, etwa ein Viertel der Aufnahmelänge.

Passende Tools