Generiere .srt- oder .vtt-Untertitel aus jedem Video, inklusive Zeitstempel. Die Transkription läuft auf deinem Gerät mit Whisper; die Untertiteldatei lädt direkt in Player, Editoren und YouTube-Uploads.
So funktioniert es
- Fügen Sie eine Audiodatei oder ein Video ein, und die Audiospur wird auf Ihrem Gerät entschlüsselt.
- Wählen Sie ein Modell: Fast (≈41 MB, einmal heruntergeladen) oder Accurate (≈77 MB).
- Transkribieren, den Text live erscheinen lassen und .txt, .srt oder .vtt herunterladen.
Häufige Fragen
- Wird meine Datei hochgeladen?
- Nein. Die Modelle und die gesamte Verarbeitung laufen in deinem Browser auf deinem eigenen Gerät. Du kannst das selbst überprüfen: Öffne die DevTools deines Browsers, schau dir den Netzwerk-Tab an und bearbeite eine Datei: Es gibt keine Uploads. Nach dem ersten Besuch funktionieren die meisten Tools auch vollständig offline.
- Wie genau ist das?
- Die Modelle sind OpenAIs Whisper (Tiny und Basisstufen). Bei klarer Sprache sind sie sehr gut nutzbar; Starke Akzente, Überschneiden und laute Räume zeigen Fehler auf. Die Genauigkeitsstufe ist bei schwierigem Audio deutlich besser.
- Welche Sprachen funktionieren?
- Die Modelle sind mehrsprachig, und die Transkription läuft derzeit auf Englisch. Weitere Sprachen sind geplant: Das Modell selbst unterstützt bereits 99.
- Wie lange dauert das?
- Auf einem Gerät mit unterstütztem GPU, ein paar Sekunden pro Minute Audio. Bei rein CPU-basierten Rechnern ist es langsamer, aber dennoch praktisch, etwa ein Viertel der Aufnahmelänge.