‹ Zurück KI-Chat
🗣

Audio zu Text

Wandle gesprochene Sprache aus einer Audiodatei in Text um — komplett auf deinem Gerät.

🎙Zum Auswählen einer Audio- oder Videodatei tippenoder hier ablegen

    Beim ersten Einsatz dieses Tools wird einmalig ein ~110-MB-Spracherkennungsmodell heruntergeladen (größer als die ~30 MB der Video-/Audio-Umwandlungstools, da ein echtes Spracherkennungsmodell deutlich mehr Daten braucht als ein Codec). Danach wird es zwischengespeichert, und es verlässt nie dein Gerät.

    Längere Aufnahmen werden in 30-Sekunden-Abschnitten verarbeitet — größere Dateien dauern also nur länger, statt zu scheitern.

    So funktioniert's

    1. 1Wähle eine Audio- oder Videodatei.
    2. 2Wähle die gesprochene Sprache, oder lasse es bei Automatisch erkennen.
    3. 3Transkribiere und kopiere oder lade den Text herunter.

    Über dieses Tool

    Lade eine Audiodatei hoch und erhalte ein Text-Transkript der gesprochenen Sprache darin — eine Sprachnotiz, eine Besprechungsaufnahme, ein Interview. Ein Spracherkennungsmodell läuft komplett in deinem Browser, die Audiodatei verlässt also nie dein Gerät. Funktioniert in 99 Sprachen, mit automatischer Spracherkennung.

    Wird meine Audiodatei irgendwohin hochgeladen?

    Nein, das Spracherkennungsmodell läuft komplett in deinem Browser — es wird nie etwas hochgeladen.

    Welche Sprachen werden unterstützt?

    99 Sprachen, entweder automatisch erkannt oder manuell aus der Liste ausgewählt.

    Warum ist die erste Nutzung langsamer als spätere?

    Beim ersten Einsatz dieses Tools muss einmalig ein ~110-MB-Spracherkennungsmodell heruntergeladen werden. Danach wird es zwischengespeichert, sodass spätere Transkriptionen sofort starten.

    Wie lang darf die Audiodatei sein?

    Beliebig lang — längere Aufnahmen werden in 30-Sekunden-Abschnitten verarbeitet, größere Dateien dauern also nur länger, statt zu scheitern.