Beginnen Sie mit der Quelle, die Sie bereits haben
Wählen Sie eine gespeicherte Audio- oder Videodatei, nehmen Sie im Browser auf oder geben Sie eine unterstützte Medienadresse an. Jede Eingabe landet im selben Ablauf, Audio in Text umzuwandeln.
Machen Sie aus einer Aufnahme editierbaren Text, ohne den Browser zu verlassen. Audio Convert nimmt hochgeladene Medien, eine Live-Aufnahme oder eine Medien-URL entgegen und liefert eine KI-Transkription, die Sie für Notizen, Dokumente oder Untertitel prüfen.
Audio in Text
Audio-Eingabe
Audio Convert ist ein browserbasierter Arbeitsbereich für Sprache zu Text – für die komplette Transkription, nicht nur den ersten Entwurf. Sie bringen die Aufnahme mit, legen Sprache und Sprecheroptionen fest, prüfen den Text, korrigieren wichtige Stellen und wählen den Export für den nächsten Schritt. Transkribiert werden vorhandene Aufnahmen; das Produkt ist kein Diktat und keine Spracheingabe in ein Dokument.
Wählen Sie eine gespeicherte Audio- oder Videodatei, nehmen Sie im Browser auf oder geben Sie eine unterstützte Medienadresse an. Jede Eingabe landet im selben Ablauf, Audio in Text umzuwandeln.
Durchsuchen Sie das Ergebnis, korrigieren Sie Namen und Fachbegriffe, prüfen Sie Sprecherwechsel und behalten Sie die Zeitmarken, wenn sie für die Kontrolle oder Untertitel wichtig sind.
Exportieren Sie lesbaren Text für Notizen, Untertiteldateien für Video, ein Dokument zum Weiterbearbeiten oder strukturierte Daten, wenn ein anderes Werkzeug Transkriptabschnitte braucht.

Der Arbeitsbereich verbindet Eingabe, Transkription, menschliche Prüfung und Ausgabe. So lässt sich das Transkript an eine echte Aufgabe anpassen, statt die rohe Erkennung als fertiges Ergebnis zu behandeln.

OpenAI Whisper erzeugt das Arbeitstranskript. Sie bleiben dafür verantwortlich, Namen, Zahlen, leise Passagen, überlappende Stimmen und jede Formulierung in einem sensiblen Kontext gegen die Aufnahme zu prüfen.

Behalten Sie den Sprecherkontext für ein Interview, Zeitmarken für ein Zitat, Untertitelzeiten für Video oder klare Absätze, wenn aus dem Transkript Notizen oder ein Entwurf werden – etwa nach Meetings oder Vorlesungen.

Starten und prüfen Sie den Auftrag online. Wenn der Wortlaut sitzt, speichern Sie ihn als TXT, SRT, VTT, JSON, PDF oder DOCX – je nach gewähltem Plan und Ablauf.
Diese Fähigkeiten decken die Schritte zwischen dem Empfang einer Aufnahme und der Übergabe eines geprüften Transkripts ab. Die Verfügbarkeit kann vom gewählten Plan abhängen.
Nutzen Sie gängige Formate wie MP3, WAV, M4A oder MP4 als Quelle – inklusive exportierter WhatsApp-Sprachnachrichten. Die Sprachspur wird auf derselben Seite zur Eingabe für die Transkription.
Nehmen Sie eine Sprachnotiz oder eine Live-Sitzung auf, wenn noch keine Datei existiert, und senden Sie diese Aufnahme als aktuellen Transkriptionsauftrag.
Geben Sie eine Medien-URL an, wenn die Quelle bereits online liegt, und sparen Sie sich einen Extra-Download, bevor Sie Audio in Text umwandeln.
Wählen Sie die Ausgangssprache oder nutzen Sie die Erkennung, und aktivieren Sie die Sprechererkennung, wenn in Gesprächen wichtig ist, wer gesprochen hat.
Finden Sie zentrale Passagen, ersetzen Sie falsch erkannte Eigennamen, benennen Sie Sprecher um und passen Sie den Text an die Leserinnen und Leser an, bevor Sie exportieren.
Wählen Sie Klartext, Untertitel, Dokument oder JSON, damit das Transkript die Struktur behält, die der nächste Schritt in Ihrem Ablauf braucht.
Wählen Sie ein Abonnement, wenn Transkription fest zu Ihrem Ablauf gehört, oder kaufen Sie ein einmaliges Minutenpaket für gelegentliche größere Aufträge. Zu jeder Option sehen Sie Kontingent, Abrechnungszeitraum und die enthaltenen Werkzeuge.
Ein Jahreskontingent für einen gleichmäßigen, eher leichten Transkriptionsrhythmus.
Jahresplan Starter
Der angezeigte Monatsbetrag entspricht dem Jahrespreis.
Ein größeres Jahresabonnement für wiederkehrende Arbeit an Inhalten und Transkriptanalyse.
Jahresplan Pro
Der angezeigte Monatspreis ist der Jahresbetrag geteilt durch zwölf.
Das größte Jahreskontingent für häufige Transkription und KI-gestützte Prüfung.
Jahresplan Max
Die Abrechnung erfolgt jährlich; die Karte zeigt das Monatsäquivalent.
Diese Antworten helfen Ihnen bei der Wahl der Eingabe, bei den Grenzen der Prüfung, beim Unterschied zwischen Sprache zu Text und Text zu Sprache sowie bei der Planung des Exports.
Audio Convert übernimmt Sprache zu Text: von der Aufnahme über die Prüfung bis zum Export. Es nimmt hochgeladene Medien, eine Browser-Aufnahme oder eine unterstützte URL entgegen – etwa Meetings, Interviews, Vorlesungen oder exportierte WhatsApp-Sprachnachrichten – und liefert Text, den Sie vor dem Download prüfen. Transkribiert werden vorhandene Aufnahmen, kein Live-Diktat in ein Dokument.
Öffnen Sie eine Frage, um Hinweise zum Ablauf zu sehen
Wählen Sie die Quelle, die zu Ihrer Aufnahme passt, erstellen Sie den Entwurf für Sprache zu Text und prüfen Sie das Ergebnis, bevor Sie den Export für Ihre nächste Aufgabe festlegen.