Werkzeuge von Audio Convert
Audio- und Videowerkzeuge
Wählen Sie einen klaren Ablauf zum Transkribieren, Übersetzen gesprochener Sprache oder zum privaten Extrahieren von Audio im Browser. Jedes Werkzeug sagt, was es tut, was es nicht tut und wann ein anderer Ablauf besser passt.
Audio in Text umwandeln kostenlos für kurze Aufnahmen
Audio in Text umwandeln kostenlos heißt bei Audio Convert: Sie starten mit fünf Transkriptionsminuten, sobald Ihr Konto verifiziert ist. Laden Sie unterstützte Medien hoch oder nehmen Sie im Browser auf, prüfen Sie den Entwurf, korrigieren Sie Namen oder Zahlen und exportieren Sie ihn. Längere oder wiederholte Arbeit braucht weitere Minuten, und wichtige Transkripte verlangen weiterhin eine menschliche Prüfung.
Audio-zu-Text-Konverter für Dateien
Ein Audio-zu-Text-Konverter sollte echte Dateien annehmen, erkannte Wörter sichtbar machen und Korrekturen vor dem Export zulassen. Audio Convert stellt nach der Kontoverifizierung fünf Startminuten bereit, akzeptiert gängige Audio- und Videodateien und öffnet das Transkript in einem Editor, statt es als fertigen Beleg darzustellen.
MOV in MP3 umwandeln im Browser
MOV in MP3 umwandeln extrahiert die lesbare Audiospur aus einem QuickTime-Film und kodiert sie als separate MP3. Audio Convert erledigt das in Ihrem Browser, das gewählte Video wird nicht an unseren Server gesendet. Wählen Sie eine Bitrate, wandeln Sie um, hören Sie das Ergebnis an und laden Sie es herunter.
MP4 in MP3 umwandeln auf diesem Gerät
MP4 in MP3 umwandeln entfernt die Bildspur und kodiert die erste lesbare Audiospur als MP3 in Ihrem Browser. Die gewählte MP4-Datei wird für diese Aufgabe nicht zu Audio Convert hochgeladen. Wählen Sie 128, 192 oder 320 kbps, verfolgen Sie den Fortschritt, hören Sie das Ergebnis an und speichern Sie es.
Audio-Übersetzer für aufgenommene Sprache
Ein Audio-Übersetzer macht aus aufgenommener Sprache zuerst Text und übersetzt dieses Transkript anschließend in eine Zielsprache. In Audio Convert wählen Sie beide Sprachen, prüfen das Ausgangstranskript, sehen die Kosten und erzeugen editierbaren Zieltext. Es entsteht keine Synchronstimme, und eine fachliche Prüfung bleibt erforderlich.
Video in Text umwandeln für bearbeitbare Entwürfe
Ein Video in Text umzuwandeln bedeutet, die gesprochene Tonspur einer unterstützten Datei oder öffentlichen Videoseite als durchsuchbaren Text bereitzustellen. Audio Convert legt den Entwurf in einem Prüfbereich ab. Private, anmeldepflichtige oder regional gesperrte Seiten können über einen eingefügten Link nicht verarbeitet werden; wichtige Namen sollten Sie weiterhin selbst prüfen.
Video-Transkript mit Zeitmarken erstellen
Wenn Sie ein Video-Transkript erstellen, erhalten Sie zeitmarkierten, durchsuchbaren Text aus einer öffentlichen Videoseite und können ihn vor dem Export korrigieren. Audio Convert löst unterstützte öffentliche Links auf, behält Zeitmarken im Entwurf und bietet Dokument- oder Untertiteldateien. Es tritt keinem Livestream bei; der automatisch erzeugte Text bleibt ein erster Entwurf.
YouTube-Transkript aus öffentlichen Videos
Ein YouTube-Transkript kann entweder die offizielle Untertitelspur kopieren oder die gesprochene Tonspur erkennen. Audio Convert erledigt die zweite Aufgabe für öffentliche, erreichbare Videos: Es baut einen zeitmarkierten Entwurf, den Sie durchsuchen und exportieren können. Private, kostenpflichtige, altersbeschränkte oder nur mit Anmeldung erreichbare Videos lassen sich über einen eingefügten Link in der Regel nicht auflösen.
TikTok transkribieren für Zitate und Prüfung
Wenn Sie TikTok transkribieren, erfasst Audio Convert die erkannte Sprache eines öffentlichen Beitrags – nicht jeden Sticker und nicht den Ursprung jedes wiederverwendeten Sounds. Aus einer erreichbaren TikTok-URL entsteht zeitmarkierter Text, in dem Sie eine Aussage suchen und anschließend erneut abspielen können. Bei Duetten, Stitches und öffentlichen Sounds ist die sichtbare Person nicht zwangsläufig die sprechende Person.
Instagram transkribieren für Reels mit Sprache
Wenn Sie Instagram transkribieren, wird die erkannte Sprache eines öffentlichen Reels oder Videobeitrags zu zeitmarkiertem Text. Audio Convert erfasst nicht jede eingeblendete Beschriftung und öffnet weder private Profile noch Close-Friends-Inhalte oder abgelaufene Stories. Vergleichen Sie den Entwurf mit dem Text im Bild, bevor Sie eine der beiden Ebenen als vollständig behandeln.
Öffentliches Facebook-Video transkribieren
Wenn Sie ein Facebook-Video transkribieren, erzeugt Audio Convert zeitmarkierten Text aus einem öffentlichen Video, Reel oder einer abgeschlossenen Live-Wiederholung. Ihre Facebook-Anmeldung wird nicht verwendet, und laufende Livestreams werden nicht erfasst. Beiträge nur für Freunde, private Gruppen und interne Workplace-Aufnahmen sollten Sie über ein berechtigtes Konto herunterladen und anschließend als Datei hochladen.
Meeting-Transkript aus einer fertigen Aufnahme
Ein Meeting-Transkript verwandelt eine fertige Aufnahme in zeitmarkierten Text mit optionalen Sprecherkennzeichnungen. Audio Convert akzeptiert einen öffentlichen Zoom- oder Google-Drive-Aufnahme-Link oder eine hochgeladene Datei. Es tritt keinem laufenden Meeting bei; private Aufnahmen müssen Sie zuerst über ein berechtigtes Konto herunterladen.
MP3 in Text umwandeln
MP3-Dateien. Lade eine eigene Aufnahme hoch, wähle die gesprochene Sprache und prüfe den Entwurf beim Anhören. Korrigiere Namen und Zahlen, bevor du die überarbeitete Fassung herunterlädst. Die Seite prüft MPEG-Audioframes und Dauer einer lokalen MP3 vor dem Start. MP3 mit konstanter oder variabler Bitrate ist möglich; leere Dateien und umbenannte Fremdformate werden abgewiesen. Eine erneute Kodierung stellt verlorene Sprachdetails nicht wieder her.
M4A in Text umwandeln
M4A-Aufnahmen mit AAC oder ALAC. Lade eine eigene Aufnahme hoch, wähle die gesprochene Sprache und prüfe den Entwurf beim Anhören. Korrigiere Namen und Zahlen, bevor du die überarbeitete Fassung herunterlädst. M4A ist der Container; AAC und ALAC sind Audiocodecs. AAC wird direkt hochgeladen. Für ALAC erstellt der Browser eine MP3-Kopie zur Transkription, ohne das Original zu überschreiben. Verschlüsselte, beschädigte oder nicht unterstützte Audiospuren werden abgewiesen.
WAV in Text umwandeln
WAV-Aufnahmen. Lade eine eigene Aufnahme hoch, wähle die gesprochene Sprache und prüfe den Entwurf beim Anhören. Korrigiere Namen und Zahlen, bevor du die überarbeitete Fassung herunterlädst. Unterstützt werden WAV-Dateien mit 16-Bit-Integer-PCM, 44,1 oder 48 kHz und einem oder zwei Kanälen. Der WAV-Header wird geprüft; die Endung allein genügt nicht. Stereo bedeutet zwei Audiokanäle, nicht automatisch zwei Sprecher.
OGG in Text umwandeln
OGG-Aufnahmen mit Vorbis oder Opus. Lade eine eigene Aufnahme hoch, wähle die gesprochene Sprache und prüfe den Entwurf beim Anhören. Korrigiere Namen und Zahlen, bevor du die überarbeitete Fassung herunterlädst. Eine lokale .ogg-, .oga- oder .opus-Datei kann Vorbis oder Opus enthalten. Die Seite prüft den tatsächlichen Header und die Dauer. Ein umbenanntes MP3, beschädigte Ogg-Daten und andere Codecs werden abgewiesen. Gültige Dateien benötigen keine vorherige MP3-Konvertierung.
SRT-Untertitel erstellen
Audioaufnahmen für zeitcodierte Untertitel. Erstelle SRT-Untertitel aus einer eigenen Audioaufnahme. Wähle die Sprache, prüfe Text und Zeitmarken und lade die Untertitel herunter. Bereits vorhandene VTT-Dateien kannst du im VTT-zu-SRT-Werkzeug umwandeln. Die Aufnahme wird in die Cloud übertragen und als zeitcodierter Entwurf zurückgegeben. Jede nummerierte Zeile besitzt eigenen Text sowie Start und Ende. Korrigiere Millisekunden im Format HH:MM:SS,mmm und speichere gültige Zeilen vor dem Download als SRT oder VTT.
VTT in SRT umwandeln
WebVTT-Untertitel. Wandle vorhandene WebVTT-Untertitel lokal in SRT um. Wähle eine VTT-Datei oder füge Text ein, prüfe die Zeitmarken und lade die SRT-Datei herunter. Es wird keine neue Transkription erstellt. Gültige Start- und Endzeiten sowie lesbarer Text werden in fortlaufend nummerierte SRT-Blöcke übertragen. Millisekunden erhalten ein Komma. WebVTT-Kennungen werden ersetzt; NOTE-, STYLE- und REGION-Blöcke, Positionierung und Stimmenauszeichnungen werden mit Warnungen entfernt.
Audio komprimieren
MP3, PCM-WAV oder AAC-M4A. Verkleinere eine MP3-, PCM-WAV- oder AAC-M4A-Datei direkt im Browser. Wähle 64, 96 oder 128 kbit/s und Mono oder Stereo. Höre das Ergebnis an und lade die MP3 herunter. Die Größenschätzung basiert auf Dauer und Bitrate; nach dem Kodieren werden tatsächliche Ein- und Ausgabegrößen verglichen. 64 kbit/s kann für Sprache genügen, 96 oder 128 kbit/s bietet mehr Spielraum für Details. Höre denselben Abschnitt vor dem Download an.
Chinesische Aufnahmen transkribieren
Mandarin-Aufnahmen. Lade eine eigene Aufnahme hoch, wähle die gesprochene Sprache und prüfe den Entwurf beim Anhören. Korrigiere Namen und Zahlen, bevor du die überarbeitete Fassung herunterlädst. Wähle eine Mandarin-Aufnahme als MP3 oder WAV. Chinesisch ist als Quellsprache vorausgewählt; die Sprache der Website ändert diese Einstellung nicht. Das Ergebnis ist chinesischer Originaltext, keine Pinyin-Umschrift oder Übersetzung.
Podcasts transkribieren
Podcast-Episoden als Audiodatei. Lade eine eigene Aufnahme hoch, wähle die gesprochene Sprache und prüfe den Entwurf beim Anhören. Korrigiere Namen und Zahlen, bevor du die überarbeitete Fassung herunterlädst. Wähle eine einzelne lokale MP3-, AAC-M4A- oder WAV-Episode. WAV benötigt 16-Bit-PCM mit 44,1 oder 48 kHz, mono oder stereo. Feeds und Plattformlinks werden nicht importiert. Sprache und Sprecheroption werden mit dem Auftrag gespeichert.
Interviews transkribieren
Interviewaufnahmen. Lade eine eigene Aufnahme hoch, wähle die gesprochene Sprache und prüfe den Entwurf beim Anhören. Korrigiere Namen und Zahlen, bevor du die überarbeitete Fassung herunterlädst. Suche eine Formulierung, springe zur Zeitmarke und höre auch die angrenzenden Antworten an, bevor du sie zitierst. Korrigiere Namen, Daten und Zuschreibungen. Im Beispiel muss „Nortstar Notes“ zu „Northstar Notes“ berichtigt werden.
Arbeitsbereich für Sprache zu Text
Öffnen Sie den vollständigen Arbeitsbereich für Transkription, Prüfung, Sprecherkennzeichnung, KI und Export für unterstützte Audio- und Videoquellen.
