So konvertierst du ein Video in MP3 ohne Upload

Du kannst ein Video in MP3 konvertieren, ohne es hochzuladen, indem du den Encoder im Browser-Tab laufen lässt: Die Datei wird von deiner Festplatte in den Seitenspeicher gelesen, die Audiospur wird dort extrahiert, und das Ergebnis wird als Download zurückgegeben. Nichts wird an einen Server übertragen.

Das Tool nimmt MP4-, WebM-, MOV-, MKV- und AVI-Eingabe und schreibt MP3, M4A oder WAV. Bei MP3 und M4A kannst du 128, 192 oder 320 kbps wählen, mit 192 kbps als Standard; WAV ist unkomprimiertes 16-bit PCM und ignoriert die Bitraten-Einstellung, was es rund zehnmal größer macht als dasselbe Audio als MP3. Der Videostream wird vollständig verworfen, ein 200-MB-Clip wird also typischerweise zu ein paar Megabyte Audio. Der erste Durchlauf lädt die FFmpeg-Engine, etwa 30 MB Code, und danach funktioniert das Tool offline.

Upload-basierte Konverter sind überall, und sie alle verlangen dasselbe, bevor sie helfen: die Datei selbst. Bei einem heruntergeladenen Musikvideo ist das eine milde Belästigung. Bei einer aufgezeichneten Besprechung, einer Vorlesung mit den Namen der Teilnehmer auf dem Bildschirm oder einem Interview über etwas Vertrauliches ist es ein schlechter Tausch, die ganze Datei auszuhändigen, nur um das Audio zu behalten. Diese Anleitung behandelt, was eine lokale Extraktion tatsächlich macht, welche Einstellungen das Ergebnis verändern und wo das Tool endet.

Video zu MP3

Ziehe einen Clip hinein, wähle MP3, M4A oder WAV, stelle die Bitrate ein und lade das Audio herunter. Der Encoder läuft in der Seite, das Video wird also nie hochgeladen.

Konverter öffnen

Warum der Upload-Schritt der Teil ist, den es zu entfernen lohnt

Die Konvertierung selbst ist nicht das Risiko. Eine Audiospur ist eine kleine, harmlose Sache. Das Risiko ist, dass die Datei, die du aushändigen müsstest, auch alles andere enthält, was auf dem Bildschirm war: einen Kundennamen in einer Anrufaufnahme, eine als intern markierte Folie, ein Whiteboard-Foto eines Plans. Audio lokal zu extrahieren bedeutet, dass der zusätzliche Inhalt nie reist, weil die Extraktion geschieht, bevor irgendetwas gesendet werden könnte.

Der praktische Unterschied zwischen den beiden Ansätzen ist nicht Geschwindigkeit oder Qualität. Er ist, ob du jeden Ort benennen kannst, an dem deine Datei danach existiert.

AihangsoftUpload-basierter Konverter
Wohin das Video gehtBleibt im Browser-TabAn deren Server gesendet
Größen- und TageslimitsKeine außer deinem eigenen SpeicherOft begrenzt, manchmal mit Wasserzeichen
Funktioniert offlineJa, nach dem ersten LadenNein
KontoNicht nötigManchmal ab einer bestimmten Größe erforderlich
Was du überprüfen kannstDas Netzwerk-Panel bleibt ruhigNichts zu Aufbewahrung oder Löschung

Was hineingeht und was herauskommt

Die Eingabe ist jede Datei, die der Browser als Video erkennt, und das Tool nennt die fünf gängigen Container vorab, damit du weißt, was erwartet wird: MP4, WebM, MOV, MKV und AVI. Die Ausgabe ist bewusst schmal, weil drei gut verstandene Formate fast jeden Fall abdecken.

AusgabeCodecBitraten-SteuerungAm besten für
MP3libmp3lame128, 192 oder 320 kbpsWiedergabe überall, Sprachnotizen, Podcasts
M4AAAC in einem MP4-Container128, 192 oder 320 kbpsKleinere Dateien bei gleicher Qualität
WAV16-bit PCMNicht zutreffendBearbeiten, Mischen, späteres Neu-Codieren

Die Wahl von WAV blendet die Bitraten-Steuerung aus, weil unkomprimiertes Audio keine Bitrate zum Einstellen hat. Das Tool sagt das im Panel, statt dich rätseln zu lassen, warum die Option verschwunden ist. Alles andere an der Ausgabe ist fest: Das Audio wird in einem Durchgang neu codiert, der Videostream wird verworfen statt verborgen, und keine Metadaten aus dem Container werden übernommen.

So extrahierst du Audio aus einem Video ohne Upload

  1. Video hinzufügen. Ziehe eine MP4-, WebM-, MOV-, MKV- oder AVI-Datei in die Ablagefläche oder klicke zum Durchsuchen. Der Clip wird auf deinem Gerät gelesen, und das Tool zeigt seine Größe und Dauer an, sobald die Metadaten geladen sind.
  2. Format und Bitrate wählen. MP3 mit 192 kbps ist der Standard und eine sichere Wahl. Wechsle zu WAV, wenn das Audio bearbeitet wird, oder senke auf 128 kbps für Sprache, die du nur hören musst.
  3. Extrahieren und herunterladen. Drücke Audio extrahieren, beobachte die Fortschrittsleiste, höre die Vorschau im Ergebnis-Panel an und lade dann herunter. Das Panel zeigt die Quellgröße, die Quelldauer, die Audiodauer und die Ausgabegröße, der Tausch ist also messbar.

Das Ergebnis-Panel behält das Quellvideo nur für die Sitzung im Speicher, und die Originaldatei auf der Festplatte wird nie verändert. Zurücksetzen leert das Panel und gibt die Ausgabe-URL frei, eine nützliche Gewohnheit, wenn du etwas extrahiert hast, von dem du lieber keine Vorschau auf dem Bildschirm lassen möchtest.

Die beiden Dauerfelder lesen

Das Panel meldet die Quelldauer und die Audiodauer getrennt. Normalerweise stimmen sie überein. Wenn die Quelle eine Datei ist, für die der Browser keine Metadaten parsen kann, können beide einen Bindestrich zeigen, und die Konvertierung läuft trotzdem weiter: Der Encoder liest den Stream selbst, statt dem Container-Header zu vertrauen. Ein Bindestrich ist eine Anzeigegrenze, kein Zeichen dafür, dass die Datei kaputt ist.

Das Ergebnis prüfen, bevor du es behältst

Die Audio-Vorschau spielt in der Seite ab, du kannst also bestätigen, dass die Extraktion die richtige Spur erfasst hat, bevor du etwas speicherst. Das ist wichtig bei MKV- und MOV-Dateien, die mehrere Audiospuren tragen: Das Tool extrahiert den Standardstream, und wenn ein Film eine englische und eine französische Spur mitbringt, bekommst du die als Standard markierte. Es gibt keinen Spurauswähler.

Welche Bitrate zu wählen ist

Die Bitrate ist der einzige Qualitätsregler, den das Tool bietet, und die drei Werte entsprechen klaren Anwendungsfällen.

BitrateUngefähr pro MinuteVerwende es für
128 kbpsEtwa 1 MBSprache, Vorlesungen, Sprachnotizen, Meeting-Aufnahmen
192 kbpsEtwa 1,4 MBDer Standard. Musik und allgemeines Zuhören
320 kbpsEtwa 2,4 MBMusik, die du archivieren oder später neu codieren willst

Diese Werte stammen aus der Arithmetik einer konstanten Bitrate: 128 Kilobit pro Sekunde sind 128 mal 60 geteilt durch 8 Kilobyte pro Minute, was nahe 1 MB liegt. Weil der Encoder MP3 mit konstanter Rate schreibt, ist die Dateigröße vorhersehbar, bevor du die Taste drückst, und das Panel bestätigt sie danach. Zum Vergleich: PCM in CD-Qualität mit 44,1 kHz in Stereo läuft auf etwa 10 MB pro Minute, weshalb dasselbe Audio als WAV rund zehnmal so groß ist.

Was dieses Tool nicht macht

Das sind die echten Grenzen einer browserbasierten Extraktion, und sie zu kennen erspart einen verschwendeten Versuch.

  • Es kann das Audio nicht schneiden. Es gibt in diesem Tool keinen Start- und Ende-Zuschnitt. Extrahiere die ganze Spur und schneide sie dann mit dem Audio-Zuschneider, der die Wellenform anzeigt und den Abschnitt exportiert, den du behältst.
  • Es kann keine reine Audiodatei annehmen. Die Ablagefläche nimmt Video, eine MP3 oder WAV kann also nicht als Eingabe verwendet werden. Verwende den Audio-Konverter für Formatwechsel zwischen Audiodateien, einschließlich Stapelkonvertierungen.
  • Es gibt keine Lautstärkenormalisierung. Eine leise Aufnahme bleibt leise. Der Encoder gibt den Pegel unverändert weiter.
  • Keine Bitrate über 320 kbps und kein VBR. MP3 und M4A werden mit konstanter Bitrate aus einer festen Liste von drei Werten geschrieben.
  • Nur die Standard-Audiospur. Dateien mit mehreren eingebetteten Spuren geben dir die Standardspur, ohne Auswahlmöglichkeit.
  • Beim ersten Durchlauf wird die Engine heruntergeladen. Etwa 30 MB FFmpeg-Code, danach zwischengespeichert. Das ist der Preis dafür, lokal zu codieren statt auf der Maschine eines anderen.
  • Lange Dateien sind langsam. Ein Spielfilm in voller Länge dauert eine Weile, weil die Arbeit auf deinem Gerät stattfindet und nicht auf einem Server mit mehr Kernen.

Wann das Extrahieren der ganzen Spur der falsche Schritt ist

Eine zwei Stunden lange Aufnahme, aus der du zehn Minuten brauchst, ist ein schlechter Kandidat für eine direkte Konvertierung: Du würdest die ganze Datei im Speicher halten, alles konvertieren und dann das Ergebnis schneiden. Zuerst zuschneiden ist bei jedem Schritt schneller. Der Video-Zuschneider schneidet den Clip vor der Extraktion, und der Audio-Zuschneider schneidet die extrahierte Datei danach, wenn du den nützlichen Abschnitt erst spät entdeckt hast.

Dieselbe Logik gilt für einen Clip, der überwiegend Stille ist oder einen einzigen Sprecher, von dem du eine einzige Antwort brauchst. Extrahieren, dann zuschneiden, dann nur behalten, was seinen Platz verdient. Es lohnt sich auch zu prüfen, ob das Video danach überhaupt existieren muss: Wenn das Bild der Punkt war, behalte das Video und verwende den Video-Kompressor statt die Frames wegzuwerfen.

Häufig gestellte Fragen

Ja, wenn der Encoder auf deiner Maschine läuft. Dieses Tool ist FFmpeg, kompiliert zu WebAssembly, wie jedes andere Skript in die Seite geladen, und die Konvertierung geschieht im Tab. Dein Video wird von der Festplatte in den Speicher gelesen und nie irgendwohin gesendet. Du musst das nicht auf Vertrauen annehmen. Öffne die Entwicklertools des Browsers, wechsle zum Netzwerk-Panel und drücke Audio extrahieren: Die Anfragen, die du siehst, sind der Engine-Download und sonst nichts, und keine Anfrage trägt das Video. Das Einzige, was über das Netzwerk reist, sind beim ersten Durchlauf etwa 30 MB Engine-Code, der danach zwischengespeichert wird, sodass das Tool offline weiterarbeitet. Vergleiche das mit einem serverbasierten Konverter, bei dem der Upload das Produkt ist: Dein Clip liegt auf der Festplatte eines anderen, und die Aufbewahrungsrichtlinie entscheidet, wie lange er dort bleibt. Dieser Unterschied ist der Grund, die Konvertierung lokal laufen zu lassen, und er kostet nichts extra, weil das Ergebnis auf beide Arten dasselbe Audio ist.
Die Eingabe umfasst MP4, WebM, MOV, MKV und AVI sowie alles andere, was der Browser als Videodatei erkennt. Die Ausgabe ist MP3, M4A oder WAV. MP3 ist die sicherste Wahl für die Wiedergabe, M4A liefert dir AAC-Audio in einer kleineren Datei, und WAV ist unkomprimiert. Das Audio wird neu codiert statt kopiert, selbst wenn die Quelle bereits eine MP3-Spur enthält, die Ausgabe bleibt also vorhersehbar. MP3 wird mit libmp3lame mit konstanter Bitrate codiert, M4A mit AAC und WAV als 16-bit signed PCM, das Format, das Editoren erwarten. Was ankommt, ist eine einzelne Audiospur ohne das Bild: Der Videostream wird beim Codieren verworfen, nicht verborgen, es wird also nichts von den Frames in der Ausgabe gespeichert. Eine Konsequenz, mit der man rechnen sollte, ist, dass ein Container, den der Browser gar nicht dekodieren kann, scheitert, statt eine kaputte Datei zu erzeugen. Sehr neue oder ungewöhnliche Codecs und Dateien, die einen Videotyp melden, aber tatsächlich Audio enthalten, sind die üblichen Fehlerfälle.
Deutlich kleiner, weil das Bild den Platz belegt. Ein 200 MB großes Video mit normalem Soundtrack wird zu ein paar Megabyte MP3, und der genaue Wert hängt von der Länge des Clips und der gewählten Bitrate ab. Die Audiobitrate ist eine Rate, keine Gesamtmenge, du kannst die Ausgabe also vorab schätzen: 128 kbps sind etwa 1 MB pro Minute, 192 kbps sind etwa 1,4 MB pro Minute und 320 kbps sind etwa 2,4 MB pro Minute. Eine zehn Minuten lange Vorlesung bei 128 kbps landet daher nahe 10 MB, und dieselbe Vorlesung bei 320 kbps nahe 24 MB. WAV ignoriert die Bitraten-Einstellung und speichert jeden Sample, was eine Stereo-Datei mit 44,1 kHz auf etwa 10 MB pro Minute bringt, rund das Zehnfache des MP3-Werts. Das Ergebnis-Panel meldet die Quellgröße, die Quelldauer, die Audiodauer und die Ausgabegröße, du kannst die echten Zahlen also prüfen, statt einer Schätzung zu vertrauen.
Es läuft in mobilen Browsern, aber ein Handy ist nicht der bequeme Ort dafür. Die Engine ist etwa 30 MB groß und die Codierung konkurriert mit dem Rest des Systems um Speicher, kurze Clips funktionieren also und lange können stocken. Auf dem Handy muss nichts installiert werden, und die Dateiauswahl erreicht deine Kamerarolle und deinen Download-Ordner. Was sich ändert, ist die praktische Obergrenze: Eine zwei Stunden lange Aufnahme aus einer Handykamera ist eine große Datei, und sie im Browser-Speicher zu halten, während ein Encoder läuft, ist die Stelle, an der mobile Browser zu kämpfen beginnen oder den Tab neu laden. Für einen fünf Minuten langen Clip ist das kein Thema. Wenn eine lange Konvertierung tatsächlich stockt, besteht die Lösung darin, zuerst mit dem Audio-Zuschneider oder dem Video-Zuschneider zuzuschneiden, nur den benötigten Abschnitt zu extrahieren und diesen dann zu konvertieren. Safari unter iOS funktioniert, aber seine Speichergrenzen sind die engsten unter den gängigen Browsern, halte Clips dort also kurz.
Ja, teilweise. Du steuerst das Ausgabeformat und bei MP3 und M4A die Bitrate: 128, 192 oder 320 kbps. Du kannst keine Abtastrate, kein Kanal-Layout und keine Lautstärkeänderung einstellen, und es gibt kein Zielfeld für die Dateigröße. Das Audio wird neu codiert statt kopiert, mit konstanter Bitrate, ein MP3 eines zehn Minuten langen Vortrags ist also in der Größe vorhersehbar und läuft überall. Wenn das Quell-Audio bereits komprimiert ist, wirft ein erneutes Extrahieren als MP3 ein wenig mehr Detail weg, was der Preis für eine frische, kompatible Datei ist. Die Konvertierung zu WAV vermeidet diesen zweiten Verlust ganz, weil die Dekodierung in unkomprimierte Samples kopiert wird, und sie ist die richtige Wahl, wenn das Audio später bearbeitet oder neu codiert wird. Bei Sprachaufnahmen ist 128 kbps in der Praxis nicht von der Quelle zu unterscheiden, und 320 kbps lohnt sich nur, wenn der Soundtrack Musik trägt. Das Tool meldet immer die Größen vorher und nachher, der Tausch ist also sichtbar.

Dein Video in Audio umwandeln

Kostenlos, privat und unbegrenzt. Kein Konto und kein Upload.

Video zu MP3 öffnen