Du kannst Audiodateien online zusammenfügen, indem du zwei oder mehr Tracks in einen Browser-Tab lädst, die gewünschte Reihenfolge festlegst und sie als eine MP3-, WAV-, M4A- oder OGG-Datei exportierst. Die Verbindung läuft mit zu WebAssembly kompiliertem FFmpeg, das Audio wird also nie hochgeladen, kein Konto ist nötig und es gibt kein Wasserzeichen.
Zwei Details sind vor dem Start wissenswert. Das Zusammenfügen verbindet Tracks Ende an Ende, was dasselbe ist wie Aneinanderhängen und nicht das Übereinanderlegen, und jede Eingabe wird zuerst auf eine Abtastrate und auf Stereo resampelt, gemischte Quellen werden also nicht Byte für Byte zusammengesetzt. Ein einzelner Durchlauf akzeptiert bis zu 20 Dateien und braucht mindestens zwei. MP3, WAV, M4A, AAC, OGG, FLAC und Opus können alle hinzugefügt werden, und der erste Durchlauf lädt eine Engine von etwa 30 MB herunter.
Audioclips zusammenzufügen ist der kleinste Audioschnitt, den es gibt, und er kommt häufiger vor, als man erwartet. Ein Podcast wird in drei Sitzungen aufgenommen, ein Meeting kommt als mehrere Dateien an, ein Lernender will einen Track mit wiederholten Phrasen. Ein Desktop-Editor kann das auch, verlangt aber zusätzlich, dass du etwas installierst und eine Zeitleiste lernst, die du monatelang nicht mehr anfasst.
Audio zusammenfügen
Füge bis zu 20 Tracks hinzu, ordne sie mit den Pfeilen neu an und verbinde sie zu einer MP3-, WAV-, M4A- oder OGG-Datei. Das Audio verlässt dein Gerät nie.
Was das Zusammenfügen von Audiodateien tatsächlich macht
Ein Audio-Zusammenfügen schreibt mehrere Dateien in einer festen Reihenfolge in eine einzige. Es ist nicht dieselbe Aufgabe wie das Mischen, das Tracks übereinanderlegt, sodass eine Stimme und eine Hintergrundspur im selben Moment erklingen. Zusammenfügen, oder Verbinden, setzt einen Track nach den anderen: Das Ende der ersten Datei wird zum Anfang der zweiten.
Das Zusammenfügen auf dieser Seite führt diese Verbindung im Browser-Tab aus. Jede Datei wird auf deinem Gerät gelesen, in einen lokalen Arbeitsbereich geschrieben, mit dem concat-Filter in FFmpeg verbunden und als ein Download zurückgegeben. Deine Tracks werden nie hochgeladen, und die Zusammenfüge-Reihenfolge ist einfach die Reihenfolge der Liste. Halte die beiden Wörter bei der Suche auseinander, denn ein Zusammenfügen-Tool beantwortet "diese Clips gehören nacheinander", während ein Mischer beantwortet "diese beiden Klänge sollen zusammen gehört werden".
So fügst du Audiodateien online zusammen
Die ganze Aufgabe umfasst vier Schritte, und keiner davon erfordert ein Konto oder eine Browser-Erweiterung.
- Deine Audiodateien hinzufügen. Ziehe zwei oder mehr Tracks auf den Upload-Bereich oder klicke zum Durchsuchen. MP3, WAV, M4A, AAC, OGG, FLAC und Opus werden akzeptiert, jede Datei wird auf deinem Gerät gelesen, und ihre Länge erscheint in der Liste. Alles, was kein Audio ist, wird mit einem kurzen Hinweis abgelehnt, statt halb verarbeitet zu werden.
- Die Zusammenfüge-Reihenfolge festlegen. Die Listenreihenfolge ist die Zusammenfüge-Reihenfolge, gelesen von oben nach unten. Nutze die Pfeile nach oben und unten in jeder Zeile, um einen Track zu verschieben, und die Papierkorb-Schaltfläche, um einen zu verwerfen. Neue Dateien werden ans Ende der Liste angehängt, der erste Ablegevorgang sitzt also oben.
- Ausgabe wählen. Wähle MP3, WAV, M4A oder OGG. Wähle für die verlustbehafteten Formate 128, 192, 256 oder 320 kbps, mit 192 kbps als Standard; WAV ignoriert die Bitraten-Einstellung, weil es unkomprimierte Samples speichert. Lass die Abtastrate auf Original behalten oder stelle 44100 oder 48000 Hz ein.
- Zusammenfügen und herunterladen. Klicke auf Audio zusammenfügen. Die Ergebniskarte zeigt die Segmentzahl, die Gesamtlänge und die Größenänderung von Quelle zu Ausgabe, spielt die zusammengefügte Datei ab und bietet den Download an.
Du kannst das Ergebnis hören, bevor du es behältst. Der Player auf der Ergebniskarte spielt die fertige Datei ab, nicht die Vorschau eines Tracks, eine falsche Reihenfolge fällt also sofort auf.
Warum die zusammengefügte Datei neu codiert wird und keine Byte-für-Byte-Zusammenfügung ist
Das intuitive Bild vom Zusammenfügen zweier MP3s ist, dass die zweite Datei mit unangetasteten Bytes ans Ende der ersten geklebt wird. Das passiert hier nicht, und wenn du es verstehst, erklärt es die Qualitätsfrage.
Der concat-Filter benötigt für jede Eingabe dieselben Audioparameter, das Zusammenfügen konvertiert also jeden Track vor dem Verbinden auf eine Abtastrate und auf Stereo. Genau das hält die Übergänge sauber: Ohne ein gemeinsames Format würde eine Verbindung zwischen einem 44,1-kHz-Mono-Handy-Memo und einer 48-kHz-Stereoaufnahme an der Grenze knacken oder in der Tonhöhe springen. Der Preis ist, dass die Samples resampelt statt kopiert werden, die Ausgabe ist also nicht Bit für Bit identisch mit den Eingaben, selbst wenn du WAV exportierst.
| Ausgabe | Encoder | Bitraten-Einstellung | Am besten für |
|---|---|---|---|
| MP3 | libmp3lame | 128, 192, 256 oder 320 kbps | Überall abspielbar, kleine Dateien |
| WAV | pcm_s16le | Nicht zutreffend, PCM ist unkomprimiert | Bearbeiten, Archivieren, Weiterverarbeiten |
| M4A | AAC | 128, 192, 256 oder 320 kbps | Qualität pro Kilobyte, Apps, die AAC erwarten |
| OGG | libvorbis | 128, 192, 256 oder 320 kbps | Offene, royaltyfreie Wiedergabe |
Die Neucodierung ist der Preis für einen sauberen Übergang. Zwei Eingaben, die bereits Abtastrate, Kanallayout und Codec teilen, werden trotzdem decodiert und erneut codiert, selbst eine Zusammenfügung im selben Format ist also nicht bytegenau. Bei Sprache und Podcasts mit 192 kbps ist der hörbare Unterschied klein genug, um ihn zu ignorieren. Wo er zählt, ist eine Mastering- oder Archivierungsaufgabe, und dort ist die richtige Antwort WAV für die Arbeitskopie und eine einzige finale Codierung am Ende.
Wann das Zusammenfügen von Audiodateien die richtige Aufgabe ist
Podcasts, in Segmenten aufgenommen
Ein Gespräch in einem langen Take aufzunehmen ist riskant, deshalb stoppen viele zwischen den Themen und starten neu. Jeder Neustart hinterlässt eine separate Datei, und Veröffentlichen bedeutet, sie in der richtigen Reihenfolge zusammenzufügen. Das Zusammenfügen erledigt das in einem Durchlauf, und mit den Pfeilen kannst du die Reihenfolge vor dem Export korrigieren.
Meetings, die in mehreren Dateien aufgezeichnet wurden
Konferenztelefone, mobile Apps und Sprachrecorder teilen ein langes Meeting oft an einer Größen- oder Zeitgrenze auf, eine neunzigminütige Sitzung kommt also als zwei oder drei Dateien an. Sie zusammenzufügen erzeugt eine Archivkopie, die leichter zu speichern, zu transkribieren und zu teilen ist als ein Ordner voller Fragmente.
Sprachübungen und Shadowing
Lernende, die eine Phrase, eine Pause und dieselbe Phrase erneut aneinanderreihen, erhalten eine Schleife, die sie in Wiederholung abspielen können. Derselbe Ansatz funktioniert für Ausspracheübungen und Hörverständnismaterial für Prüfungen, das in einer festen Reihenfolge laufen muss.
Was dieses Audio-Zusammenfügen nicht kann
Lies diese Grenzen, bevor du dich festlegst, denn in einigen Fällen ist ein Desktop-Editor wirklich die bessere Antwort.
- Mindestens zwei Dateien, höchstens zwanzig Dateien pro Durchlauf. Ein Ablegen über die zwanzigste Datei hinaus wird abgeschnitten und als übersprungen gemeldet, größere Mengen laufen also in Stapeln durch.
- Das Zusammenfügen ist eine Neucodierung, es ist also nicht verlustfrei. Jede Eingabe wird vor dem concat auf eine Abtastrate und auf Stereo resampelt, was die Übergänge sauber hält, aber die Samples verändert, eine Zusammenfügung gemischter Quellen ist also nicht Bit für Bit identisch, selbst wenn die Ausgabe WAV ist.
- Beim ersten Durchlauf werden etwa 30 MB heruntergeladen. Das ist die FFmpeg-Engine, die danach zwischengespeichert wird und dann offline funktioniert. Bei einer langsamen Verbindung bleibt der erste Klick eine Weile im Ladeschritt stehen.
- Alles läuft im Browser-Speicher. Alle Eingaben werden auf einmal gehalten, weil der concat-Filter sie zusammen braucht, eine große Menge kann den Tab also überlasten und mitten im Vorgang scheitern. Führe die Zusammenfügung in dem Fall in mehreren Durchgängen aus.
- Kein Crossfade zwischen den Tracks. Tracks werden stumpf aneinandergefügt, ein Song, der auf einem Beat endet, springt also direkt in den nächsten. Es gibt kein Fade, keine Überlappung und kein Einfügen von Stille, und dies ist kein DJ-Mixing-Tool.
- Keine Lautheitsanpassung. Wenn eine Aufnahme leise und die nächste laut ist, behält das Zusammenfügen beide Pegel so bei, wie sie sind. Es gibt keine automatische Pegelanpassung und keine Lautstärke pro Track, korrigiere die Pegel also, bevor du zusammenfügst.
- Kein Zuschneiden im Zusammenfügen-Tool. Das Zusammenfügen verbindet nur. Schneide einen Track zuerst im Audio-Zuschneider und füge die gekürzte Datei dann zur Zusammenfügen-Liste hinzu.
Wo das Zusammenfügen in einen lokalen Audio-Workflow passt
Das Zusammenfügen ist meist ein Schritt in einer Kette und nicht die ganze Aufgabe. Ein üblicher Weg ist, das Audio zu extrahieren, auf Länge zu schneiden, die Teile zusammenzufügen und das Ergebnis dann in das zu konvertieren, was das Ziel erwartet.
Die Video zu MP3-Tool zieht die Tonspur lokal aus einer Videodatei heraus, was der übliche Ausgangspunkt ist, wenn das gewünschte Audio in einer Bildschirmaufnahme oder einem Clip steckt. Der Audio-Zuschneider schneidet eine Aufnahme auf den Teil herunter, der es wert ist, behalten zu werden, und der Audio-Konverter ändert anschließend den Container, wenn das Ziel ein Format will, das das Zusammenfügen nicht schreibt. Der Sprachrecorder nimmt neues Audio direkt im Browser auf, die Teile sind also bereits auf deiner Maschine, bevor sie das Zusammenfügen erreichen.
Audio-Zuschneider
Schneide eine Aufnahme auf den Teil herunter, den du behältst, und füge die gekürzte Datei dann zur Zusammenfügen-Liste hinzu. Läuft ebenfalls vollständig im Browser.
Weil jedes dieser Tools im Tab läuft, kann eine Datei die ganze Kette durchlaufen, ohne dass irgendwo ein Upload-Schritt nötig ist.
Warum das Zusammenfügen lokal wichtig ist
Das meiste Audio auf einem persönlichen Rechner ist nicht für die Öffentlichkeit bestimmt. Sprachnotizen enthalten Familiengespräche, Meeting-Aufnahmen enthalten ein Kundengespräch und Interviewbänder enthalten jemanden, der nicht zugestimmt hat, auf einem von dir gewählten Server zu liegen. Eine Reihe von Dateien in ein Zusammenfügen-Tool hochzuladen bedeutet, einer Aufbewahrungsrichtlinie zu vertrauen, die du nicht gelesen hast.
Die Zusammenfügung im Tab auszuführen nimmt die Frage aus dem Raum. Die Tracks werden aus dem lokalen Speicher gelesen, lokal decodiert und codiert, und der einzige Datenverkehr ist die Seite selbst plus der einmalige Engine-Download. Du kannst das prüfen, statt es zu glauben: Öffne die Entwicklertools, wechsle zum Netzwerk-Panel und führe eine Zusammenfügung aus.