Du kannst den Gesang aus einem Lied auf Aihangsoft in einem Durchlauf entfernen: Lade den Track hoch, drücke Gesang trennen und lade zwei MP3-Dateien herunter, eine mit dem isolierten Gesang und eine mit dem Instrumental. Keine Installation und kein Konto sind nötig, aber ein Gast bekommt einen einzigen kostenlosen Durchlauf pro Tag, begrenzt auf 30 Sekunden Audio.
Zwei Dinge entscheiden, ob dieses Tool zu dir passt. Erstens ist es ein Cloud AI-Tool, dein Audio wird also auf unseren Server hochgeladen und an Volcengine AI MediaKit weitergeleitet, statt im Browser verarbeitet zu werden. Zweitens ist ein kostenloser Durchlauf klein und langsam: 30 Sekunden Audio kosten 5 Credits, ein kostenloses Konto bekommt 5 Credits pro Tag, und selbst ein 5-Sekunden-Clip dauert etwa 105 Sekunden, weil der Dienst etwa 100 Sekunden festen Overhead hinzufügt. Die Abschnitte unten behandeln, was du bekommst, was es kostet und die Fälle, in denen ein anderes Tool die bessere Antwort ist.
Die meisten kommen mit einer von zwei Aufgaben: eine Playback-Spur für Karaoke oder ein sauberer Gesang für einen Remix, ein Sample oder ein Transkript. Beides ist ohne Installation möglich. Was leicht zu übersehen ist, ist dass zwei Ausgaben die ganze Geschichte sind: keine zusätzlichen Spuren, keine Trennstärke zum Einstellen und keine Möglichkeit, ein ganzes drei Minuten langes Lied in das kostenlose Kontingent zu bringen.
Gesangsentferner
Teilt einen Track in ein Acapella und ein Instrumental als zwei herunterladbare MP3-Dateien. Ein Cloud AI-Tool, dein Audio wird also zur Verarbeitung hochgeladen.
Was du bekommst: zwei MP3-Spuren
Jeder erfolgreiche Durchlauf liefert genau zwei Dateien, keine kurze Vorschau und keinen Link, der mit der Seite verschwindet.
| Ausgabe | Was in der Datei ist | Wofür es genutzt wird |
|---|---|---|
| Gesang (Acapella) | Die Gesangslinie, mit weitgehend entfernten Instrumenten | Remixe, Sampling, Songtext-Prüfung, Transkription |
| Instrumental (Playback) | Drums, Bass, Gitarren, Keyboards und alles andere | Karaoke, Übung, Cover-Aufnahmen |
Jede Datei hat ihren eigenen Player und Download-Button, du kannst also eine oder beide nehmen. Die Namen stammen von deinem Upload, song.mp3 kommt also als song-vocals.mp3 und song-instrumental.mp3 zurück.
Ergebnisse sind vorübergehend: 30 Minuten für einen Gast, 2 Stunden für ein kostenloses Konto und 24 Stunden mit Pro. Speichere die Dateien, bevor du den Tab schließt, denn nach diesem Fenster gibt es keinen späteren erneuten Download und der einzige Weg zurück ist ein weiterer Durchlauf.
Dies ist ein Cloud-Tool, dein Audio wird also hochgeladen
Aihangsoft hat 28 Tools, die vollständig in deinem Browser laufen: Eine Datei wird in den Seitenspeicher gelesen, dort verarbeitet und als Download zurückgegeben, ohne dass etwas übertragen wird. Dieses ist keines davon. Die Gesangstrennung braucht ein Modell, das zu groß ist, um in einem Browser-Tab zu laufen, dein Track wird also auf unseren Server hochgeladen, an Volcengine AI MediaKit weitergeleitet und die beiden Ergebnisse werden zurückgeschrieben, damit du sie abrufen kannst.
| Die 45 Browser-Tools | Dieser Gesangsentferner | |
|---|---|---|
| Wohin dein Audio geht | Bleibt auf deinem Gerät | Auf unseren Server hochgeladen |
| Was es verarbeitet | Dein Browser, mit Canvas und WebAssembly | Volcengine AI MediaKit, ein Cloud-KI-Dienst |
| Wie lange Ergebnisse aufbewahrt werden | Überhaupt nicht gespeichert | 30 Minuten als Gast, 2 Stunden kostenlos, 24 Stunden mit Pro |
| Konto | Nie nötig | Nicht erforderlich, aber eine Anmeldung erhöht das Tageskontingent und das Längenlimit |
| Funktioniert offline | Ja, nach dem ersten Laden | Nein |
Betrachte das als Aufbewahrungsfenster und nicht als Versprechen über Logs oder Backups. Lade kein unveröffentlichtes Master, kein privates Sprachnotiz und kein vertrauliches Interview hoch und nichts, was du nicht einem Fremden per E-Mail senden würdest. Ein Lied, das du gekauft hast, eine Demo, die deine eigene Band aufgenommen hat, oder ein Clip, den du selbst aufgenommen hast, ist ein vernünftiger Tausch.
So entfernst du den Gesang aus einem Lied in drei Schritten
- Füge deinen Track hinzu. Ziehe eine Audio- oder Videodatei hinein, eine nach der anderen, bis 30 MB. Die Dauer wird zuerst im Browser gelesen, ein Clip, der länger ist als dein Tarif erlaubt, wird also markiert und die Schaltfläche deaktiviert, bevor etwas hochgeladen wird.
- Drücke Gesang trennen. Es gibt nichts zu konfigurieren, es gibt also keine falsche Einstellung zu wählen. Die Seite lädt die Datei hoch, reicht den Auftrag ein und fragt dann alle 3 Sekunden ab, während sie ausgibt, wie lange du gewartet hast.
- Lade beide Spuren herunter. Wenn der Durchlauf abgeschlossen ist, erscheinen der Gesang und das Instrumental mit ihren eigenen Playern und Download-Buttons. Speichere, was du brauchst, bevor das Aufbewahrungsfenster schließt.
Nichts hier ist destruktiv und deine Originaldatei bleibt unangetastet. Was du nicht kannst, ist es dir auf halbem Weg anders überlegen: Es gibt keine Abbrechen-Schaltfläche und keine Möglichkeit, einen laufenden Auftrag zu pausieren.
Welche Audio- und Videoformate du hochladen kannst
Der Upload akzeptiert sowohl Audio als auch Video, und Video wird beim Einlesen in Audio umgewandelt, statt dich zu bitten, den Ton zuerst selbst zu extrahieren.
| Eingabetyp | Formate | Was passiert |
|---|---|---|
| Audio | MP3, WAV, M4A, AAC, FLAC, OGG | Direkt getrennt |
| Video | MP4, MOV, AVI, MKV, WebM, M4V, MPEG | Die Audiospur wird extrahiert, dann getrennt |
Das einzige Upload-Limit sind 30 MB pro Datei, was eine normale MP3 erst bei etwa 30 Minuten erreicht, es ist also fast immer die Länge und nicht die Größe, die dich aufhält. Beide Ausgaben sind MP3, egal was hineinging.
Das 30-Sekunden-Limit und was ein Durchlauf kostet
Die Länge wird auf dem Server mit ffprobe gemessen statt vom Browser übernommen, die echte Dauer der Datei entscheidet also, ob ein Durchlauf akzeptiert wird. Nichts in der Seite kann das ändern.
| Tarif | Längster Clip in einem Durchlauf | Was ein 30-Sekunden-Clip kostet | Kontingent | Ergebnisse aufbewahrt für |
|---|---|---|---|---|
| Gast | 30 Sekunden | Dein einziger kostenloser Durchlauf des Tages | 1 Durchlauf pro Tag pro Verbindung | 30 Minuten |
| Kostenloses Konto | 30 Sekunden | 5 Credits | 5 Credits pro Tag | 2 Stunden |
| Pro | 600 Sekunden (10 Minuten) | 5 Credits | 1500 Credits pro Monat | 24 Stunden |
Die Abrechnung erfolgt in 30-Sekunden-Schritten: Die Kosten betragen 5 Credits für jede angefangene 30 Sekunden, ein 30-Sekunden-Clip kostet also 5, ein 31-Sekunden-Clip 10 und ein 10-Minuten-Track 100. Für ein kostenloses Konto bedeutet das, dass 5 Credits pro Tag genau einen 30-Sekunden-Durchlauf kaufen, ohne Möglichkeit, einen halben Durchlauf zu kaufen oder ungenutzte Sekunden auf morgen zu übertragen.
Ein faires Detail: Credits werden nur abgezogen, wenn tatsächlich ein Ergebnis erzeugt wird. Eine als zu lang abgelehnte Datei oder ein am Dienst gescheiterter Auftrag kostet dich Zeit, aber sonst nichts, und das Schließen der Seite während eines Laufs verbraucht dein Kontingent nicht.
Wenn dein Lied länger als das Limit ist
Ein drei Minuten langes Lied passt nicht in einen 30-Sekunden-Durchlauf, und keine Einstellung ändert das. Der praktikable Weg ist, das Lied zuerst zu kürzen.
- Schneide den Abschnitt zu, den du brauchst. Die Audio-Zuschneider läuft vollständig im Browser, es wird also nichts hochgeladen, während du den Track auf die 30 Sekunden eingrenzt, die du brauchst.
- Trenne diesen Abschnitt. Lade den zugeschnittenen Clip hoch und lade beide Spuren herunter, sobald der Durchlauf fertig ist.
- Wiederhole das für andere Abschnitte, wenn du sie brauchst. Jeder Durchgang ist ein separater Lauf, der weitere 5 Credits pro angefangene 30 Sekunden kostet, und die Teile in einem Editor zusammenzufügen ist deine Aufgabe, weil die Nahtstellen davon abhängen, wo du schneidest.
Warum selbst ein kurzer Clip etwa zwei Minuten dauert
Die Wartezeit ist nicht deine Verbindung. Der Dienst hat einen festen Startaufwand von etwa 100 Sekunden, bevor irgendein Audio verarbeitet wird, plus etwas mehr für das Audio selbst. In unseren eigenen Messungen ist ein 5-Sekunden-Clip in etwa 105 Sekunden fertig und ein 25-Sekunden-Clip in etwa 125 Sekunden, ein 30-Sekunden-Clip liegt also am langsamen Ende desselben Zwei-Minuten-Bereichs, statt dramatisch schlechter zu sein.
Die Seite fragt den Auftrag alle 3 Sekunden ab und zeigt die verstrichene Zeit, eine Fortschrittsleiste, die sich kaum bewegt, ist also zu erwarten und kein Zeichen dafür, dass etwas kaputt ist. Ein Neuladen beschleunigt es nicht: Ein Reload verliert die Auftragsreferenz und das Ergebnis kann nicht mehr abgeholt werden, lass den Tab also offen und lass ihn fertig werden.
Wie die KI-Trennung tatsächlich funktioniert
Der Track wird an Volcengine AI MediaKit gesendet, das ein trainiertes Quellentrennungsmodell über den Mix laufen lässt. Das Modell schätzt zwei Signale, die Teile, die wie eine menschliche Stimme klingen, und alles andere, und schreibt jedes als MP3 heraus. Weil es eine Vorhersage und kein Filter ist, funktioniert es auch bei Tracks, die nie als Instrumental veröffentlicht wurden, und bei Mono-Aufnahmen, bei denen die Mittenkanal-Auslöschung versagt.
Dieselbe Eigenschaft erklärt, warum das Ergebnis nicht chirurgisch sauber ist. Trennung ist eine Schätzung, dichte Mixes, lange Hallfahnen und verzerrter Gesang sind also die härtesten Fälle, und kleine Spuren der jeweils anderen Seite können in jeder Datei überleben. Es gibt keinen Stärkeregler zum Ausgleichen, wenn der erste Versuch also rau klingt, versuche eine sauberere Quelle, statt nach einer Einstellung zu suchen, die es nicht gibt.
Wofür die beiden Spuren verwendet werden
| Aufgabe | Benötigte Spur | Warum |
|---|---|---|
| Karaoke oder Bandprobe | Instrumental | Eine Playback-Spur, ohne nach einer offiziellen Veröffentlichung zu suchen, die es vielleicht nicht gibt |
| Remix, Mashup oder Sample | Gesang | Ein sauberes Acapella lässt sich als normale MP3 direkt in einen Editor laden |
| Songtext oder Transkription | Gesang | Hintergrundmusik ist der häufigste Grund, warum automatische Transkription schiefgeht |
Das Tool kann jedoch keine Rechte verleihen: Das Urheberrecht an der Aufnahme und der Komposition bleibt bei ihren Inhabern, was du veröffentlichen oder monetarisieren darfst, hängt also von deiner Lizenz und den Plattformregeln ab, unter denen du postest.
Was dieses Tool nicht kann
- Es lädt dein Audio hoch. Dies ist ein Cloud-Tool, die Datei verlässt also dein Gerät und wird von einem Drittanbieter-KI-Dienst verarbeitet.
- 30 Sekunden sind eine harte Obergrenze für Gäste und kostenlose Konten, auf dem Server anhand der echten Dauer durchgesetzt, ein längerer Clip wird also abgelehnt, statt für dich zugeschnitten zu werden.
- Das kostenlose Kontingent beträgt höchstens einen Durchlauf pro Tag. Ein Gast bekommt einen einzigen Durchlauf und ein kostenloses Konto 5 Credits, was genau einem 30-Sekunden-Durchlauf entspricht.
- Es ist langsam. Etwa 100 Sekunden fester Overhead plus etwas mehr pro Sekunde Audio, ein paar Minuten sind also selbst für wenige Sekunden Ton normal.
- Nur zwei Spuren. Es gibt keine Aufteilung in Drums, Bass, Klavier oder Gitarre. Multitrack-Stem-Trennung ist eine andere Klasse von Tool.
- Keine einstellbaren Parameter: keine Trennstärke, keine Auswahl der zu behaltenden Teile und keine Möglichkeit, ein schlechtes Ergebnis zu beheben, außer die Quelle zu ändern und einen weiteren Durchlauf auszugeben.
- Eine Datei pro Durchlauf, kein Stapel, ein Ordner mit Tracks muss also einzeln abgearbeitet werden.
- Keine manuelle Reparatur: kein Pinsel, um Übersprechen wegzumalen, und keine Wellenform-Bearbeitung, nur die beiden fertigen Dateien.
- Ergebnisse verfallen. 30 Minuten, 2 Stunden oder 24 Stunden je nach Tarif, ohne späteren erneuten Download.