Gesang aus einem Lied entfernen

Entferne den Gesang aus einem Lied und behalte das Instrumental — kostenlos, ohne Anmeldung, ohne Upload. Das KI-Modell läuft in deinem Browser, das Lied verlässt dein Gerät nie. Ein Vier-Minuten-Song dauert etwa eine Minute.

Lied hier ablegen

MP3, WAV, FLAC, OGG, M4A — Videodateien gehen auch

Wie die Trennung funktioniert

Du legst ein Lied ab, und das Werkzeug teilt es in zwei Spuren: Instrumental und Gesang. Dahinter steckt ein neuronales Netz, das das Spektrogramm liest und für jede Frequenz in jedem Moment entscheidet, wie viel davon zu einer Stimme gehört. Es wird nichts nach Frequenz weggefiltert, wie ein Karaoke-Filter es täte — ein Gesang im selben Bereich wie die Gitarre wird von ihr getrennt, und genau dafür braucht es ein Modell statt eines Equalizers.

Das Lied bleibt auf deinem Gerät

Das Modell wird beim ersten Mal in deinen Browser geladen — 78 MB, einmal, danach bleibt es auf deinem Gerät. Das Lied selbst wird nirgendwohin geschickt. Du kannst es im Netzwerk-Tab des Browsers nachprüfen: es gibt keinen Upload. Jeder andere kostenlose Vocal Remover schickt deine Datei auf einen Server, und genau deshalb kann er dich nach Dateigröße und Anzahl pro Tag begrenzen.

Karaoke-Version oder Playback erzeugen

Das Instrumental ist die Karaoke-Fassung: die Begleitung bleibt vollständig, die Leadstimme ist weg. Das ist der übliche Ausgangspunkt, um selbst darüber zu singen, ein Instrument gegen die Originalband zu üben oder Musik unter ein Video zu legen, ohne dass eine Stimme mit der Erzählung konkurriert. Beide Spuren kommen in voller Länge und synchron zurück.

Wo es schwächelt, und warum

Eine Trennung ist keine Subtraktion, sondern eine Schätzung — und es lohnt sich zu wissen, wo die Schätzung dünn wird. Starker Hall auf der Stimme ist für das Modell zum Teil bereits Musik und bleibt anteilig im Instrumental. Backing Vocals und Gesangs-Samples verschwinden mit, weil sie Stimmen sind. Und Zischlaute liegen oberhalb des Bandes, das das Modell analysiert, also bleibt davon etwas im Instrumental. Ein dichter, lauter Master trennt sich schlechter als eine sparsame Produktion.

Lieber den Gesang behalten

Beide Spuren entstehen im selben Durchgang, die Acapella liegt also direkt neben dem Instrumental und du kannst beide herunterladen. Wenn dir die Stimme wichtiger ist als die Begleitung, ist der Vocal Separator dasselbe Werkzeug mit der Acapella an erster Stelle.

Zum Vocal Separator

In vier Spuren aufteilen

Zwei Spuren reichen für Karaoke und die meiste Remix-Arbeit. Wenn du das Schlagzeug allein brauchst oder eine Basslinie ohne den Rest der Band, nimmt der Stem Splitter ein Vier-Wege-Modell: Gesang, Drums, Bass und alles Übrige. Er lädt mehr und braucht länger — 157 MB und rund dreieinhalb Minuten für vier Minuten Musik.

Zum Stem Splitter

Danach auf die gewünschte Stelle kürzen

Ein Instrumental ist meist Mittel zum Zweck. Schick es direkt zum Audio-Schneider, um den Refrain für ein Reel herauszunehmen, oder zum Normalizer, um die Lautheit an ein Projekt anzugleichen — das Ergebnis liegt bereits im Audio-Pool, es muss nichts heruntergeladen und neu abgelegt werden.

Zum Audio-Schneider
Läuft im Browser
Kein Upload, keine Warteschlange, kein Server. Das Modell arbeitet auf deinem Rechner — etwa eine Minute für vier Minuten Musik.
Nichts wird hochgeladen
Das Lied verlässt dein Gerät nicht. Im Netzwerk-Tab des Browsers nachprüfbar: keine ausgehende Anfrage.
Kostenlos, ohne Konto
Keine Anmeldung, kein Wasserzeichen, kein Limit pro Tag. Instrumental und Gesang, beide in voller Länge.

Häufige Fragen

Ja. Kein Konto, kein Wasserzeichen, keine Begrenzung pro Lied. Das Werkzeug läuft auf deinem eigenen Gerät, es entstehen also keine Serverkosten pro Song, die jemand weitergeben müsste — genau deshalb müssen die serverbasierten Anbieter dich deckeln und dieser hier nicht.

Nein. Das KI-Modell wird in deinen Browser geladen und die Trennung passiert dort. Du kannst es nachprüfen: Netzwerk-Tab öffnen, ein Lied durchlaufen lassen — du siehst den einmaligen Modell-Download und danach nichts Ausgehendes mehr.

Etwa eine Minute für vier Minuten Musik auf einem normalen Laptop, plus einmalig 78 MB für das Modell beim ersten Besuch. Danach liegt es im Cache und es bleibt nur die Rechenzeit. Es läuft auf einem Prozessorkern und braucht keine Grafikkarte.

Gut genug für Karaoke, zum Üben und für die meiste Remix-Arbeit; nicht gut genug, um als offizielle Instrumentalversion durchzugehen. Rechne mit einer Spur Gesang in dichten Passagen, etwas Zischeln im Instrumental und Hallfahnen, die zurückbleiben.

Zehn Minuten pro Datei. Das ist weniger als die Stunde bei den anderen Werkzeugen, und der Grund ist Speicher statt Regel: die Trennung muss das ganze Lied unkomprimiert im Tab halten, plus eine Kopie je Spur — rund 125 MB pro Minute. Lieder sind drei bis sechs Minuten lang, die Grenze liegt also dort, wo das Material ist.

MP3, WAV, FLAC, OGG und M4A gehen hinein, Videodateien ebenfalls — die Tonspur wird aus einem MP4 oder WebM im Browser herausgelöst. Heraus kommt MP3, WAV, FLAC oder OGG.

Spleeter, das Trennmodell, das Deezer unter der MIT-Lizenz veröffentlicht hat, nach ONNX konvertiert und mit onnxruntime im Browser ausgeführt. Die Lizenz ist der Grund für die Wahl: die stärkeren Forschungsmodelle sind nur für wissenschaftliche Zwecke oder nicht-kommerziell freigegeben und können nicht ehrlich hinter einem kostenlosen öffentlichen Werkzeug stehen.