← Zurück

So funktioniert es Vocal-Remover Vocal-Isolation FAQ

Hintergrundmusik-Remover
mit KI

Entferne die Hintergrundmusik aus einer Aufnahme und behalte die Stimme sauber darunter

MP3, WAV oder FLAC · bis 20 MB und 5 Minuten · 25 Credits pro Track

So entfernst du Hintergrundmusik

  1. Lade die Aufnahme hoch. MP3, WAV oder FLAC bis 20 MB und fünf Minuten. Steckt das Audio in einem Video, exportiere die Tonspur zuerst aus deinem Schnittprogramm und leg das gesäuberte Ergebnis danach zurück auf die Timeline.
  2. Die KI trennt Musik von Stimme. Das Modell teilt die Aufnahme in zwei: alles, was es als Musik liest, auf die eine Spur, alles, was es als Stimme liest, auf die andere. Nichts wird weggefiltert oder per EQ entfernt, die Stimme bleibt also nicht dünn und hohl zurück, wie es ein Notch-Filter hinterlässt.
  3. Die Musik startet stumm. Diese Seite lädt mit dem Musikfader auf null, du hörst die Stimme also sofort allein. Hat die Entfernung etwas mitgenommen, das du behalten wolltest, zieh den Musikfader ein Stück hoch, statt ihn ganz unten zu lassen — ein leises Bett klingt oft besser als eine harte Entfernung.
  4. Sichere die saubere Stimme. WAV, wenn es zurück in einen Video- oder Podcast-Schnitt geht, MP3 für alles Leichtere.

Wenn die Musik weg muss

Häufige Fragen

Funktioniert es bei Sprache, oder nur bei Gesang?
Es ist ein Modell zur Musiktrennung, also auf gesungene Stimme trainiert — und es kommt mit Sprache gut zurecht, weil eine Sprechstimme im selben Bereich liegt und dieselbe harmonische Form hat. Schwer tut es sich im umgekehrten Fall: sehr leise sehr leise Sprache unter sehr lauter — und mit Musik ganz ohne melodischen Inhalt, etwa einem reinen Drum-Loop, von dem das Modell die Stimme kaum trennen kann.
Ist das dasselbe wie Rauschentfernung?
Nein, und das falsche Werkzeug macht es schlimmer. Rauschentfernung zielt auf gleichmäßige, tonal flache Geräusche — Rauschen, Brummen, Klimaanlage, Verkehr. Musik im Hintergrund ist nichts davon: Sie hat Tonhöhe, Struktur und ändert sich ständig, ein Rauschentferner ignoriert sie also entweder oder zerlegt beim Versuch die Stimme. Musik braucht Trennung, keine Reduktion.
Bleibt etwas von der Musik übrig?
Manchmal eine Spur, und man kann vorhersagen wo: in den Momenten, in denen die Musik im Verhältnis zur Stimme am lautesten ist, und bei jedem Instrument, das die Stimme eng überlagert — einem Lead-Synth oder einer Streicherlinie im selben Register. Es ist kein Filter mit einem Schwellwert, den man härter fahren kann; kommt ein Abschnitt mit zu viel Rest zurück, war dieser Abschnitt wirklich schwer zu trennen.
Kann ich stattdessen die Musik behalten und die Stimme entfernen?
Ja — das ist dieselbe Trennung mit dem anderen Fader unten, und sie hat eine eigene Seite: der Karaoke-Maker exportiert die Musik allein. Oder nimm den Vocal-Remover und lässt dich beide Fader selbst setzen.
Brauche ich ein Konto?
Du musst angemeldet sein, weil die Trennung auf einem Server läuft und nicht in deinem Browser, und weil sie 25 Credits pro Track kostet. Nichts, was du hochlädst, wird veröffentlicht; die Ergebnisse landen in deiner privaten Bibliothek.

Eine Trennung, sechs Einstiege

Das ist überall dieselbe KI-Trennung, nur mit den Fadern an anderer Stelle. Egal, wo du startest: Die Trennung läuft einmal, und du bekommst beide Spuren.