So funktioniert es Vocal-Remover Musik-Remover FAQ
Vocal-Isolation
mit KI
Isoliere die Stimme in jeder Aufnahme und hör sie allein, in Originaltonart und Originalqualität
MP3, WAV oder FLAC · bis 20 MB und 5 Minuten · 25 Credits pro Track
So funktioniert die Vocal-Isolation
- Lade den Track hoch. MP3, WAV oder FLAC bis 20 MB und fünf Minuten. Nichts wird an irgendeiner Stelle transponiert oder gestreckt, was du isolierst, bleibt also in Originaltonart und Originaltempo.
- Das Modell isoliert die Stimme. Ein auf echten isolierten Stems trainiertes Netzwerk rekonstruiert das Vocal allein. Weil es rekonstruiert statt filtert, behält die isolierte Stimme ihre Höhen und ihren Körper — sie kommt nicht dünn und phasig zurück wie bei einem Versuch über den EQ.
- Hör sie allein, oder unter dem Mix. Die Seite startet mit dem isolierten Vocal allein. Den Musikfader wieder auf etwa 15–20 % zu ziehen ist zum Studieren oft die nützlichere Einstellung: Die Stimme sitzt klar obenauf, während das Arrangement als Kontext erhalten bleibt.
- Behalte es. Exportiere als WAV für eine Transkriptionssoftware oder eine DAW, als MP3 fürs Handy. Gespeichert wird genau die Balance, die auf dem Bildschirm steht.
Wofür Vocals isoliert werden
Häufige Fragen
Ist Isolieren etwas anderes als Entfernen?
Dieselbe Trennung, andere Hälfte. Das Entfernen wirft die Stimme weg und behält die Musik — das ist der Fall beim Karaoke — die Isolation behält die Stimme und wirft die Musik weg. Die Trennung läuft einmal und liefert beides, und deshalb sind diese Seite und der Remover gleich teuer und geben dir dieselben zwei Fader; sie starten nur mit anderen Einstellungen.
Ändert das Isolieren Tonhöhe oder Tonart?
Nein. Nichts wird transponiert, gestreckt oder resampelt — das isolierte Vocal liegt auf Originaltonhöhe und -tempo, sample-genau am Track ausgerichtet, aus dem es stammt. Wenn du es wirklich verschieben willst, ist das ein eigener Schritt im Tonart- und Tempo-Shifter, der das eine ändert, ohne das andere mitzuziehen.
Wie sauber ist die isolierte Stimme?
Bei den meisten kommerziellen Mixes sauber genug, um sicher abzutippen und um dazu zu singen. Zwei Dinge hinterlassen Spuren. Hall- und Delay-Fahnen gehören musikalisch zur Stimme, sitzen statistisch aber bei der Musik, ein Teil von ihnen bleibt also zurück. Und Instrumente im selben Register wie die Stimme — ein Lead-Synth, eine Legato-Streicherlinie — sind am schwersten zu trennen, weil sie sich in diesem Band wirklich ähneln.
Kann ich einen von zwei Sängern isolieren?
Nicht einzeln — das Modell isoliert Stimme als Kategorie, ein Duett kommt also mit beiden Sängern auf einer Spur zurück. Das Panorama hilft, wenn die beiden im Original hart verteilt sind, aber eine Regelung pro Sänger gibt es hier nicht, und kein Separator am Markt schafft das bisher zuverlässig.
Kann ich Sprache statt Gesang isolieren?
Ja — Sprache und Gesang liegen im selben Bereich und haben dieselbe harmonische Struktur, das Modell kann also beides. Wenn die Quelle ein Interview, ein Vlog oder ein Voiceover statt eines Songs ist, ist der Hintergrundmusik-Remover ist dasselbe Tool, nur für diese Aufgabe geschrieben.
Eine Trennung, sechs Einstiege
Das ist überall dieselbe KI-Trennung, nur mit den Fadern an anderer Stelle. Egal, wo du startest: Die Trennung läuft einmal, und du bekommst beide Spuren.