Verarbeitung auf diesem Gerät
Remove Audio

AI Vocal Remover: Stimme aus einem Video entfernen und die Musik behalten

Füge ein Video oder einen Song hinzu. Die KI trennt Gesang oder Sprache von der Tonspur dahinter. Musik, Filmmusik und Soundeffekte bleiben genau, wo sie waren, und du bekommst das Video mit unverändertem Bild zurück. Auf einem Computer läuft das kostenlos in deinem Browser, auf diesem Gerät: Es wird nichts hochgeladen und du brauchst kein Konto. Für längere Dateien oder einen Browser, der das Modell nicht ausführen kann, wechsle in die Cloud: Deine ersten 10 Credits sind kostenlos. Das entspricht 10 Minuten mit diesem Tool.

Remove Audio-Maskottchen, eine freundliche Kopfhörerfigur. KI-Audiotool, das nach Möglichkeit kostenlos in deinem Browser läuft oder für längere Dateien auf unseren Servern.

Video- oder Audiodatei hier ablegen oder auf deinem Gerät auswählen

MP4, MOV, MKV, WebM, AVI, MP3, WAV, M4A und mehr

Bis zu 20 Dateien auf einmal

Datenschutz zuerst Keine Uploads Lokale Verarbeitung

Dieser Browser kann das KI-Modell nicht selbst ausführen: Er braucht WebGPU und mindestens 8 GB Arbeitsspeicher. Wechsle in die Cloud, um diese Datei zu verarbeiten.

Kostenlos auf diesem Gerät, wenn das Modell darauf laufen kann. In der Cloud bestimmst du, wie lange das Ergebnis aufbewahrt wird.

Größere Dateien? Verarbeite sie in der Cloud

Dieses Tool läuft kostenlos auf diesem Gerät. Für eine Datei über dem Gerätelimit oder eine lange Aufnahme läuft dasselbe Tool auf unseren Servern: bis zu 5 GB pro Datei und 6 Stunden Audio, schneller, und deine Dateien bleiben bis zu 7 Tage gespeichert, mit jedem Credit-Paket oder Tarif so lange, wie du möchtest. Ab 1 Credit pro Minute, mit 10 Credits kostenlos, sobald du ein Konto erstellst.

Kurz erklärt

So entfernst du die Stimme aus einem Video und behältst die Musik

Füge das Video hinzu. Die KI trennt Gesang oder Sprache von allem anderen. Auf diesem Gerät läuft das kostenlos in deinem Browser, ohne Upload. Du bekommst dasselbe Video mit intakter Tonspur und ohne Stimme zurück. Kein Schnittprogramm und keine separate Audiodatei, die du wieder importieren musst.

  1. Füge eine MP4-, MOV-, MKV- oder WebM-Datei hinzu, oder eine MP3- oder WAV-Datei.
  2. Die KI trennt die Stimme von Musik und Soundeffekten.
  3. Lade das Video mit der erhaltenen Musik herunter.

Warum dieses Tool statt eines Videoschnittprogramms verwenden?

Schnittprogramme können eine Spur leiser machen oder einen Abschnitt herausschneiden, aber keine einzelne Stimme aus einer bereits gemischten Tonspur lösen. Dieses Tool trennt die Bestandteile, damit du alles Gewünschte behältst und nur die Stimme entfernst.

Video rein, Video raus

Die meisten Stimmenentferner liefern dir eine separate Audiospur. Das Video musst du selbst wieder zusammensetzen. Hier fügst du ein Video hinzu und bekommst ein Video mit unverändertem Bild zurück.

Funktioniert mit fertig gemischtem Audio

Du brauchst weder die ursprünglichen Einzelspuren noch eine Projektdatei. Füge einen Clip hinzu, in dem Stimme und Musik bereits zusammengemischt sind. Das Tool trennt sie.

Behält die Soundeffekte bei

Es entfernt gezielt die Stimme, nicht alle Töne außer der Musik. Schritte, Motoren, Menschenmengen und Filmmusik bleiben an ihrem Platz.

Keine Schnittkenntnisse nötig

Du musst nichts auf einer Zeitleiste ausrichten. Datei hinzufügen, warten, herunterladen. Ein paar Klicks und wenige Minuten genügen, statt eines ganzen Abends.

Verarbeitet auch lange Aufnahmen

Eine komplette Gaming-Session oder eine Vorlesungsaufnahme funktioniert genauso wie ein 30-Sekunden-Clip: Bis zu 15 Minuten laufen in deinem Browser, alles Längere kannst du mit einem Konto in der Cloud verarbeiten. Du bist nicht auf eine kurze Vorschau beschränkt.

Kostenlos in deinem Browser

Auf diesem Gerät läuft das KI-Modell auf deinem eigenen Computer und kostet deshalb nichts: kein Konto, kein Upload, keine Credits, beliebig viele Dateien. Für lange Dateien gibt es die Cloud: Jedes neue Konto startet mit 10 Credits kostenlos. Das entspricht 10 Minuten mit diesem Tool. Keine Kreditkarte nötig.

So funktioniert’s, Schritt für Schritt

In vier Schritten vom Clip mit Sprache zum Clip mit nur Musik.

  1. 01

    Datei hinzufügen

    Ziehe eine Video- oder Audiodatei in das Feld oben oder klicke, um eine Datei auszuwählen. MP4, MOV, MKV und WebM werden unterstützt, ebenso MP3, WAV und M4A.

  2. 02

    „Dieses Gerät“ oder Cloud wählen

    Auf diesem Gerät läuft die KI in deinem Browser: kostenlos, ohne Konto, ohne Upload, in einem Browser mit WebGPU und mindestens 8 GB Arbeitsspeicher, für bis zu 15 Minuten Audio pro Datei. In der Cloud läuft sie für längere Dateien auf unseren Servern: Melde dich an, deine ersten 10 Credits sind kostenlos.

  3. 03

    Lass das Modell die Audiospur trennen

    Es analysiert die gesamte Tonspur und trennt Gesang und Sprache von Musik, Soundeffekten und Raumgeräuschen.

  4. 04

    Ergebnis herunterladen

    Lade nach der Verarbeitung das Video mit erhaltener Musik und entfernter Stimme herunter. Im Modus „Dieses Gerät“ hat deine Datei dein Gerät nie verlassen. In der Cloud werden die Dateien nach der Aufbewahrungsdauer gelöscht, die du gewählt hast.

Wofür das Tool genutzt wird

Dieses Tool entfernt Gesang und gesprochene Stimmen aus einer Tonspur und behält die Musik und den restlichen Soundtrack bei. Hier sind einige typische Anwendungen.

Kommentar entfernen

Nimm einen Gameplay-Clip oder ein Reaction-Video und entferne die Sprache, während die Hintergrundmusik weiterläuft. Du erhältst die Musik ohne die darüberliegende Stimme, bereit für einen neuen Schnitt als Reel oder Short im Format 9:16.

Eine Karaoke-Version erstellen

Füge einen Song hinzu und entferne die Hauptstimme, sodass die Instrumentalbegleitung übrig bleibt. Du bekommst einen Backingtrack zum Mitsingen, mit unveränderten Drums, Bass und Melodie.

Sprechertext aus einem Clip entfernen

Du hast ein Tutorial oder Reisevideo, in dem eine Stimme über der Musik liegt. Entferne den Sprechertext und behalte die übrige Tonspur. So bleibt die Stimmung des Clips erhalten, ohne dass jemand spricht.

Eine saubere Grundlage für einen Remix

Entferne den Gesang und erhalte eine saubere Instrumentalspur zum Weiterarbeiten. Exportiere sie und füge die Musik in deine DAW oder deinen Schnitt ein, ohne dass eine Stimme aus der Mischung heraussticht.

Die Filmmusik behalten

Entferne die Dialoge aus einem Film- oder Trailerausschnitt und behalte die Filmmusik. Streicher und musikalische Steigerungen bleiben erhalten, während die gesprochenen Sätze verschwinden. Praktisch, wenn du für ein Projekt nur die Musik brauchst.

Instrumentalmusik für Videos

Verwandle einen Song mit Gesang in eine saubere Instrumentalspur für einen Instagram-Beitrag im Format 1:1 oder einen Clip, in dem du in die Kamera sprichst. Die Musik läuft im Hintergrund ohne zusätzliche Worte. So bleiben deine eigene Stimme oder Untertitel klar verständlich.

Was gut funktioniert und wo die Grenzen liegen

Funktioniert gut beiSchwierig bei
Kommentaren oder Sprechertext über HintergrundmusikGeflüsterter oder sehr leiser Sprache, die in einer lauten Mischung untergeht
Einer klaren Hauptstimme über InstrumentalmusikStark bearbeiteten oder mit einem Vocoder verfremdeten Stimmen, die wie ein Instrument klingen
Dialogen über FilmmusikAufnahmen, in denen Stimme und Musik dieselben Frequenzen belegen
Reaction- und Gameplay-ClipsAudio mit sehr niedriger Bitrate, das bereits stark durch Kompression beeinträchtigt ist
Im Vergleich

Der Vergleich mit anderen Methoden

MethodeDas tatsächliche Ergebnis
Den Clip stummschaltenStille. Auch die Musik verschwindet, was meist nicht das gewünschte Ergebnis ist.
Eine Karaoke-Website oder ein StimmenentfernerMeist eine separate MP3-Spur. Du musst sie anschließend in einem Schnittprogramm wieder mit dem Video zusammenfügen.
Der Trick mit der Phasenumkehr in AudacityFunktioniert nur bei manchen Stereomischungen und lässt die Musik dünner klingen. Bei den meisten modernen Mischungen klappt es nicht.
Premiere, DaVinci oder CapCutDu kannst die ganze Spur absenken oder schneiden. Auf der Zeitleiste lässt sich jedoch keine einzelne Stimme aus einer fertigen Mischung lösen.
Dieses ToolDasselbe Video zurück, mit unverändertem Bild, ohne Stimme und mit erhaltener Tonspur.

Ehrlich gesagt: Wenn Stimme und Musik in deinem Projekt noch auf getrennten Spuren liegen, ist ein Schnittprogramm die bessere Wahl. Dieses Tool ist für fertige Dateien gedacht, in denen beides bereits zusammengemischt ist.

Du wolltest das Gegenteil? Der Music Remover behält deine Sprache und entfernt die Musik, und der AI Voice Isolator macht dasselbe mit jeder Aufnahme.

Wenn etwas nicht richtig klingt

Häufig gestellte Fragen

Ja, in deinem Browser. Wähle „Dieses Gerät“, dann läuft das KI-Modell auf deinem eigenen Computer: kein Konto, kein Upload, keine Credits, und es bleibt kostenlos, egal wie viele Dateien du verarbeitest. Du brauchst einen Browser mit WebGPU und mindestens 8 GB Arbeitsspeicher, pro Datei sind bis zu 15 Minuten Audio möglich, und das Modell wird einmalig beim ersten Durchlauf heruntergeladen. Die Cloud ist für längere Dateien und für Geräte gedacht, die das Modell nicht ausführen können: Jedes neue Konto erhält kostenlos 10 Credits. Das entspricht 10 Minuten mit diesem Tool, ohne Kreditkarte. Die Cloud kostet 1 Credit pro Minute. Jede angefangene Minute zählt, ein Clip von 2:30 Minuten wird also als 3 Minuten abgerechnet.

Zuletzt geprüft im September 2026.