Einzelne Spuren in voller Qualität. Keine Registrierung, keine Gebühren pro Titel.Das gleiche Modell und die gleiche Qualität mit 192 kbps (oder verlustfreies WAV) wie in der kostenpflichtigen Version – Titel bis zu 15 Minuten Länge.
Der schnellste Weg, um den Gesang aus einem Lied zu entfernen, ohne für Software zu bezahlen oder nach einer bearbeiteten Datei zu suchen: Laden Sie einen Titel hoch und erhalten Sie eine saubere Instrumentalversion (Karaoke-Version) sowie den isolierten Acapella-Gesang in einem Schritt. Echte Spuren-Trennung auf einer GPU, keine Registrierung, kein Wasserzeichen, keine täglichen Beschränkungen.
Ihre hochgeladene Datei wird gelöscht, sobald die Trennung abgeschlossen ist. Möchten Sie WAV-Dateien, Play-Along-Mixe oder längere Titel? Das vollständige Tool finden Sie auf der Startseite.
Jetzt Gesang entfernen →Der Stimmentferner ist das am häufigsten genutzte Tool auf der Seite: 1.776 Uploads in den 40 Tagen, in denen wir die Nutzung gemessen haben – mehr als alle anderen Tools hier zusammen. Betrachtet man die Dateien selbst – 320 Uploads, gemessen anhand ihrer Größe – lag der Durchschnitt bei 9,44 MB und die größte Datei hatte 83,66 MB; die meisten Dateien liegen zwischen 4 und 8 MB (107 davon), 8 bis 16 MB (57) und 2 bis 4 MB (43), wobei sich 98 % bequem innerhalb unserer Grenzen bewegen und nicht an diese stoßen. Dieser Bereich entspricht in etwa einer normalen MP3-Datei von drei bis fünf Minuten Länge in üblicher Exportqualität – kein Problem, sondern einfach die Größe eines durchschnittlichen Uploads. Was schiefgeht, ist weniger das Problem der Trennung selbst: Die häufigste Ursache für die Ablehnung eines Uploads auf der gesamten Seite war eine Datei ohne Dateierweiterung, nämlich 26 Mal in 40 Tagen – meistens ein Dokument oder eine umbenannte Datei, die in das Feld hochgeladen wurde, und nicht ein von uns nicht unterstütztes Format. Wenn Ihr Upload abgelehnt wird, ist dies viel wahrscheinlicher der Grund als ein Problem mit der eigentlichen Stimmentfernung.
StemGrab verwendet ein Modell, das speziell für die Trennung von Stimmen trainiert wurde und auf unserer eigenen GPU läuft. Anstatt des alten Phasenauslöschungstricks (der nur bei einigen Stereo-Mixen halbwegs funktioniert), versteht das Tool tatsächlich, wie eine Stimme klingt, und isoliert sie aus dem Mix, sodass Sie sowohl das Instrumental als auch den Gesang als separate MP3-Dateien zusammen mit Schlagzeug, Bass, Gitarre, Klavier und dem Rest erhalten.
Die meisten kostenlosen „Stimmentferner“-Tools, die Sie online finden, basieren immer noch auf PhaseninversionKehren Sie die Polarität eines Stereokanals um, addieren Sie ihn zum anderen, und alles, was genau in der Mitte liegt, wird ausgeblendet. Es ist ein netter Trick, aber es ist keine echte Stimmentfernung: Es blendet auch das Schlagzeug und den Bass zusammen mit dem Sänger aus, es funktioniert nur bei Mixen, die genau in der Mitte liegen, und es versagt bei Mono-Dateien oder bei Gesang mit Stereo-Hall. Was übrig bleibt, ist ein hohler, phasenverschobener Mix, bei dem der Gesang nur teilweise entfernt wurde, und kein echtes Instrumental.
StemGrab blendet nichts aus. Das Modell ist darauf trainiert, zu erkennen, wie eine Stimme tatsächlich klingt (ihre Formanten, der Atem und die Phrasierung), und isoliert diese Stimme direkt aus dem Mix, unabhängig davon, ob die Spur Mono oder Stereo, zentriert oder seitlich verschoben, trocken oder mit Hall versehen ist. Deshalb erhalten Sie bei einem Upload eine wirklich saubere Acapella-Version und eine wirklich saubere Instrumentalversion anstelle eines Kompromisses. Sind Sie neugierig auf die dahinterliegende Mechanik? Wir haben aufgeschrieben, wie die KI-basierte Trennung von einzelnen Spuren tatsächlich funktioniert, inklusive Phasenanpassungen.
Wenn Sie vorhaben, das Ergebnis zu veröffentlichen (einen Remix, einen Mashup, einen Cover-Song über dem Instrumental)? Lesen Sie was Sie mit dem Ergebnis rechtlich tun dürfen Zuerst: Privat zu üben und zu experimentieren ist immer in Ordnung, die Veröffentlichung der Aufnahme einer anderen Person benötigt in der Regel eine Genehmigung.
Arbeiten Sie stattdessen mit einem Video – einem Vlog oder einem Tutorial mit Musik, die unter Ihrer eigenen Stimme gemischt ist? Laden Sie das Video direkt hier hoch und behalten Sie die Acapella-Spur als Ihre Erzählung.
Kein Trennmodell ist perfekt, und es ist gut zu wissen, bei welchen Songs es Probleme geben wird, bevor Sie die Upload-Qualität in Frage stellen. Mehrspurige Hintergrundgesänge und Harmonien werden vom Modell immer noch als Gesang betrachtet, daher verschwinden sie zusammen mit dem Leadsänger aus dem Mix: Wenn der Refrain, den Sie behalten möchten, aus drei Stimmen besteht, wirkt Ihr Instrumental plötzlich leer, genau dort, wo sich das Lied eigentlich öffnen sollte. Lange Hall-Effekte sind das zweite Problem. Die Stimme ist zwar trocken, wenn sie gesungen wird, aber der Raum, in dem sie gesungen wurde, ist Teil der Aufnahme. Bei einem Track, der mit Hall-Effekten durchzogen ist, kann es daher zu einem schwachen Echo des Gesangs im Instrumental kommen, selbst wenn die Stimme selbst verschwunden ist.
Vocoder, Talkbox und stark veränderter Gesang werden eher wie Instrumente denn wie Stimmen wahrgenommen, was in der Regel keine gute Wahl für einen modernen Pop-Refrain ist: Rechnen Sie damit, dass ein Teil dieses Refrains im Instrumental erhalten bleibt. Live-Aufnahmen sind am schwierigsten, da das Publikum, der Raum und das Übersprechen zwischen den Mikrofonen alle übereinander liegen. Und bei Aufnahmen von vor etwa 1970, bei denen die gesamte Band oft auf ein enges Mono-Mix reduziert wurde, gibt es schlichtweg weniger räumliche Informationen, mit denen das Modell arbeiten kann.
Das macht das Ergebnis nicht unbrauchbar. Es bedeutet, dass Sie vorher zuhören sollten: Eine dichte Live-Aufnahme benötigt möglicherweise eine Reduzierung der Gesangsspur anstelle einer vollständigen Entfernung, und genau dafür ist der Mixer da.
StemGrab liefert Ihnen nicht einfach eine einzelne Datei mit dem Hinweis „Gesang entfernt“ und hofft auf das Beste. Wenn der Vorgang abgeschlossen ist, erhalten Sie alle sieben Spuren in einem kleinen Mixer auf der Ergebnisseite, sodass Sie die einzelnen Spuren isoliert abspielen und sie einzeln anhören können, oder die Gesangsspur stummschalten und den Rest der Band in dem Abschnitt spielen lassen, der Sie tatsächlich interessiert. Das ist der schnellste Weg, um die oben genannten Probleme zu erkennen: Springen Sie zum Refrain, schalten Sie den Gesang stumm, und Sie werden innerhalb von zehn Sekunden wissen, ob die Hintergrundharmonien ebenfalls entfernt wurden.
Wenn es gut klingt, verwenden Sie die Option „Ausgewählte herunterladen“ und laden Sie nur die Spuren herunter, die Sie benötigen, anstatt die gesamte ZIP-Datei. Wenn nicht, wissen Sie jetzt, warum, und ob ein anderer Abschnitt des Songs besser funktioniert. StemGrab liest auch die Tonart und das Tempo der hochgeladenen Datei und zeigt sie neben den einzelnen Spuren an, was wichtig ist, wenn Sie planen, über die Instrumentalversion zu singen oder sie zu spielen, anstatt sie nur anzuhören. Möchten Sie die Gesangsmelodie selbst als Noten und nicht nur als Tonartbezeichnung erhalten? MP3 zu MIDI wandelt die gleiche hochgeladene Datei in eine MIDI-Datei um, wobei die Gesangslinie auf einer eigenen Spur liegt.
Ja, die Werbung auf der Website finanziert den Betrieb der GPU. Keine Registrierung, keine E-Mail-Adresse, kein Wasserzeichen, keine zeitlich begrenzte Testversion.
Bei den meisten modernen, gut abgemischten Tracks ist die Trennung bemerkenswert sauber. Sehr dichte Mischungen, Live-Aufnahmen oder starker Hall sind schwieriger: das gilt für jedes Trennwerkzeug.
Sie wird direkt nach der Verarbeitung gelöscht; die einzelnen Spuren werden innerhalb von 45 Minuten gelöscht. Siehe die Datenschutzrichtlinie.
Das Tool kann kostenlos verwendet werden, aber die Rechte an dem Lied verbleiben bei demjenigen, der sie besitzt: holen Sie sich für alles, was öffentlich genutzt wird, vorher die Erlaubnis.