Stem-Separation und KI-Audiobearbeitung

Gesang, Instrumente, Sprache und Störgeräusche mit KI trennen oder bearbeiten.

Wissensstufe: Status: Zuletzt geprüft: 28.07.2026Primärquelle: Meta Research: Demucs
Lesedauer: etwa 1 Min.Zur Übersicht

Source-Separation-Modelle zerlegen eine gemischte Aufnahme in geschätzte Einzelbestandteile, etwa Gesang, Schlagzeug, Bass und Begleitung. Andere Modelle reduzieren Rauschen, verbessern Sprache oder erzeugen passende Geräusche.

Typische Anwendungen

  • Gesang und Instrumental trennen
  • alte Aufnahmen restaurieren
  • Dialog verständlicher machen
  • Remix- und Übungsfassungen erstellen
  • Ton für Videos ergänzen

Keine perfekte Rückgewinnung

Die getrennten Spuren sind Schätzungen. Wenn sich Frequenzen und Klänge stark überlagern, können Artefakte oder Teile anderer Instrumente hörbar bleiben.

Rechte beachten

Technische Trennung schafft keine neuen Nutzungsrechte. Auch isolierte Stimmen oder Instrumente bleiben Bestandteile einer geschützten Aufnahme.

Qualitätsprüfung

  • Kopfhörer und Lautsprecher verwenden
  • Übergänge und leise Passagen prüfen
  • Phasen- und Hallartefakte kontrollieren
  • Original und bearbeitete Version archivieren

Quellen und Prüfstand

Prüfstand: 28.07.2026. Produktfunktionen, Nutzungsbedingungen und Rechte können sich ändern und müssen vor einer Veröffentlichung beim jeweiligen Anbieter geprüft werden.