Zum Inhalt springen

Werkzeuge & Agenten · KI und IT für konkrete Arbeitsaufgaben

Unterschiedliche Stimmen automatisch gleich laut machen

Stand 10.10.2026 · 5 Min. Lesezeit

Kurz gesagt

Mit Normalisierung und Lautheitsanpassung gleichen Audioprogramme Pegelunterschiede automatisch aus, oft mit KI-Unterstützung. Bei Gesprächen mit mehreren Personen hilft zusätzlich ein Kompressor. Prüfen Sie das Ergebnis mit Kopfhörern, denn zu starke Anpassung hebt auch Rauschen und Atemgeräusche an.

Das Problem

Sie haben ein Gespräch zu zweit oder zu viert aufgenommen. Eine Person sitzt direkt am Mikrofon und ist laut, die andere spricht leise und weit weg. Beim Anhören drehen Sie ständig an der Lautstärke: Wenn Sie die leise Stimme verstehen wollen, übertönt Sie die laute. Das ermüdet und macht die Aufnahme für andere unbrauchbar.

Solche Pegelunterschiede sind bei Aufnahmen mit einem einzelnen Mikrofon oder bei verschiedenen Mikrofonabständen normal. Auch innerhalb einer Stimme gibt es Unterschiede: Wer lacht, wird laut, wer nachdenkt, leise.

Audioprogramme können Lautstärken automatisch angleichen. Dafür gibt es drei Werkzeuge, die man leicht verwechselt: Normalisierung, Lautheitsanpassung und Kompression. Mit KI-Unterstützung gelingt es heute oft einfacher als früher. Stand: Oktober 2026; Funktionen und Angebote ändern sich. Prüfen Sie Ihre Software.

Einfach erklärt

Die drei Begriffe in einfachen Worten:

  • Normalisieren: Das Programm sucht die lauteste Stelle der ganzen Aufnahme und hebt alles gleichmässig an, bis diese Stelle eine Zielhöhe erreicht. Es verändert die Unterschiede nicht, hebt nur das Ganze.
  • Lautheitsanpassung: Das Programm misst, wie laut die Aufnahme für das Ohr wirkt (die «Lautheit», oft in LUFS angegeben), und passt sie auf einen Zielwert an. So klingen verschiedene Aufnahmen ähnlich laut. Für Podcasts werden oft Zielwerte um minus 16 LUFS genannt, für Rundfunk gilt in Europa häufig minus 23 LUFS. Das sind Richtwerte, die je nach Plattform abweichen.
  • Kompression: Ein Kompressor macht laute Stellen leiser und leise Stellen im Verhältnis lauter. Das verringert die Unterschiede innerhalb der Aufnahme und ist das Mittel der Wahl, wenn eine Person deutlich leiser spricht als die andere.

Ein Beispiel: Frau Keller spricht laut, Herr Meier leise. Die Normalisierung hebt beide an, aber Herr Meier bleibt zu leise. Ein Kompressor ist nötig. Er verringert die Spitzen von Frau Keller und stärkt Herrn Meiers Stimme.

KI-gestützte Werkzeuge bieten oft eine Funktion, die Stimmen automatisch ausgleicht, manchmal getrennt für jede sprechende Person. Wie gut das funktioniert, hängt von der Aufnahme ab.

WerkzeugWas es machtWofür
NormalisierungHebt alles gleichmässig anZu leise Aufnahme insgesamt
LautheitsanpassungPasst auf Zielwert anMehrere Aufnahmen gleich laut machen
KompressionVerringert Unterschiede innerhalb der AufnahmeLaute und leise Stimmen angleichen

So lösen Sie es mit KI – Schritt für Schritt

  1. Original sichern. Arbeiten Sie an einer Kopie. Bearbeitung lässt sich so rückgängig machen.
  1. Problem erkennen. Hören Sie mit Kopfhörern. Ist die ganze Aufnahme zu leise oder sind es einzelne Stimmen? Das bestimmt die Methode.
  1. Ein geeignetes Programm wählen. Viele Audioprogramme bieten Normalisierung, Lautheitsanpassung und Kompression, manche zusätzlich KI-Funktionen zur Stimmenangleichung. Prüfen Sie Datenschutz und Bedingungen, besonders bei Online-Diensten.
  1. Vertraulichkeit klären. Laden Sie keine vertraulichen Gespräche in Online-Dienste ohne geklärte Bedingungen und Einwilligungen. Siehe Transkription vertraulicher Aufnahmen.
  1. Zuerst Rauschen und Hall prüfen. Wenn die Aufnahme verrauscht oder verhallt ist, verstärkt das Anheben der Lautstärke auch diese Störungen. Bearbeiten Sie sie zuerst. Siehe Hall entfernen und Hintergrundgeräusche entfernen.
  1. Stimmen angleichen. Verwenden Sie Kompression oder die automatische Stimmenangleichung mit moderaten Einstellungen. Hören Sie nach jeder Änderung neu.
  1. Gesamtlautheit anpassen. Stellen Sie am Schluss die Gesamtlautheit auf einen sinnvollen Zielwert ein, passend zu Ihrer Plattform.
  1. Ergebnis prüfen. Hören Sie die ganze Aufnahme an verschiedenen Geräten, etwa Kopfhörern und Handylautsprecher. Achten Sie auf übersteuerte Stellen und hörbares Pumpen.

Vorlage zum Kopieren

Notizblatt für Ihre Einstellungen (Klammern ersetzen):

Aufnahme: [Titel, Datum]
Problem: [z. B. Person B ist deutlich leiser als Person A]
Reihenfolge der Bearbeitung: [z. B. 1. Rauschen, 2. Hall, 3. Stimmen angleichen, 4. Lautheit]
Methode Stimmenangleichung: [Kompression / automatische Funktion des Programms]
Eingestellter Zielwert Lautheit: [z. B. -16 LUFS laut Plattformvorgabe]
Geprüft auf Geräten: [Kopfhörer, Handylautsprecher, ...]
Auffälligkeiten: [z. B. Atemgeräusche zu laut]
Original gesichert: [ja/nein]

Und ein Prompt, der Ihnen die Begriffe für Ihr Programm erklärt:

Du erklärst mir als Laie, wie ich in dem Audioprogramm [Name des Programms] unterschiedlich laute Stimmen in einer Gesprächsaufnahme angleiche. Du erfindest keine Menüpunkte. Wenn du den Weg im Programm nicht sicher kennst, sagst du es und beschreibst allgemein, welche Funktion (Kompression, Lautheitsanpassung, Normalisierung) ich suchen soll.
Antworte in einfachen Schritten, Sie-Form, Deutsch (Schweiz).

Prüfen Sie Angaben der KI zu Menüs in der Anleitung Ihres Programms.

Worauf Sie achten müssen

  • Rauschen wird mitverstärkt. Wer leise Stimmen anhebt, hebt auch Rauschen an. Vorher bereinigen.
  • Zu starke Kompression. Sie macht Stimmen flach und kann Atemgeräusche überbetonen. Moderat einstellen.
  • Übersteuern vermeiden. Zu laute Spitzen verzerren. Lassen Sie Reserve.
  • Plattformvorgaben prüfen. Podcast- und Videoplattformen haben eigene Zielwerte. Die genannten Zahlen sind Richtwerte.
  • Datenschutz. Stimmen sind Personendaten. Prüfen Sie Dienste und holen Sie Einwilligungen ein. Siehe Meeting aufnehmen: Datenschutz.
  • Besser aufnehmen. Gleicher Abstand zum Mikrofon vermeidet das Problem. Siehe Aufnahmequalität.

Ein Beispiel aus der Praxis

Ein Beispiel: Die Leiterin eines Pflegeheims in Zofingen hat ein Gespräch mit einem Angehörigen für ein internes Lernvideo aufgenommen, mit Einverständnis beider. Die Leiterin sitzt nah am Handy, der Angehörige weiter weg. Beim Anhören muss sie ständig die Lautstärke ändern.

Sie bereinigt zuerst leises Rauschen, dann nutzt sie die automatische Stimmenangleichung ihres Programms und stellt die Gesamtlautheit ein. Beim Anhören auf dem Handy merkt sie, dass die Atemgeräusche der Leiterin nun zu laut sind, und reduziert die Stärke. Danach sind beide Stimmen gut verständlich. Das Original bewahrt sie getrennt auf.

So hilft Ihnen Alpasana

Wer Audioaufnahmen für Schulung, Transkription und Kommunikation im Betrieb nutzen möchte, findet im Kurs KI und IT für konkrete Arbeitsaufgaben bei absofort unter anderem Bürokommunikation mit Meetings sowie Podcast- und Voiceover-Vorbereitung. Praxisaufgaben, KI-Lerncoach und ein verifizierbarer Abschluss gehören dazu.

Welches Programm Sie nutzen und wie Sie einstellen, entscheiden Sie anhand Ihrer Aufnahme.

Häufige Fragen

Reicht es, die Aufnahme zu normalisieren?

Nur, wenn die ganze Aufnahme zu leise ist. Wenn einzelne Stimmen leiser sind, brauchen Sie Kompression oder eine Stimmenangleichung.

Was bedeutet LUFS?

Eine Einheit für die wahrgenommene Lautheit. Plattformen nennen oft Zielwerte. Sie dienen dazu, dass verschiedene Aufnahmen ähnlich laut klingen.

Kann KI jede Stimme auf eigene Spur trennen?

Manche Werkzeuge versuchen es, mit gemischtem Erfolg. Bei überlappenden Stimmen ist es schwierig. Prüfen Sie das Ergebnis.

Soll ich vorher oder nachher Rauschen entfernen?

Vorher. Sonst verstärken Sie das Rauschen mit.

Erstellt mit KI-Unterstützung, redaktionell verantwortet von der Alpasana GmbH · 10.10.2026. Fehler entdeckt? Melden Sie es uns.

Weiterlesen in der Galaxie