Zum Inhalt springen

Recht & Ethik · Begriff · KI-Weiterbildung für Unternehmen

Was bedeutet Text und Data Mining für KI und Urheberrecht?

Stand 10.10.2026 · 3 Min. Lesezeit

Kurz gesagt

Text und Data Mining (TDM) heisst, grosse Mengen an Texten, Bildern oder Daten automatisch nach Mustern auszuwerten, wie es beim Training von KI geschieht. Ob das ohne Erlaubnis zulässig ist, hängt vom Recht ab: Die EU kennt Ausnahmen mit Widerspruchsmöglichkeit, die Schweiz hat eine Ausnahme für die wissenschaftliche Forschung, aber nach heutigem Stand keine allgemeine für kommerzielles TDM.

Einfach erklärt

Text und Data Mining, kurz TDM, bedeutet: Ein Computerprogramm liest sehr viele Inhalte automatisch ein und sucht darin nach Mustern, Zusammenhängen und Häufigkeiten. Ein einfaches Beispiel ist die Auswertung von tausend Zeitungsartikeln, um zu sehen, wie sich ein Thema über die Jahre entwickelt. Auch das Training von KI-Modellen beruht darauf, dass Programme riesige Mengen an Texten und Bildern auswerten.

Das Urheberrecht kommt ins Spiel, weil dazu Inhalte vervielfältigt werden müssen, wenigstens vorübergehend. Ob das erlaubt ist, regeln die Länder unterschiedlich. In der Europäischen Union gibt es seit der Urheberrechtsrichtlinie von 2019 Ausnahmen für TDM: eine für Forschungseinrichtungen und eine allgemeinere, die auch kommerzielle Nutzung erfasst. Die allgemeine Ausnahme gilt aber nur, solange Rechteinhaber die Nutzung nicht vorbehalten haben. Bei online veröffentlichten Inhalten soll ein solcher Vorbehalt maschinenlesbar sein. Der EU AI Act verpflichtet Anbieter von Allzweck-KI-Modellen, eine Strategie zur Einhaltung des EU-Urheberrechts zu haben, einschliesslich der Beachtung solcher Vorbehalte.

In der Schweiz kennt das Urheberrechtsgesetz eine Ausnahme für die wissenschaftliche Forschung, aber nach heutigem Stand keine ausdrückliche allgemeine Ausnahme für kommerzielles TDM. Wie das im Einzelfall zu beurteilen ist, auch bei Trainings für kommerzielle KI, ist rechtlich nicht abschliessend geklärt.

FrageEUSchweiz
Ausnahme für Forschungjaja
Ausnahme für kommerzielles TDMja, mit Nutzungsvorbehaltnach heutigem Stand keine ausdrückliche
Vorbehalt durch Rechteinhabermöglich, maschinenlesbar bei Online-InhaltenBedeutung offen
Besondere KI-Pflichten für Modellanbieterja, im AI Actnicht direkt

Ein Beispiel

Ein Schweizer Verlag mit einer Fachzeitschrift stellt fest, dass sein Archiv offenbar von einem KI-Anbieter ausgelesen wurde. Er fragt sich, ob das zulässig war, und prüft, ob er den Zugriff einschränken kann. Er ergänzt auf der Website maschinenlesbare Hinweise, dass Inhalte nicht für KI-Training verwendet werden sollen, und klärt mit einer Fachperson, wie weit solche Hinweise rechtlich tragen. Siehe Training auf Websites widersprechen.

Worauf Sie achten müssen

  • Rechtslage in Bewegung: TDM und KI-Training sind politisch und gerichtlich umstritten. Aussagen können sich ändern.
  • Land entscheidet: Für Schweizer Betriebe können je nach Markt und Dienstleister EU-Regeln eine Rolle spielen.
  • Technische Hinweise sind kein Schutzschild: Eine Datei wie robots.txt hilft nur gegen Programme, die sie beachten. Siehe robots.txt und Urheberrecht.
  • Fachliche Prüfung: Bei eigenem KI-Training mit fremden Inhalten holen Sie rechtlichen Rat.

Vorlage zum Kopieren

Wir sind [Betrieb, Schweiz] und möchten [Art der Inhalte, z. B. öffentlich zugängliche Fachartikel] für [Zweck, z. B. eine interne KI-Auswertung] automatisch auswerten.
Erstelle eine Prüfliste mit Fragen zu: Herkunft der Inhalte, Nutzungsbedingungen, technischen Nutzungsvorbehalten (zum Beispiel robots.txt), Land und Zweck der Auswertung, Personendaten und Weitergabe an Dienste.
Ergänze drei Fragen an eine Fachperson für Urheberrecht.
Gib keine Rechtsberatung und erfinde keine Gesetzesartikel.

Ersetzen Sie die Klammern und lassen Sie das Vorhaben fachlich prüfen.

So hilft Ihnen Alpasana

Damit Ihr Team versteht, wie KI lernt und welche Fragen sich beim Datenumgang stellen, bietet absofort die KI-Weiterbildung für Unternehmen. Laut Beschreibung gehören Schweizer Praxisbezug, Datenschutz, der verantwortungsbewusste Umgang mit Unternehmensdaten und bei EU-Bezug der EU AI Act zu den Lerninhalten. Gelernt wird online im eigenen Tempo.

Häufige Fragen

Ist Text und Data Mining immer verboten?

Nein. Es gibt gesetzliche Ausnahmen, zum Beispiel für Forschung, die je nach Land unterschiedlich ausgestaltet sind.

Darf ich fremde Websites für mein KI-Projekt auslesen?

Das hängt von Land, Zweck, Nutzungsbedingungen und Vorbehalten ab. Siehe Fremde Websites auslesen und holen Sie bei Zweifeln Rat ein.

Erstellt mit KI-Unterstützung, redaktionell verantwortet von der Alpasana GmbH · 10.10.2026. Fehler entdeckt? Melden Sie es uns.

Hinweis: Dieser Beitrag gibt einen allgemeinen Überblick und ersetzt keine Rechtsberatung im Einzelfall. Massgeblich sind die geltenden Gesetzestexte.

Quellen

Weiterlesen in der Galaxie