Recht & Ethik · Begriff · KI-Weiterbildung für Unternehmen
Was bedeutet Text und Data Mining für KI und Urheberrecht?
Kurz gesagt
Text und Data Mining (TDM) heisst, grosse Mengen an Texten, Bildern oder Daten automatisch nach Mustern auszuwerten, wie es beim Training von KI geschieht. Ob das ohne Erlaubnis zulässig ist, hängt vom Recht ab: Die EU kennt Ausnahmen mit Widerspruchsmöglichkeit, die Schweiz hat eine Ausnahme für die wissenschaftliche Forschung, aber nach heutigem Stand keine allgemeine für kommerzielles TDM.
Einfach erklärt
Text und Data Mining, kurz TDM, bedeutet: Ein Computerprogramm liest sehr viele Inhalte automatisch ein und sucht darin nach Mustern, Zusammenhängen und Häufigkeiten. Ein einfaches Beispiel ist die Auswertung von tausend Zeitungsartikeln, um zu sehen, wie sich ein Thema über die Jahre entwickelt. Auch das Training von KI-Modellen beruht darauf, dass Programme riesige Mengen an Texten und Bildern auswerten.
Das Urheberrecht kommt ins Spiel, weil dazu Inhalte vervielfältigt werden müssen, wenigstens vorübergehend. Ob das erlaubt ist, regeln die Länder unterschiedlich. In der Europäischen Union gibt es seit der Urheberrechtsrichtlinie von 2019 Ausnahmen für TDM: eine für Forschungseinrichtungen und eine allgemeinere, die auch kommerzielle Nutzung erfasst. Die allgemeine Ausnahme gilt aber nur, solange Rechteinhaber die Nutzung nicht vorbehalten haben. Bei online veröffentlichten Inhalten soll ein solcher Vorbehalt maschinenlesbar sein. Der EU AI Act verpflichtet Anbieter von Allzweck-KI-Modellen, eine Strategie zur Einhaltung des EU-Urheberrechts zu haben, einschliesslich der Beachtung solcher Vorbehalte.
In der Schweiz kennt das Urheberrechtsgesetz eine Ausnahme für die wissenschaftliche Forschung, aber nach heutigem Stand keine ausdrückliche allgemeine Ausnahme für kommerzielles TDM. Wie das im Einzelfall zu beurteilen ist, auch bei Trainings für kommerzielle KI, ist rechtlich nicht abschliessend geklärt.
| Frage | EU | Schweiz |
|---|---|---|
| Ausnahme für Forschung | ja | ja |
| Ausnahme für kommerzielles TDM | ja, mit Nutzungsvorbehalt | nach heutigem Stand keine ausdrückliche |
| Vorbehalt durch Rechteinhaber | möglich, maschinenlesbar bei Online-Inhalten | Bedeutung offen |
| Besondere KI-Pflichten für Modellanbieter | ja, im AI Act | nicht direkt |
Ein Beispiel
Ein Schweizer Verlag mit einer Fachzeitschrift stellt fest, dass sein Archiv offenbar von einem KI-Anbieter ausgelesen wurde. Er fragt sich, ob das zulässig war, und prüft, ob er den Zugriff einschränken kann. Er ergänzt auf der Website maschinenlesbare Hinweise, dass Inhalte nicht für KI-Training verwendet werden sollen, und klärt mit einer Fachperson, wie weit solche Hinweise rechtlich tragen. Siehe Training auf Websites widersprechen.
Worauf Sie achten müssen
- Rechtslage in Bewegung: TDM und KI-Training sind politisch und gerichtlich umstritten. Aussagen können sich ändern.
- Land entscheidet: Für Schweizer Betriebe können je nach Markt und Dienstleister EU-Regeln eine Rolle spielen.
- Technische Hinweise sind kein Schutzschild: Eine Datei wie robots.txt hilft nur gegen Programme, die sie beachten. Siehe robots.txt und Urheberrecht.
- Fachliche Prüfung: Bei eigenem KI-Training mit fremden Inhalten holen Sie rechtlichen Rat.
Vorlage zum Kopieren
Wir sind [Betrieb, Schweiz] und möchten [Art der Inhalte, z. B. öffentlich zugängliche Fachartikel] für [Zweck, z. B. eine interne KI-Auswertung] automatisch auswerten.
Erstelle eine Prüfliste mit Fragen zu: Herkunft der Inhalte, Nutzungsbedingungen, technischen Nutzungsvorbehalten (zum Beispiel robots.txt), Land und Zweck der Auswertung, Personendaten und Weitergabe an Dienste.
Ergänze drei Fragen an eine Fachperson für Urheberrecht.
Gib keine Rechtsberatung und erfinde keine Gesetzesartikel.Ersetzen Sie die Klammern und lassen Sie das Vorhaben fachlich prüfen.
So hilft Ihnen Alpasana
Damit Ihr Team versteht, wie KI lernt und welche Fragen sich beim Datenumgang stellen, bietet absofort die KI-Weiterbildung für Unternehmen. Laut Beschreibung gehören Schweizer Praxisbezug, Datenschutz, der verantwortungsbewusste Umgang mit Unternehmensdaten und bei EU-Bezug der EU AI Act zu den Lerninhalten. Gelernt wird online im eigenen Tempo.
Häufige Fragen
Ist Text und Data Mining immer verboten?
Nein. Es gibt gesetzliche Ausnahmen, zum Beispiel für Forschung, die je nach Land unterschiedlich ausgestaltet sind.
Darf ich fremde Websites für mein KI-Projekt auslesen?
Das hängt von Land, Zweck, Nutzungsbedingungen und Vorbehalten ab. Siehe Fremde Websites auslesen und holen Sie bei Zweifeln Rat ein.
Erstellt mit KI-Unterstützung, redaktionell verantwortet von der Alpasana GmbH · 10.10.2026. Fehler entdeckt? Melden Sie es uns.
Hinweis: Dieser Beitrag gibt einen allgemeinen Überblick und ersetzt keine Rechtsberatung im Einzelfall. Massgeblich sind die geltenden Gesetzestexte.
Quellen
Weiterlesen in der Galaxie
- Wie widerspreche ich KI-Training mit meinen Website-Inhalten?KI Training Widerspruch Website: So erklären Sie einen maschinenlesbaren Nutzungsvorbehalt in robots.txt und Impressum und prüfen die Crawler.
- Schützt eine robots.txt meine Inhalte vor KI-Nutzung?robots.txt KI Urheberrecht: Was die Sperre für KI-Crawler bewirkt, wo sie rechtlich und technisch an Grenzen stösst und was Sie zusätzlich tun können.
- Darf KI Inhalte anderer Websites automatisch auslesen?KI Web Scraping Urheberrecht: Wann das automatische Auslesen fremder Websites heikel ist: Nutzungsbedingungen, Urheber-, Lauterkeits- und Datenschutzrecht.
- KI-Urheberrecht: Was unterscheidet die Schweiz und die EU?KI Urheberrecht Schweiz EU im Vergleich: Schutz von KI-Ergebnissen, Training mit fremden Werken und Anbieterpflichten, mit Hinweisen für Betriebe.
- Was ist ein KI-Modell mit allgemeinem Verwendungszweck?GPAI einfach erklärt: Was ein KI-Modell mit allgemeinem Verwendungszweck ist und warum für das Modell andere Regeln gelten können als für die Anwendung darauf.