Zum Inhalt springen

Recht & Ethik · KI-Console

Wie widerspreche ich KI-Training mit meinen Website-Inhalten?

Stand 10.10.2026 · 5 Min. Lesezeit

Kurz gesagt

Erklären Sie Ihren Vorbehalt doppelt: maschinenlesbar in der Datei robots.txt für bekannte KI-Crawler und in Worten im Impressum oder in den Nutzungsbedingungen. Wägen Sie vorher ab, ob Sie damit auch in KI-Suchen weniger sichtbar werden möchten. Einen vollständigen Schutz bietet keine Methode, weil sich nicht alle Crawler an solche Angaben halten.

Das Problem

Sie haben über Jahre Texte, Anleitungen und Fotos für Ihre Website erstellt. Nun lesen Sie, dass KI-Firmen öffentlich zugängliche Websites automatisch durchsuchen, um ihre Modelle zu trainieren. Diese Suchprogramme heissen Crawler. Sie fragen sich: Kann ich das verhindern oder zumindest klar machen, dass ich es nicht will?

Das Thema ist rechtlich und technisch zugleich. Rechtlich geht es um das Urheberrecht und darum, ob Sie einen Vorbehalt erklärt haben. Technisch geht es darum, wie Crawler diesen Vorbehalt erkennen. Ein Satz im Impressum allein liest kaum ein Programm.

Gleichzeitig gibt es einen Zielkonflikt: Wer KI-Crawler aussperrt, wird unter Umständen auch in KI-Suchdiensten weniger gefunden. Diese Abwägung sollten Sie bewusst treffen.

So lösen Sie es mit KI – Schritt für Schritt

  1. Klären Sie Ihr Ziel. Wollen Sie KI-Training ausschliessen, aber in Suchmaschinen und KI-Suchen sichtbar bleiben? Oder möchten Sie gar nicht von KI-Diensten gelesen werden? Schreiben Sie Ihr Ziel in einem Satz auf.
  1. Finden Sie Ihre robots.txt. Die Datei robots.txt liegt im Hauptverzeichnis Ihrer Website, zum Beispiel unter «ihre-domain.ch/robots.txt». Sie enthält Anweisungen für Crawler. Öffnen Sie die Adresse im Browser und schauen Sie, was dort bereits steht. Hintergründe zur Rechtswirkung finden Sie unter robots.txt und Urheberrecht.
  1. Wählen Sie die Crawler aus. Mehrere Anbieter dokumentieren eigene Kennungen für das Sammeln von Trainingsdaten. Beispiele sind GPTBot (OpenAI), ClaudeBot (Anthropic), Google-Extended (Google, steuert die Nutzung für KI-Modelle, nicht die normale Google-Suche), Applebot-Extended (Apple) und CCBot (Common Crawl). Prüfen Sie die aktuellen Angaben in der Dokumentation der Anbieter.
  1. Ergänzen Sie die robots.txt. Lassen Sie sich mit der Vorlage unten einen Vorschlag erstellen. Ihr Webhoster oder Ihre Webagentur kann die Datei anpassen. Bei vielen Baukastensystemen gibt es dafür ein Einstellungsfeld.
  1. Formulieren Sie einen Vorbehalt in Worten. Ergänzen Sie im Impressum oder in den Nutzungsbedingungen einen kurzen Satz, etwa: «Die Inhalte dieser Website dürfen nicht für das Training von KI-Modellen verwendet werden. Dieser Vorbehalt ist zusätzlich maschinenlesbar in unserer robots.txt hinterlegt.»
  1. Prüfen Sie neuere Signale. Es gibt weitere Vorschläge für maschinenlesbare Vorbehalte, etwa sogenannte Content-Signale in der robots.txt oder das TDM-Reservation-Protokoll. Sie sind noch nicht überall verbreitet, können aber ergänzend sinnvoll sein.
  1. Kontrollieren Sie das Ergebnis. Rufen Sie die robots.txt erneut auf und prüfen Sie, ob die Einträge korrekt sind. Testen Sie danach mit einem Prüfwerkzeug, ob die gewünschten Crawler gesperrt und Suchmaschinen weiterhin zugelassen sind.
  1. Wiederholen Sie die Kontrolle. Neue Crawler kommen hinzu, Kennungen ändern sich. Planen Sie eine Überprüfung zweimal pro Jahr.

Vorlage zum Kopieren

Erstelle eine robots.txt für meine Website [Domain].
Ziel: [z. B. KI-Training ausschliessen, aber in Google-Suche und KI-Suchdiensten sichtbar bleiben]
Bestehende Einträge in meiner robots.txt: [Inhalt einfügen oder «keine»]
Bereiche, die ganz gesperrt bleiben sollen: [z. B. /intern/]
Erkläre jede Zeile in einfachem Deutsch.
Nenne nur Crawler-Kennungen, die du sicher kennst, und schreibe dazu, in welcher Anbieter-Dokumentation ich sie überprüfen soll.
Weise mich darauf hin, wenn eine Zeile auch die normale Suchmaschinen-Sichtbarkeit beeinträchtigen könnte.

Setzen Sie Domain und Ziel ein und lassen Sie den Vorschlag von Ihrem Webhoster prüfen, bevor er live geht.

Ein vereinfachtes Beispiel, wie das Ergebnis aussehen kann:

User-agent: GPTBot
Disallow: /

User-agent: ClaudeBot
Disallow: /

User-agent: Google-Extended
Disallow: /

User-agent: CCBot
Disallow: /

User-agent: *
Allow: /
MassnahmeWirkungGrenze
robots.txt mit KI-CrawlernSeriöse Crawler halten sich daranNicht alle Crawler respektieren sie
Vorbehalt im ImpressumKlare Erklärung gegenüber MenschenFür Programme schwer lesbar
Neuere Signale (z. B. Content-Signal)Feinere Steuerung nach ZweckNoch nicht überall unterstützt
Technische Sperre beim HosterBlockiert Zugriffe aktivKann auch erwünschte Besucher treffen

Worauf Sie achten müssen

  • EU: Die EU-Urheberrechtsrichtlinie erlaubt Text- und Data-Mining, also das automatische Auswerten von Inhalten, grundsätzlich auch zu kommerziellen Zwecken. Rechteinhaber können sich die Nutzung aber vorbehalten; bei online veröffentlichten Inhalten in maschinenlesbarer Form. Der EU AI Act verpflichtet Anbieter von Allzweck-KI-Modellen, solche Vorbehalte zu beachten.
  • Schweiz: Das Schweizer Urheberrechtsgesetz kennt eine Ausnahme für Text- und Data-Mining zu wissenschaftlichen Zwecken. Wie KI-Training sonst einzuordnen ist, ist Stand Oktober 2026 nicht abschliessend geklärt und politisch in Diskussion.
  • Keine technische Garantie: Die robots.txt ist eine Bitte, keine Sperre. Unseriöse Crawler ignorieren sie.
  • Sichtbarkeit: Sperren Sie nicht versehentlich Suchmaschinen oder KI-Suchdienste, über die Kundschaft Sie findet.
  • Fremde Inhalte: Ihr Vorbehalt betrifft nur Inhalte, an denen Sie die Rechte haben.
  • Lassen Sie im Einzelfall fachlich prüfen, wie Ihr Vorbehalt formuliert werden sollte.

Ein Beispiel aus der Praxis

Ein Beispiel: Eine Kräuterfachfrau im Appenzellerland hat auf ihrer Website über hundert ausführliche Pflanzenporträts veröffentlicht. Sie möchte nicht, dass diese Texte ohne Gegenleistung in KI-Modelle einfliessen, will aber weiterhin über Suchmaschinen gefunden werden.

Mit der Vorlage lässt sie eine robots.txt erstellen, die bekannte Trainings-Crawler ausschliesst und Suchmaschinen erlaubt. Ihr Webhoster spielt die Datei ein, und im Impressum ergänzt sie einen Satz zum Vorbehalt. Ein anschliessender Test zeigt, dass alles korrekt hinterlegt ist. Sie weiss nun genau, was sie erreicht hat – und was nicht.

So hilft Ihnen Alpasana

Die KI-Console bietet einen kostenlosen öffentlichen Live-Scan ohne Anmeldung. Er prüft unter anderem den Crawler-Zugriff, die robots.txt, die Sitemap und weitere Signale wie Content-Signal. Sie sehen einen Score, erkennbare Hindernisse und Verbesserungshinweise.

Mit verifizierten Websites und je nach Paket können Sie zudem nachvollziehen, welche erfassten Crawler Ihre Website tatsächlich besuchen. So prüfen Sie, ob Ihr Vorbehalt technisch korrekt hinterlegt ist und ob Sie gleichzeitig für KI-Suchen sichtbar bleiben. Eine rechtliche Beurteilung Ihres Vorbehalts ersetzt die KI-Console nicht.

Häufige Fragen

Verschwinde ich aus Google, wenn ich Google-Extended sperre?

Nach den Angaben von Google steuert Google-Extended die Nutzung für KI-Modelle und beeinflusst die Aufnahme in die Google-Suche nicht. Prüfen Sie die aktuelle Dokumentation, da sich Angaben ändern können.

Kann ich die Nutzung meiner Inhalte bereits trainierter Modelle verhindern?

Kaum. Ein Vorbehalt wirkt für künftiges Sammeln. Einige Anbieter bieten Formulare für Anliegen von Rechteinhabern; ob und wie sie wirken, ist unterschiedlich.

Brauche ich zusätzlich eine Datei wie llms.txt?

Eine llms.txt ist ein Vorschlag, KI-Systemen eine geordnete Übersicht über Ihre Inhalte zu geben. Sie dient eher der Sichtbarkeit als einem Widerspruch. Mehr zum Hintergrund erklärt Text- und Data-Mining und KI.

Erstellt mit KI-Unterstützung, redaktionell verantwortet von der Alpasana GmbH · 10.10.2026. Fehler entdeckt? Melden Sie es uns.

Hinweis: Dieser Beitrag gibt einen allgemeinen Überblick und ersetzt keine Rechtsberatung im Einzelfall. Massgeblich sind die geltenden Gesetzestexte.

Quellen

Weiterlesen in der Galaxie