Wie widerspreche ich KI-Training mit meinen Website-Inhalten?
Kurz gesagt
Erklären Sie Ihren Vorbehalt doppelt: maschinenlesbar in der Datei robots.txt für bekannte KI-Crawler und in Worten im Impressum oder in den Nutzungsbedingungen. Wägen Sie vorher ab, ob Sie damit auch in KI-Suchen weniger sichtbar werden möchten. Einen vollständigen Schutz bietet keine Methode, weil sich nicht alle Crawler an solche Angaben halten.
Das Problem
Sie haben über Jahre Texte, Anleitungen und Fotos für Ihre Website erstellt. Nun lesen Sie, dass KI-Firmen öffentlich zugängliche Websites automatisch durchsuchen, um ihre Modelle zu trainieren. Diese Suchprogramme heissen Crawler. Sie fragen sich: Kann ich das verhindern oder zumindest klar machen, dass ich es nicht will?
Das Thema ist rechtlich und technisch zugleich. Rechtlich geht es um das Urheberrecht und darum, ob Sie einen Vorbehalt erklärt haben. Technisch geht es darum, wie Crawler diesen Vorbehalt erkennen. Ein Satz im Impressum allein liest kaum ein Programm.
Gleichzeitig gibt es einen Zielkonflikt: Wer KI-Crawler aussperrt, wird unter Umständen auch in KI-Suchdiensten weniger gefunden. Diese Abwägung sollten Sie bewusst treffen.
So lösen Sie es mit KI – Schritt für Schritt
- Klären Sie Ihr Ziel. Wollen Sie KI-Training ausschliessen, aber in Suchmaschinen und KI-Suchen sichtbar bleiben? Oder möchten Sie gar nicht von KI-Diensten gelesen werden? Schreiben Sie Ihr Ziel in einem Satz auf.
- Finden Sie Ihre robots.txt. Die Datei robots.txt liegt im Hauptverzeichnis Ihrer Website, zum Beispiel unter «ihre-domain.ch/robots.txt». Sie enthält Anweisungen für Crawler. Öffnen Sie die Adresse im Browser und schauen Sie, was dort bereits steht. Hintergründe zur Rechtswirkung finden Sie unter robots.txt und Urheberrecht.
- Wählen Sie die Crawler aus. Mehrere Anbieter dokumentieren eigene Kennungen für das Sammeln von Trainingsdaten. Beispiele sind GPTBot (OpenAI), ClaudeBot (Anthropic), Google-Extended (Google, steuert die Nutzung für KI-Modelle, nicht die normale Google-Suche), Applebot-Extended (Apple) und CCBot (Common Crawl). Prüfen Sie die aktuellen Angaben in der Dokumentation der Anbieter.
- Ergänzen Sie die robots.txt. Lassen Sie sich mit der Vorlage unten einen Vorschlag erstellen. Ihr Webhoster oder Ihre Webagentur kann die Datei anpassen. Bei vielen Baukastensystemen gibt es dafür ein Einstellungsfeld.
- Formulieren Sie einen Vorbehalt in Worten. Ergänzen Sie im Impressum oder in den Nutzungsbedingungen einen kurzen Satz, etwa: «Die Inhalte dieser Website dürfen nicht für das Training von KI-Modellen verwendet werden. Dieser Vorbehalt ist zusätzlich maschinenlesbar in unserer robots.txt hinterlegt.»
- Prüfen Sie neuere Signale. Es gibt weitere Vorschläge für maschinenlesbare Vorbehalte, etwa sogenannte Content-Signale in der robots.txt oder das TDM-Reservation-Protokoll. Sie sind noch nicht überall verbreitet, können aber ergänzend sinnvoll sein.
- Kontrollieren Sie das Ergebnis. Rufen Sie die robots.txt erneut auf und prüfen Sie, ob die Einträge korrekt sind. Testen Sie danach mit einem Prüfwerkzeug, ob die gewünschten Crawler gesperrt und Suchmaschinen weiterhin zugelassen sind.
- Wiederholen Sie die Kontrolle. Neue Crawler kommen hinzu, Kennungen ändern sich. Planen Sie eine Überprüfung zweimal pro Jahr.
Vorlage zum Kopieren
Erstelle eine robots.txt für meine Website [Domain].
Ziel: [z. B. KI-Training ausschliessen, aber in Google-Suche und KI-Suchdiensten sichtbar bleiben]
Bestehende Einträge in meiner robots.txt: [Inhalt einfügen oder «keine»]
Bereiche, die ganz gesperrt bleiben sollen: [z. B. /intern/]
Erkläre jede Zeile in einfachem Deutsch.
Nenne nur Crawler-Kennungen, die du sicher kennst, und schreibe dazu, in welcher Anbieter-Dokumentation ich sie überprüfen soll.
Weise mich darauf hin, wenn eine Zeile auch die normale Suchmaschinen-Sichtbarkeit beeinträchtigen könnte.Setzen Sie Domain und Ziel ein und lassen Sie den Vorschlag von Ihrem Webhoster prüfen, bevor er live geht.
Ein vereinfachtes Beispiel, wie das Ergebnis aussehen kann:
User-agent: GPTBot
Disallow: /
User-agent: ClaudeBot
Disallow: /
User-agent: Google-Extended
Disallow: /
User-agent: CCBot
Disallow: /
User-agent: *
Allow: /| Massnahme | Wirkung | Grenze |
|---|---|---|
| robots.txt mit KI-Crawlern | Seriöse Crawler halten sich daran | Nicht alle Crawler respektieren sie |
| Vorbehalt im Impressum | Klare Erklärung gegenüber Menschen | Für Programme schwer lesbar |
| Neuere Signale (z. B. Content-Signal) | Feinere Steuerung nach Zweck | Noch nicht überall unterstützt |
| Technische Sperre beim Hoster | Blockiert Zugriffe aktiv | Kann auch erwünschte Besucher treffen |
Worauf Sie achten müssen
- EU: Die EU-Urheberrechtsrichtlinie erlaubt Text- und Data-Mining, also das automatische Auswerten von Inhalten, grundsätzlich auch zu kommerziellen Zwecken. Rechteinhaber können sich die Nutzung aber vorbehalten; bei online veröffentlichten Inhalten in maschinenlesbarer Form. Der EU AI Act verpflichtet Anbieter von Allzweck-KI-Modellen, solche Vorbehalte zu beachten.
- Schweiz: Das Schweizer Urheberrechtsgesetz kennt eine Ausnahme für Text- und Data-Mining zu wissenschaftlichen Zwecken. Wie KI-Training sonst einzuordnen ist, ist Stand Oktober 2026 nicht abschliessend geklärt und politisch in Diskussion.
- Keine technische Garantie: Die robots.txt ist eine Bitte, keine Sperre. Unseriöse Crawler ignorieren sie.
- Sichtbarkeit: Sperren Sie nicht versehentlich Suchmaschinen oder KI-Suchdienste, über die Kundschaft Sie findet.
- Fremde Inhalte: Ihr Vorbehalt betrifft nur Inhalte, an denen Sie die Rechte haben.
- Lassen Sie im Einzelfall fachlich prüfen, wie Ihr Vorbehalt formuliert werden sollte.
Ein Beispiel aus der Praxis
Ein Beispiel: Eine Kräuterfachfrau im Appenzellerland hat auf ihrer Website über hundert ausführliche Pflanzenporträts veröffentlicht. Sie möchte nicht, dass diese Texte ohne Gegenleistung in KI-Modelle einfliessen, will aber weiterhin über Suchmaschinen gefunden werden.
Mit der Vorlage lässt sie eine robots.txt erstellen, die bekannte Trainings-Crawler ausschliesst und Suchmaschinen erlaubt. Ihr Webhoster spielt die Datei ein, und im Impressum ergänzt sie einen Satz zum Vorbehalt. Ein anschliessender Test zeigt, dass alles korrekt hinterlegt ist. Sie weiss nun genau, was sie erreicht hat – und was nicht.
So hilft Ihnen Alpasana
Die KI-Console bietet einen kostenlosen öffentlichen Live-Scan ohne Anmeldung. Er prüft unter anderem den Crawler-Zugriff, die robots.txt, die Sitemap und weitere Signale wie Content-Signal. Sie sehen einen Score, erkennbare Hindernisse und Verbesserungshinweise.
Mit verifizierten Websites und je nach Paket können Sie zudem nachvollziehen, welche erfassten Crawler Ihre Website tatsächlich besuchen. So prüfen Sie, ob Ihr Vorbehalt technisch korrekt hinterlegt ist und ob Sie gleichzeitig für KI-Suchen sichtbar bleiben. Eine rechtliche Beurteilung Ihres Vorbehalts ersetzt die KI-Console nicht.
Häufige Fragen
Verschwinde ich aus Google, wenn ich Google-Extended sperre?
Nach den Angaben von Google steuert Google-Extended die Nutzung für KI-Modelle und beeinflusst die Aufnahme in die Google-Suche nicht. Prüfen Sie die aktuelle Dokumentation, da sich Angaben ändern können.
Kann ich die Nutzung meiner Inhalte bereits trainierter Modelle verhindern?
Kaum. Ein Vorbehalt wirkt für künftiges Sammeln. Einige Anbieter bieten Formulare für Anliegen von Rechteinhabern; ob und wie sie wirken, ist unterschiedlich.
Brauche ich zusätzlich eine Datei wie llms.txt?
Eine llms.txt ist ein Vorschlag, KI-Systemen eine geordnete Übersicht über Ihre Inhalte zu geben. Sie dient eher der Sichtbarkeit als einem Widerspruch. Mehr zum Hintergrund erklärt Text- und Data-Mining und KI.
Erstellt mit KI-Unterstützung, redaktionell verantwortet von der Alpasana GmbH · 10.10.2026. Fehler entdeckt? Melden Sie es uns.
Hinweis: Dieser Beitrag gibt einen allgemeinen Überblick und ersetzt keine Rechtsberatung im Einzelfall. Massgeblich sind die geltenden Gesetzestexte.
Quellen
Weiterlesen in der Galaxie
- Schützt eine robots.txt meine Inhalte vor KI-Nutzung?robots.txt KI Urheberrecht: Was die Sperre für KI-Crawler bewirkt, wo sie rechtlich und technisch an Grenzen stösst und was Sie zusätzlich tun können.
- Was bedeutet Text und Data Mining für KI und Urheberrecht?Text und Data Mining KI: Was das automatische Auswerten grosser Inhaltsmengen heisst, wann es erlaubt sein kann und was ein Nutzungsvorbehalt bewirkt.
- Dürfen wir KI mit unseren Firmeninhalten trainieren?KI Training eigene Inhalte: Mit einer Checkliste klären Sie, ob Ihnen an Texten, Bildern und Daten die nötigen Rechte für ein KI-Training oder Fine-Tuning zustehen.
- Darf eine KI-Suche Ausschnitte unserer Website anzeigen?KI Suche Urheberrecht: Wenn Inhalte Ihrer Website in KI-Antworten auftauchen, was rechtlich unklar ist, wie Sie es prüfen und mit robots.txt und Nachweisen steuern.
- KI-Urheberrecht: Was unterscheidet die Schweiz und die EU?KI Urheberrecht Schweiz EU im Vergleich: Schutz von KI-Ergebnissen, Training mit fremden Werken und Anbieterpflichten, mit Hinweisen für Betriebe.