KI-Crawler sperren: Website vor KI-Training schützen

2 Min. LesezeitStand 07.10.2026Mit KI erstellt · redaktionell geprüft

KI-Crawler sperren können Sie mit wenigen Zeilen in der robots.txt Ihrer Website. Viele Anbieter durchsuchen das Netz, um Trainingsdaten zu sammeln oder Antworten mit aktuellen Quellen zu belegen. Ob Sie das zulassen, ist eine Abwägung zwischen Schutz Ihrer Inhalte und Sichtbarkeit in KI-Antworten.

Die wichtigsten KI-Crawler

Name (User-Agent)AnbieterZweck
GPTBotOpenAITraining
OAI-SearchBotOpenAISuche in ChatGPT
ClaudeBotAnthropicTraining
Claude-SearchBotAnthropicSuche in Claude
Google-ExtendedGoogleSteuert die Nutzung für Gemini-Training, kein eigener Crawler
Applebot-ExtendedAppleSteuert die Nutzung für Apples KI-Training
PerplexityBotPerplexitySuche und Antworten
CCBotCommon CrawlOffenes Webarchiv, oft für Training genutzt
meta-externalagentMetaTraining

Die Liste ändert sich laufend; die Anbieter dokumentieren ihre Crawler auf ihren Websites.

So sieht die robots.txt aus

User-agent: GPTBot
Disallow: /

User-agent: ClaudeBot
Disallow: /

User-agent: Google-Extended
Disallow: /

User-agent: CCBot
Disallow: /

Damit verbieten Sie das Training, lassen aber normale Suchmaschinen wie den Googlebot weiter zu. Die Suchcrawler der KI-Anbieter (OAI-SearchBot, Claude-SearchBot) können Sie getrennt erlauben, wenn Sie in KI-Antworten als Quelle auftauchen wollen.

Was die Sperre rechtlich bewirkt

In Deutschland erlaubt § 44b des Urheberrechtsgesetzes das automatisierte Auswerten von Inhalten (Text und Data Mining), solange der Rechteinhaber nicht in maschinenlesbarer Form widersprochen hat. Ein Eintrag in der robots.txt gilt als ein solcher Vorbehalt; zusätzlich empfiehlt sich ein Hinweis im Impressum oder in den Nutzungsbedingungen. Mehr dazu in KI und Urheberrecht.

Grenzen

  • Die robots.txt ist eine Bitte, keine technische Sperre. Seriöse Anbieter halten sich daran, nicht alle tun es.
  • Bereits gesammelte Inhalte werden nicht nachträglich entfernt.
  • Wer zuverlässig sperren will, blockiert bekannte Crawler zusätzlich auf Server- oder CDN-Ebene. Anbieter wie Cloudflare bieten das als Einstellung an.

Sperren oder nicht?

Für Verlage und Anbieter exklusiver Inhalte ist das Sperren der Trainings-Crawler meist sinnvoll. Wer gefunden werden will, etwa Shops, Dienstleister oder Ratgeber-Seiten, profitiert dagegen davon, in KI-Antworten genannt zu werden. Ein häufiger Kompromiss: Training sperren, Such-Crawler erlauben.

Erstellt mit Unterstützung von KI, geprüft und redaktionell verantwortet von Leon Blatz. Allgemeine Information, keine Rechts-, Steuer- oder Finanzberatung.

KI-Kennzeichnung-GeneratorPassende Hinweise für KI-Texte, KI-Bilder und Chatbots erzeugen, mit Blick auf den EU AI Act.
Öffnen

Auch hilfreich: KI-Richtlinie-Generator

KI-News

Aktuelle News zum Thema

Alle Google & Gemini-News
  1. Gemini kostenlos nur noch mit Flash-Lite: Was sich am 9. Oktober ändert7. Oktober 2026 · Produkte
  2. Anhörung in New York: KI-Firmen geben keine Garantie für sichere Agenten6. Oktober 2026 · Sicherheit
  3. Reflection Beam: offenes Modell mit 501 Milliarden Parametern6. Oktober 2026 · Modelle
Weiterlesen

Weitere Artikel

  1. ChatGPT Datenschutz: Was Unternehmen beachten solltenChatGPT Datenschutz im Unternehmen: personenbezogene Daten, DSGVO, Auftragsverarbeitung, Trainingsnutzung und praktische Regeln für den Alltag. Ein Überblick.
  2. EU AI Act: Was die KI-Verordnung für Unternehmen bedeutetEU AI Act verständlich: Risikoklassen, neue Fristen nach dem Digital Omnibus, Pflichten für Anbieter und Betreiber, KI-Kompetenz und Kennzeichnung.
  3. KI-Kennzeichnungspflicht: Wann KI-Inhalte markiert werden müssenKI-Kennzeichnungspflicht nach EU AI Act: Wann Chatbots, Deepfakes, KI-Bilder und KI-Texte gekennzeichnet werden müssen und wie ein rechtssicherer Hinweis aussieht.