Statistik · KI-Crawler-Monitor

Wie viele deutsche Websites blocken KI-Crawler?

Tägliche robots.txt-Messung über die deutschen Top-1000-Websites: welche KI-Bots ausgesperrt werden, wie oft — und was die 20 größten Sites tun. Alle Zahlen kannst du frei zitieren.

Stand: 3. Juli 2026 · Panel: Deutschland (CrUX Top-1000), 891 Sites erreichbar

32,2 %der Top-Websites sperren GPTBot aus (robots.txt oder serverseitig)
14 / 20der 20 bekanntesten Sites blocken GPTBot
891Websites im täglichen Messpanel
12KI-Crawler werden beobachtet

Blockrate je KI-Crawler

Anteil der erreichbaren Panel-Sites, die den jeweiligen Bot effektiv aussperren (robots.txt inkl. serverseitiger Blocks, soweit gemessen):

CCBot · Common Crawl · Datensatz33,4 %
GPTBot · OpenAI · Training32,2 %
Bytespider · ByteDance · Training30,4 %
ClaudeBot · Anthropic · Training28,4 %
Google-Extended · Google · Gemini-Training26,3 %
meta-externalagent · Meta · Training26,2 %
Applebot-Extended · Apple · Training25,3 %
Amazonbot · Amazon · Assistent22,4 %
anthropic-ai · Anthropic · Training (alt)20,8 %
PerplexityBot · Perplexity · Suche20,3 %
ChatGPT-User · OpenAI · On-Demand16,4 %
OAI-SearchBot · OpenAI · Suche11,9 %

Methode & Einordnung

Gemessen wird täglich die robots.txt der deutschen Top-1000-Websites (CrUX-Panel); von 891 erreichbaren Sites werden die Regeln für 12 bekannte KI-Crawler ausgewertet. Eine Teilmenge wird zusätzlich auf serverseitige Blocks geprüft (z. B. 403 für Bot-User-Agents).

„Effektiv geblockt“ heißt: explizite robots.txt-Regel gegen den Bot oder ein nachgewiesener serverseitiger Block. Sites ohne Regel zählen als nicht geblockt — robots.txt ist zudem nur eine Bitte, kein technischer Zwang.

Beobachtet seit 3. Juli 2026. Die Seite wird mit jedem Site-Build aus der aktuellen Messung neu berechnet.