
30+ KI-SEO-Statistiken für 2026: Daten zu AI Overviews, ChatGPT & GEO
Cloudflare Radar: Anthropic crawlt 2.442 Seiten pro zurückgeschicktem Besucher, Google nur 5. Dazu SEOmators 48-Websites-Scan und 30+ KI-SEO-Statistiken.
Nur noch 46 % der AI-Crawler-Anfragen erhalten ein 200 OK, mehr als ein Viertel wird blockiert oder gedrosselt, und welcher Bot dominiert, kippt je nach Land komplett.

Als ich diese Daten vor sechs Monaten zum ersten Mal analysiert habe, beanspruchte Googlebot 38,7 % des gesamten AI-bezogenen Crawler-Traffics, und die Welt teilte sich säuberlich in zwei Lager. Diese Landkarte ist bereits neu gezeichnet. In den 28 Tagen bis zum 23. Juli 2026 zeigt Cloudflare Radar, dass Googlebot auf 24,4 % gefallen ist, ClaudeBot auf Platz 2 mit 17,9 % aufgestiegen ist und die ordentliche geografische Geschichte in drei Muster zerbrochen ist statt in zwei -- wobei ByteDances Bytespider inzwischen einen ganzen wichtigen Markt anführt. Ebenso auffällig: Nur 46 % der AI-Crawler-Anfragen werden mit einem 200 OK beantwortet. Mehr als ein Viertel trifft auf ein 403 Forbidden oder ein 429 Too Many Requests. Das Web hat begonnen sich zu wehren -- und tut das je nach Standort des Publikums mit sehr unterschiedlicher Intensität.
Ich habe die vollständige Analyse über 11 Länder hinweg erneut durchgeführt -- nach User-Agent, Crawl-Zweck, Content-Typ, HTTP-Antwort und robots.txt-Direktiven -- um zu sehen, wie die AI-Crawler-Landschaft Mitte 2026 genau aussieht und wie sie sich seit Februar verschoben hat.
Googlebot führt weltweit weiterhin den gesamten AI-bezogenen Crawler-Traffic an, doch sein Vorsprung ist auf 24,4 % geschrumpft -- fast 14 Prozentpunkte weniger als die 38,7 %, die ich im Februar gemessen habe. ClaudeBot ist auf Platz 2 mit 17,9 % vorgestoßen, und wenn man Anthropics zwei Crawler zusammenfasst (ClaudeBot plus Claude-SearchBot mit 3,5 %), rivalisiert Anthropics kombinierter Anteil von 21,4 % inzwischen mit Googles gesamter Präsenz. Das geht aus Cloudflare Radar hervor (ai/bots/summary/user_agent) und deckt Websites ab, die durch Cloudflares Netzwerk von 330+ Städten in 125+ Ländern geschützt sind.
| AI-Bot | Globaler Anteil (%) | Betreiber | Hauptzweck |
|---|---|---|---|
| Googlebot | 24.4% | Suchindexierung + AI-Training (gemischt) | |
| ClaudeBot | 17.9% | Anthropic | Modelltraining |
| Meta-ExternalAgent | 11.8% | Meta | AI-Training |
| GPTBot | 9.7% | OpenAI | Modelltraining |
| Bingbot | 8.8% | Microsoft | Suchindexierung + AI (gemischt) |
| Bytespider | 6.3% | ByteDance | AI-Training |
| Applebot | 6.2% | Apple | Suche + AI-Funktionen |
| Amazonbot | 6.0% | Amazon | AI-Training |
| Claude-SearchBot | 3.5% | Anthropic | Claude-Websuche |
Die vier führenden Crawler machen jetzt 63,8 % der identifizierten AI-Bot-Anfragen aus -- ein weniger konzentrierter Markt als die 74,3 % vom Februar, weil die Verfolger gewachsen sind, während Google schrumpfte. Die mit Abstand größte Geschichte ist Anthropic: ClaudeBot rückte in sechs Monaten von Platz 4 (11,4 %) auf einen klaren zweiten Platz (17,9 %) vor, und Anthropic hat einen eigenen Such-Crawler (Claude-SearchBot) gestartet, der allein bereits einen globalen Anteil von 3,5 % erreicht.
Im Februar beschrieb dieser Abschnitt eine klare Zweiteilung -- einen "Googlebot-Gürtel" gegenüber einem "ChatGPT-Korridor". Diese Einordnung übersteht den Kontakt mit den Daten nicht mehr. Brasilien und Japan sind ins Googlebot-Lager gewechselt, Australiens ChatGPT-Dominanz hat sich mehr als halbiert, und ein wirklich neues Muster ist aufgetaucht: Bytespider führt jetzt Indien an. Es gibt inzwischen drei Muster, nicht zwei.
| Land | #1-Bot | Anteil #1 | #2-Bot | Anteil #2 | Training % | Nutzeraktion % |
|---|---|---|---|---|---|---|
| Brasilien | Googlebot | 50.8% | ChatGPT-User | 25.5% | 12.0% | 27.3% |
| Deutschland | Googlebot | 42.8% | Bytespider | 10.7% | 27.4% | 12.0% |
| Kanada | Googlebot | 42.5% | Bytespider | 23.5% | 35.3% | 2.0% |
| Frankreich | Googlebot | 36.6% | Meta-ExternalAgent | 10.5% | 33.2% | 3.4% |
| Vereinigtes Königreich | Googlebot | 30.4% | ChatGPT-User | 9.3% | 31.2% | 11.9% |
| Vereinigte Staaten | Googlebot | 25.6% | ClaudeBot | 19.8% | 44.4% | 1.0% |
| Japan | Googlebot | 23.6% | ChatGPT-User | 23.5% | 24.4% | 29.1% |
| Niederlande | Googlebot | 23.3% | Meta-ExternalAgent | 12.2% | 38.5% | 5.8% |
| Südkorea | ChatGPT-User | 27.3% | Googlebot | 25.5% | 14.6% | 30.8% |
| Australien | ChatGPT-User | 36.5% | Googlebot | 21.1% | 22.4% | 40.7% |
| Indien | Bytespider | 29.6% | Googlebot | 21.1% | 41.6% | 16.5% |
Googlebot hält in acht der elf analysierten Länder die Position Nr. 1. Brasilien ist jetzt der Googlebot-lastigste Markt mit 50,8 % -- eine komplette Umkehr gegenüber Februar, als ChatGPT-User Brasilien mit 57,6 % anführte. Deutschland (42,8 %) und Kanada (42,5 %) runden die Spitze des Gürtels ab. Die Vereinigten Staaten, einst mit 40,3 % solides Googlebot-Territorium, sind auf 25,6 % gefallen, während ClaudeBot auf einen sehr knappen zweiten Platz mit 19,8 % geklettert ist -- das heißt, in den USA ist Anthropics Crawler inzwischen fast so aktiv wie der von Google.
Australien und Südkorea bleiben die beiden Länder, in denen ChatGPT-User -- der Bot, der Seiten besucht, wenn echte Nutzer ChatGPT Fragen stellen -- der dominierende Crawler ist. Doch die Intensität ist deutlich abgekühlt. Australiens ChatGPT-User-Anteil fiel von erstaunlichen 75,8 % im Februar auf 36,5 % heute, und sein Crawl-Zweck "Nutzeraktion" sank von 76,0 % auf 40,7 %. Es ist immer noch der nutzergetriebenste AI-Crawler-Markt der Welt, aber kein Beinahe-Monopol mehr. Japan ist jetzt ein Fotofinish: Googlebot 23,6 % gegenüber ChatGPT-User 23,5 %, mit dem höchsten Nutzeraktions-Anteil aller Googlebot-geführten Märkte (29,1 %).
Das klarste neue Signal in den Daten ist, dass ByteDances Bytespider Indien mit 29,6 % anführt -- vor Googlebots 21,1 %. Bytespider ist außerdem der Crawler Nr. 2 in Kanada (23,5 %) und Deutschland (10,7 %). Das ist ein trainingsorientiertes Muster: Indiens Crawl-Aktivität besteht zu 41,6 % aus "Training" -- der höchste Wert aller betrachteten Länder außerhalb der USA. Wo ChatGPT-User-Traffic die Endnutzernachfrage nach AI-Antworten signalisiert, signalisiert ein Bytespider-Anstieg die massenhafte Datensammlung fürs Modelltraining -- eine andere Belastung für Ihre Infrastruktur, und eine, die überhaupt keinen Referral-Traffic zurückbringt.
Das Zwei-Lager-Modell vom Februar zerbrach, weil sich der AI-Crawler-Markt noch immer formt. Drei Kräfte sind in den Länderdaten sichtbar am Werk:
Eine Aufschlüsselung, die Cloudflare Radar offenlegt, die aber kaum eine Analyse nutzt, ist der Content-Typ (ai/bots/summary/content_type) -- die MIME-Kategorie dessen, was AI-Crawler anfordern. Weltweit rufen AI-Bots überwiegend gerenderte Seiten ab, doch das Nicht-HTML-Segment ist der Ort, an dem sich das interessante Verhalten verbirgt.
| Content-Typ | Anteil an AI-Bot-Anfragen |
|---|---|
| HTML | 72.8% |
| JSON | 7.0% |
| JavaScript | 5.6% |
| Bilder | 5.3% |
| Klartext | 5.2% |
| XML | 1.7% |
| CSS | 1.4% |
Fast drei Viertel der AI-Crawler-Anfragen gelten HTML -- der lesbaren Seite. Aber 7,0 % sind JSON und 5,2 % sind Klartext, und zusammen sagen Ihnen diese über 12 %, dass AI-Crawler zunehmend strukturierte und rohe Daten abrufen, nicht nur Fließtext: API-Antworten, JSON-LD-Payloads, Sitemaps und die Klartext-Dateien (llms.txt, robots.txt, Feeds), die Agenten direkt parsen. Wenn AI-Systeme Ihre Fakten sauber konsumieren sollen, statt aus gerendertem HTML zu raten, zählt eine maschinenlesbare Oberfläche -- unser kostenloser llms.txt-Generator erstellt eine, die diese Crawler lesen können, ohne Ihr JavaScript auszuführen.
Hier ist der Befund, der die gesamte Debatte "Soll ich AI-Bots blockieren?" neu rahmt. Cloudflare Radars Aufschlüsselung nach Antwortstatus (bots/crawlers/summary/response_status) zeigt die HTTP-Statuscodes, die Crawler tatsächlich erhalten -- und Websites sagen bereits Nein, und zwar im großen Stil.
| HTTP-Antwort | Anteil an AI-Bot-Anfragen | Bedeutung |
|---|---|---|
| 200 OK | 46.0% | Erfolgreich ausgeliefert |
| 403 Forbidden | 20.7% | Zugriff verweigert (blockiert) |
| 301 Moved | 8.1% | Permanente Weiterleitung |
| 404 Not Found | 7.8% | Fehlende Seite |
| 429 Too Many Requests | 6.0% | Rate-limitiert (gedrosselt) |
| 302 Found | 4.6% | Temporäre Weiterleitung |
| 204 No Content | 1.6% | Leerer Erfolg |
| 503 Unavailable | 1.3% | Server überlastet / blockiert |
| 304 Not Modified | 1.2% | Zwischengespeichert, unverändert |
Nur 46 % der AI-Crawler-Anfragen erhalten ein sauberes 200. Kombinierte 26,7 % werden aktiv abgelehnt oder gedrosselt (20,7 % 403 + 6,0 % 429), und weitere 1,3 % treffen auf ein 503. Mit anderen Worten: Etwa jede vierte AI-Crawler-Anfrage wird bereits von den anvisierten Seiten abgewiesen -- durch WAF-Regeln, Bot-Management-Produkte oder Origin-Rate-Limits. Das Narrativ "AI scrapt alles ungehindert" ist überholt; ein großer und wachsender Teil des Webs verweigert diese Bots standardmäßig. Das bedeutet auch, dass AI-Antwortmaschinen zunehmend aus unvollständigen Crawls arbeiten -- wenn Ihre Wettbewerber blockieren und Sie nicht, sind es Ihre Seiten, die zitiert werden.
Wenn Antwortcodes zeigen, wie Seiten in Echtzeit reagieren, zeigt robots.txt ihre erklärte Absicht. Cloudflare Radar parst robots.txt-Dateien über seine Domain-Population hinweg und rankt die User-Agents, die diese Dateien am häufigsten nennen (robots_txt/top/user_agents/directive). Die Liste ist ein nahezu perfektes Ranking von AI-Crawlern -- ein direktes Signal dafür, für welche Bots Website-Betreiber bewusst Regeln schreiben.
| User-Agent | Domains, die ihn in robots.txt nennen | Betreiber |
|---|---|---|
| GPTBot | 743 | OpenAI |
| ClaudeBot | 656 | Anthropic |
| Google-Extended | 626 | Google (AI-Training-Opt-out) |
| CCBot | 603 | Common Crawl |
| Bytespider | 523 | ByteDance |
| meta-externalagent | 465 | Meta |
| PerplexityBot | 448 | Perplexity |
| Amazonbot | 446 | Amazon |
| Applebot-Extended | 442 | Apple (AI-Training-Opt-out) |
| Googlebot | 416 |
Dies sind Zahlen von Domains, die jeden Agenten in einer Direktive nennen (eine Momentaufnahme eines Tages), keine Traffic-Anteile -- eine Regel kann erlauben oder einschränken, und das Ranking zählt beides.
Der auffällige Teil ist, wer die Liste anführt. GPTBot (743) und ClaudeBot (656) werden in mehr robots.txt-Dateien genannt als Googlebot selbst (416) -- der klassische Such-Crawler, den es seit zwei Jahrzehnten gibt. Website-Betreiber schreiben gezielt Regeln für die AI-Trainings-Crawler, und die Präsenz von Google-Extended (626) und Applebot-Extended (442) -- den Opt-out-Tokens, die Google und Apple speziell dafür geschaffen haben, dass Publisher AI-Training ablehnen und gleichzeitig die Suchindexierung behalten können -- bestätigt, dass dies ein bewusster Governance-Aufwand ist, keine beiläufige Konfiguration.
Ein Vorbehalt, der dies umsetzbar macht: Eine robots.txt-Direktive funktioniert nur, wenn sie syntaktisch gültig ist und das richtige Token adressiert. GPTBot und ClaudeBot beachten robots.txt; die Konformität von Bytespider ist uneinheitlich. Was auch immer Sie erlauben oder blockieren wollen -- überprüfen Sie anschließend Ihre robots.txt-Datei, denn eine fehlerhafte Regel scheitert offen, und Sie werden glauben, einen Crawler zu blockieren, der geradewegs hindurchspaziert.
Laut Cloudflare Radar (bots/crawlers/summary/vertical) bleibt Shopping und E-Commerce die am stärksten gecrawlte Vertikale, doch ihre Dominanz hat nachgelassen, während sich AI-Crawler über andere Vertikalen verteilt haben.
| Branchenvertikale | Anteil am AI-Bot-Traffic |
|---|---|
| Shopping und allgemeine Waren | 26.2% |
| Internet und Telekommunikation | 20.6% |
| Computer und Elektronik | 18.9% |
| Nachrichten, Medien und Publikationen | 9.1% |
| Glücksspiel | 6.7% |
| Wirtschaft und Industrie | 3.6% |
| Professionelle Dienstleistungen | 2.7% |
| Finanzen | 2.5% |
| Spiele | 2.3% |
Der Einzelhandel liegt mit 26,2 % (gegenüber 31,2 % im Februar) weiterhin vorn, was dazu passt, wie stark AI-Modelle für Produktrecherche und Preisvergleiche genutzt werden -- wenn ein Nutzer einen Assistenten fragt "Was ist der beste Laufschuh unter 150 €", braucht der Bot aktuelle Produktseiten und Bewertungen, um zu antworten. Doch beachten Sie den Aufstieg von Internet/Telekommunikation (20,6 %) und Computer/Elektronik (18,9 %): Technische Dokumentation und Produktspezifikationen sind erstklassiges Trainings- und Abrufmaterial, und diese Vertikalen werden inzwischen fast so stark gecrawlt wie der Einzelhandel.
Cloudflare Radar klassifiziert die AI-Bot-Aktivität nach Zweckkategorien (ai/bots/summary/crawl_purpose). Die globale Aufteilung hat sich seit Februar entschieden in Richtung Training verschoben:
Die Aufteilung auf Länderebene bleibt scharf. In den Vereinigten Staaten sind 86,4 % der AI-Bot-Aktivität Training oder Gemischter Zweck -- US-Websites sind in erster Linie Rohmaterial für den Modellbau. In Australien sind 40,7 % der Aktivität Nutzeraktion -- der Großteil des Crawls wird von echten Menschen ausgelöst, die AI um Antworten bitten.
Das Volumen der AI-Crawler-Anfragen ist im ersten Halbjahr 2026 stetig gestiegen. Das folgende Diagramm verfolgt Cloudflare Radars AI-Bot-Traffic-Index über die zurückliegenden 24 Wochen:
Quelle: Cloudflare Radar ai/bots/timeseries (normalisierter Index, Höchstwert = 1,0). Der Index stieg von 0,78 Anfang Februar auf 0,95 Ende Juli 2026 -- ein Zuwachs des AI-Crawler-Volumens von rund 21 % in sechs Monaten.
Zoomt man in den letzten Monat, verschob sich die Zusammensetzung weiter, während das Gesamtvolumen wuchs. Vergleich des aktuellen 28-Tage-Fensters (25. Juni – 23. Juli 2026) mit den vorherigen 28 Tagen (28. Mai – 25. Juni):
| AI-Bot | Anteil vorherige 28 T | Anteil aktuelle 28 T | Veränderung |
|---|---|---|---|
| Googlebot | 25.9% | 24.4% | -1.5 pp |
| ClaudeBot | 18.2% | 17.9% | -0.3 pp |
| Meta-ExternalAgent | 10.5% | 11.8% | +1.3 pp |
| GPTBot | 9.4% | 9.7% | +0.3 pp |
| Bingbot | 7.8% | 8.8% | +1.0 pp |
| Bytespider | 8.0% | 6.3% | -1.7 pp |
| Amazonbot | 5.3% | 6.0% | +0.7 pp |
| Claude-SearchBot | 3.1% | 3.5% | +0.4 pp |
Meta-ExternalAgent (+1,3 pp) und Bingbot (+1,0 pp) waren die größten Gewinner des Monats. Bytespider fiel im letzten Monat global um 1,7 pp, obwohl es Indien dominiert -- eine Erinnerung daran, dass ein Crawler in der Summe verblassen und zugleich in einem einzelnen Markt zulegen kann. Für die schärfere Sechs-Monats-Sicht lautet die Schlagzeile Anthropic: ClaudeBot verdoppelte zwischen Februar und Juli in etwa seinen Anteil am AI-Crawler-Markt.
Die Blockierentscheidung hängt letztlich an einer einzigen Zahl: wie viele Seiten ein Bot nimmt für jeden Besucher, den er zurückschickt. Unsere Analyse des Crawl-zu-Referral-Verhältnisses rankt jeden großen Betreiber genau danach -- eine Spanne über vier Größenordnungen, von DuckDuckGos Beinahe-Parität bis zu Anthropics einseitigem Extrem. Mit diesem Verhältnis in der Hand richten Sie Ihre Reaktion nach Ihrem Markt aus:
Wenn Ihr Publikum in den USA, Kanada oder Westeuropa sitzt:
Wenn Ihr Publikum in Australien, Südkorea oder Japan sitzt:
Wenn Ihr Publikum in Indien oder anderen trainingslastigen Märkten sitzt:
Für alle -- rechnen Sie damit, abgewiesen zu werden, und planen Sie dafür:
Diese Analyse nutzt AI-Bot-Daten von Cloudflare Radar, die direkt über die Radar-REST-API abgerufen wurden. Das primäre Fenster umfasst die 28 Tage vom 25. Juni bis 23. Juli 2026; der Vergleich von Monat zu Monat verwendet das vorangehende 28-tägige Kontrollfenster (28. Mai – 25. Juni 2026), und das Trenddiagramm verwendet die zurückliegenden 24 Wochen. Die zum Vergleich genannten Februar-2026-Zahlen stammen aus meiner ursprünglichen Analyse desselben Datensatzes.
Abgefragte Endpoints: ai/bots/summary/user_agent, ai/bots/summary/crawl_purpose und ai/bots/summary/content_type für globale und länderspezifische Aufschlüsselungen; bots/crawlers/summary/vertical und bots/crawlers/summary/response_status für Branchen- und HTTP-Status-Daten; robots_txt/top/user_agents/directive für die robots.txt-Governance-Momentaufnahme; und ai/bots/timeseries für den Trendindex. Die Länderaufschlüsselungen decken 11 Märkte ab: Vereinigte Staaten, Vereinigtes Königreich, Deutschland, Frankreich, Niederlande, Kanada, Japan, Australien, Südkorea, Indien und Brasilien.
Alle Prozentangaben stehen für den Anteil an den identifizierten AI-Bot-Anfragen, nicht für den Anteil am gesamten Web-Traffic, sofern nicht anders vermerkt: Die robots.txt-Zahlen sind Domain-Zählungen (eine Momentaufnahme), und die Trendlinie ist ein normalisierter Index (Höchstwert = 1,0), keine absolute Anfragezahl. Der Standortfilter entspricht dem Abrechnungsland des Cloudflare-Kunden, dessen Site den Traffic erhalten hat, aggregiert über Cloudflares globales Netzwerk von 330+ Städten in 125+ Ländern. Werte verschieben sich täglich; führen Sie die Abfragen erneut aus, bevor Sie sie zitieren.
Datenquelle: Cloudflare Radar -- radar/ai/bots/*-, radar/bots/crawlers/*- und radar/robots_txt/*-Endpoints (radar.cloudflare.com), 28 Tage bis zum 23. Juli 2026. Zuletzt aktualisiert: 24. Juli 2026.

Cloudflare Radar: Anthropic crawlt 2.442 Seiten pro zurückgeschicktem Besucher, Google nur 5. Dazu SEOmators 48-Websites-Scan und 30+ KI-SEO-Statistiken.

Mistral crawlt 3.389 Seiten für jeden Referral, den es zurückschickt – jetzt der extraktivste AI Bot im Web, vor Anthropic (2.237:1) und OpenAI (217:1). Ich habe Cloudflare Radars globales Netzwerk gegen SEOmators eigenes Panel aus 500+ Seiten abgeglichen, um das Crawl-to-Refer-Verhältnis für Juli 2026 neu aufzubauen.

50+ ChatGPT-Prompts für Keyword-Recherche, Content-Optimierung und Konkurrenzanalyse — sortiert nach der Aufgabe, die jeder wirklich gut erledigt, samt den Ausgaben, die Sie vor dem Handeln prüfen müssen.