AgentGrade
EnglishEspañolDeutsch日本語中文
← Wissensdatenbank

Wie KI-Agenten wirklich im Web browsen

Das Problem mit den Annahmen

Die meiste Website-Optimierung geht davon aus, dass ein Besucher deine Seite per HTTP abruft, die Header sieht, Redirects folgt und HTML rendert. KI-Agenten brechen jede einzelne dieser Annahmen.

ChatGPT

ChatGPTs Browsing-Tool ruft Seiten live per HTTP ab, aber das Modell sieht nie die rohe Antwort:

Was das bedeutet: Content Negotiation funktioniert stillschweigend (die Tool-Schicht übernimmt sie), aber das Modell sieht nur den extrahierten Text. Liefere sauberen, strukturierten Text aus, und deine Inhalte werden für ChatGPT nützlicher.

Perplexity

Perplexity nutzt eine mehrstufige Retrieval-Pipeline:

Was das bedeutet: Deine robots.txt-Regeln für PerplexityBot stoppen deren Stealth-Crawler womöglich nicht. Strukturierte Inhalte mit klaren Überschriften helfen der Span-Extraktion, die richtigen Passagen zu finden.

Gemini

Geminis häufigster Browsing-Modus trifft deinen Server überhaupt nicht:

Was das bedeutet: Deine Website muss von Googlebot indexiert sein, damit Gemini sie sieht. Ein <link rel="alternate" href="/llms.txt"> in deinem HTML stellt sicher, dass Google die llms.txt-Beziehung indexiert. JSON-LD-strukturierte Daten überstehen die Indexierungspipeline ebenfalls.

Was du dagegen tun kannst

MaßnahmeHilft bei
llms.txt mit sauberem Markdown ausliefernChatGPT, Perplexity
<link rel="alternate" href="/llms.txt"> hinzufügenGemini (über den Google-Index)
JSON-LD-strukturierte Daten hinzufügenGemini (über den Google-Index)
Google-Extended in der robots.txt nicht blockierenGemini
RFC-9421-Signaturen zur Bot-Authentifizierung nutzenVerifikation im ChatGPT Agent Mode
Strukturierte Inhalte mit klaren Überschriften ausliefernPerplexitys Span-Extraktion

Mehr erfahren

Verwandte Themen

Die Crawler-Ebenen hinter den Assistenten

Jeder der Assistenten oben wird von mehreren eigenständigen Bots mit separaten robots.txt-Tokens gespeist: Training-Crawler (GPTBot, ClaudeBot), Suchindex-Crawler (OAI-SearchBot, Claude-SearchBot, PerplexityBot) und nutzerinitiierte Fetcher (ChatGPT-User, Claude-User, Perplexity-User) — und eine Ebene zu blockieren bewirkt nichts bei den anderen. Die User-Agent-Referenz für KI-Agenten dokumentiert für jeden Bot den exakten UA-String, das robots.txt-Verhalten und die IP-Verifikation; der robots.txt-Guide erklärt das Ebenen-Modell und liefert Copy-Paste-Muster zum Erlauben und Blockieren.