Start / Magazin / GEO & KI-Suche
llms.txt: Google ignoriert sie, Coding-Agents lesen sie
ArtikelGEO & KI-Suche22.06.2025Alles auf einen Blick
- Google schreibt wörtlich: „Doing so will neither harm nor help your site's visibility or rankings in Google Search, as Google Search ignores them.“ Stand: 10.07.2026.
- Ahrefs hat 137.210 Domains ausgewertet: 28 Prozent haben eine llms.txt, 97 Prozent dieser Dateien bekamen im Mai 2026 keinen einzigen Abruf.
- EZY Research, 83 Websites, zwölf Wochen: OpenAI holte die llms.txt 7 Mal und die robots.txt 3.990 Mal, PerplexityBot holte sie null Mal.
- Dass OpenAI, Anthropic und Google für ihre eigene Entwicklerdoku eine llms.txt veröffentlichen, heißt nicht, dass ihre Crawler deine lesen.
- Gelesen wird die Datei von Coding-Agents: In der Ahrefs-Messung lag Claude Code vor jedem KI-Suchbot.
- Für KI-Sichtbarkeit zählt anderes: robots.txt, indexiert und snippet-fähig sein, der Schalter in der Search Console.
Inhaltsverzeichnis8 Abschnitte
Diese Frage stand hier seit 2025 im Titel, und sie war damals ehrlich offen. Inzwischen ist sie beantwortet, nicht mit Meinung, sondern mit Belegen: Google schreibt in seiner Dokumentation, dass die Suche llms.txt ignoriert. Zwei unabhängige Auswertungen von Server-Logs zeigen, dass die KI-Suchsysteme die Datei praktisch nicht abrufen.
Trotzdem ist llms.txt kein Unsinn. Sie hat eine nachgewiesene Zielgruppe, nur eine andere als die, für die sie verkauft wird. Hier bekommst du die Beweislage in drei Strängen, die Unterscheidung, die in der Branche ständig schiefgeht, und die Frage, was stattdessen zählt. Stand: September 2026.
Was llms.txt ist und was sie nicht ist
llms.txt ist eine Markdown-Datei im Root einer Website, die in wenigen Zeilen erklärt, worum es geht und wo die wichtigsten Inhalte stehen. Vorgeschlagen hat sie Jeremy Howard, Mitgründer von Answer.AI und fast.ai, am 3. September 2024. Version 2 der Spezifikation ist vom 10. August 2026.
Die Idee dahinter ist gut begründet. Eine HTML-Seite verpackt ihre Information in Navigation, Werbung und JavaScript. Ein Agent, der daraus sauberen Text machen will, verbrennt Tokens und Zeit. Eine kuratierte Markdown-Übersicht spart beides: Der Agent liest sie, orientiert sich und folgt gezielt den Links.
Wichtig ist, was llms.txt nicht ist: keine Steuerdatei. Sie sperrt nichts, erlaubt nichts, blockiert nichts. Der Dateiname erinnert an robots.txt, die Funktion hat damit nichts zu tun. Ein Sitemap-Ersatz ist sie auch nicht, denn sie listet bewusst nur eine Auswahl.
Wie die Datei aufgebaut ist
Der Aufbau ist simpel, Pflicht ist nur die Überschrift.
# Name der Website
> Ein Satz, der erklärt, worum es hier geht.
Optionale Hinweise, wie die Links zu lesen sind.
## Leistungen
- [Titel der Seite](https://www.dein-shop.de/seite/): kurze Beschreibung
## Optional
- [Nachrangiges](https://www.dein-shop.de/impressum/)
Die Reihenfolge steht fest: eine H1 mit dem Namen, der einzige Pflichtteil. Danach ein Blockquote mit der Kurzbeschreibung, danach Fließtext ohne Überschriften, danach Abschnitte mit H2 und darunter Linklisten im Format [Titel](URL) plus optionaler Notiz. Der Abschnitt „Optional“ hat eine feste Bedeutung: Links, die ein Agent weglassen darf, wenn der Kontext knapp wird.
Was Version 2 geändert hat
- Die Datei darf an jedem Pfad liegen.
/docs/llms.txtdeckt alles unter/docs/ab. Gibt es mehrere, gilt die spezifischste. - Markdown-Versionen der Seiten. Empfohlen wird, jede Seite zusätzlich als
seite.mdauszuliefern und perrel="alternate"darauf zu verweisen. - llms-full.txt kommt darin nicht vor. Ich habe den Spezifikationstext durchsucht: null Treffer. Das ist eine Konvention einzelner Doku-Plattformen, kein Teil des Standards.
Die Beweislage in drei Strängen
Die Frage lässt sich aus drei unabhängigen Richtungen prüfen: Anbieteraussagen, Crawler-Dokumentationen und Server-Logs. Alle drei zeigen in dieselbe Richtung.
1. Was die Anbieter selbst schreiben
Google hat im Mai 2026 einen Leitfaden für generative KI-Funktionen veröffentlicht. Darin räumt ein Abschnitt mit Mythen auf, und llms.txt steht an erster Stelle. Der Wortlaut, Stand 10. Juli 2026:
„You don't need to create new machine readable files, AI text files, markup, or Markdown to appear in Google Search (including its generative AI capabilities), as Google Search itself doesn't use them.“ Und direkt danach: „It's completely fine if you decide to create and maintain LLMS.txt files (or other similar files) for other services or systems that use these files. Doing so will neither harm nor help your site's visibility or rankings in Google Search, as Google Search ignores them.“
Deutlicher geht es kaum. Googles John Mueller hat es im selben Zeitraum eingeordnet: llms.txt sei „not done for search“, sondern eine „temporary crutch, perhaps to save some tokens“ für KI-Coding-Werkzeuge, die Entwicklerdokumentation lesen.
2. Was in den Crawler-Dokumentationen steht
Ich habe die Crawler-Seiten von OpenAI, Anthropic und Perplexity durchsucht. Ergebnis: Als Datei, mit der du das Verhalten der Crawler steuerst, wird überall nur robots.txt genannt. Bei Anthropic kommt llms.txt im gesamten Crawler-Artikel kein einziges Mal vor.
Bei OpenAI und Perplexity taucht der Begriff zwar auf, aber in einer ganz anderen Rolle. Perplexity blendet über der eigenen Doku ein: „For AI agents: see the complete llms.txt documentation index.“ OpenAI schreibt: „For the complete documentation index, see llms.txt.“ Beide reden über ihre eigene Doku, nicht über deine Website.
Wichtig
Das ist die Verwechslung, die in der Branche ständig passiert. „Sogar OpenAI hat eine llms.txt“ ist kein Beleg dafür, dass GPTBot deine liest. Es belegt nur, dass OpenAI seine Entwicklerdoku für Coding-Agents aufbereitet. Herausgeber und Leser sind zwei Rollen, und die Verwechslung trägt einen guten Teil des llms.txt-Marketings.
3. Was die Server-Logs zeigen
Der dritte Strang ist der harte. Ahrefs hat im Juni 2026 die Logs von 137.210 Domains ausgewertet. 28 Prozent davon, rund 38.000, haben eine gültige llms.txt. Von diesen Dateien bekamen 97 Prozent im Mai 2026 keinen einzigen Abruf. Kein Bot, kein Mensch, nichts. Die gesamte gemessene Aktivität fiel auf die verbleibenden drei Prozent.
Und dort wird es interessant. 96 Prozent der Abrufe kamen von Bots, 19,5 Prozent von benannten KI-Werkzeugen: KI-Agents 10,5 Prozent, Trainings-Crawler 5,3 Prozent, KI-Assistenten 2,5 Prozent, und die KI-Retrieval-Bots, also genau die Systeme, die eine KI-Antwort mit Quellen füttern, 1,1 Prozent. Slackbot holte die Dateien öfter als PerplexityBot. An der Spitze stand GPTBot, auf Platz zwei Claude Code.
Die zweite Messung kommt von EZY Research, einem Anbieter, der llms.txt-Dateien selbst generiert und verkauft, also kein neutraler Beobachter. Umso bemerkenswerter das Ergebnis aus zwölf Wochen, 27. April bis 19. Juli 2026, auf 83 Websites, jeweils dieselben Seiten:
| Crawler | robots.txt | llms.txt |
|---|---|---|
| OpenAI (GPTBot-Familie) | 3.990 | 7 |
| Anthropic (ClaudeBot) | 3.120 | 9 |
| PerplexityBot | 775 | 0 |
| Googlebot | 5.125 | 67 |
| Meta-ExternalAgent | 172 | 193 |
Meta ist der einzige Ausreißer nach oben und holt die llms.txt häufiger als die robots.txt. Bei allen anderen stehen einstellige Abrufe gegen Tausende. EZY zieht daraus einen freundlicheren Schluss als ich, nämlich dass die Datei billige Versicherung sei, schreibt aber dazu: „anyone selling it as the thing that gets you cited is selling ahead of the evidence.“
Ein Detail aus der Ahrefs-Auswertung räumt mit einem letzten Argument auf. Man hört oft, ohne llms.txt sei man für KI-Systeme unsichtbar. Ahrefs hat deshalb alle Anfragen ausgewertet, die auf /llms.txt einen 404 bekamen: Der Anteil der KI-Bots daran war null, 98 Prozent kamen von Menschen, vermutlich SEOs, die bei Wettbewerbern nachsehen. KI-Systeme suchen nicht nach der Datei. Sie holen sie, wenn ein Link, ein Index oder eine Nutzeranweisung ihnen sagt, dass es sie gibt.
Behauptung, Beleg, Quelle
| Behauptung aus dem Netz | Was wirklich belegt ist | Quelle |
|---|---|---|
| „Mit llms.txt wirst du in KI-Suchen besser gefunden.“ | Google schreibt, die Suche ignoriere die Datei, sie helfe weder noch schade sie. | Google, Leitfaden für generative KI, 10.07.2026 |
| „Sogar OpenAI und Anthropic nutzen llms.txt.“ | Beide veröffentlichen eine für ihre eigene Entwicklerdoku. In ihren Crawler-Dokus steht als Steuerdatei nur robots.txt. | OpenAI: Bots, Anthropic: Crawler, Perplexity: Crawlers |
| „Die KI-Bots rufen die Datei ab.“ | 97 Prozent der Dateien bekamen im Mai 2026 null Abrufe. Bei den übrigen kamen 1,1 Prozent der Abrufe von KI-Retrieval-Bots. | Ahrefs, 137.210 Domains, 15.06.2026 |
| „ChatGPT und Perplexity lesen sie.“ | In zwölf Wochen: OpenAI 7 Abrufe gegen 3.990 robots.txt, Anthropic 9 gegen 3.120, PerplexityBot 0 gegen 775. | EZY Research, 83 Websites, 27.07.2026 |
| „Ohne llms.txt findet dich die KI nicht.“ | Bei einem 404 auf /llms.txt lag der KI-Bot-Anteil bei null, 98 Prozent der Anfragen kamen von Menschen. | Ahrefs, 15.06.2026 |
| „Google prüft die Datei in Lighthouse, also zählt sie.“ | Der Check läuft in den experimentellen Agentic-Browsing-Audits. Fehlt die Datei, gilt er als „Not Applicable“. | Chrome for Developers, 05.05.2026 |
Was stattdessen zählt
Die gute Nachricht: Die Liste ist kurz und steht ohnehin auf deiner Aufgabenliste.
- Die richtigen Crawler in der robots.txt erlauben. Das ist die Datei, die jeder Crawler tausendfach abruft. Trenn dabei Suche und Training, also OAI-SearchBot und Claude-SearchBot erlauben, auch wenn du GPTBot sperrst. Die Details stehen in Was muss alles in eine robots.txt.
- Indexiert und snippet-fähig sein. Googles Bedingung im Originalton: Eine Seite muss „indexed and eligible to be shown in Google Search with a snippet“ sein. Ein pauschales
nosnippetnimmt dich also aus den KI-Flächen heraus. - Den Schalter in der Search Console prüfen. Unter Einstellungen gibt es die Freigabe für generative KI-Funktionen. Standard ist „einschließen“, ein alter Ausschluss kostet dich Anzeige und Verlinkung in KI-Übersichten und im KI-Modus auf einen Schlag. Als Einstieg hilft URL in der Google Search Console eintragen.
- Inhalte ohne JavaScript lesbar machen. Viele KI-Abrufe rendern kein JavaScript. Was erst im Browser nachgeladen wird, existiert für sie nicht. Der schnellste Test ist ein Blick in den Quelltext.
- In fremden Quellen vorkommen. Der Weg in KI-Antworten führt bei etablierten Marken überwiegend über Seiten, die dir nicht gehören. Systematisch angehen kannst du das mit der Anleitung zur Generative Engine Optimization, betreut wird es bei mir unter GEO und KI-Sichtbarkeit.
Tipp
Bevor du über llms.txt nachdenkst, schau eine Minute in deine Server-Logs. grep -i "llms.txt" access.log zeigt, ob überhaupt jemand fragt. Danach filterst du auf die Crawler-Namen und siehst, welche KI-Bots deine Seite wirklich besuchen. Diese Zahlen sind mehr wert als jede Einschätzung aus einem Blogbeitrag, meine eingeschlossen.
Wann llms.txt trotzdem sinnvoll ist
Jetzt der faire Teil. Es gibt einen Fall, in dem die Datei nachweislich gelesen wird, und er steckt in denselben Daten.
Wenn du Entwicklerdokumentation, eine API oder ein Produkt anbietest, mit dem Menschen in Coding-Agents arbeiten, ist llms.txt sinnvoll. Genau dort lag in der Ahrefs-Messung die stärkste KI-Nutzung: Claude Code auf Platz zwei aller abrufenden KI-Werkzeuge, KI-Agents als größte Einzelkategorie. Das ist die Zielgruppe, für die Jeremy Howard die Datei gedacht hat, und die Spezifikation sagt es inzwischen selbst: Am stärksten genutzt wird llms.txt für Software-Dokumentation.
Der zweite Fall ist Chromes Lighthouse. Unter den experimentellen Agentic-Browsing-Audits gibt es seit Mai 2026 einen llms.txt-Check. Er prüft nur, ob die Datei da ist, und wenn sie fehlt, gilt er als „Not Applicable“. Ein Ranking-Signal ist das nicht, und er erzeugte rund einen von tausend Abrufen.
Gut zu wissen
Ein schneller Frischetest für jeden llms.txt-Ratgeber: Wenn dort noch „Google SGE“ oder „Bing Chat“ steht, ist der Text veraltet. SGE heißt seit Mai 2024 AI Overviews, auf Deutsch KI-Übersichten, dazu kam 2025 der KI-Modus. Bing Chat heißt seit November 2023 Microsoft Copilot. Genau dieser Fehler stand übrigens bis heute in der alten Fassung dieses Beitrags.
Ein Risiko gehört dazu, auch wenn es kaum diskutiert wird. Eine llms.txt ist Text, den Agents lesen und dem sie tendenziell vertrauen. In der Ahrefs-Auswertung war der größte einzelne Forschungs-Crawler ein Bot namens prompt-injection-survey/1.0. Da untersucht jemand systematisch, ob sich über diese Dateien Anweisungen einschleusen lassen. Schreib also nichts hinein, was du nicht auch auf eine öffentliche Seite schreiben würdest.
Wie ich es auf seorado.de halte
seorado.de hat eine llms.txt. Sie liegt im Root, sie folgt der Spezifikation, und sie ist trotzdem kein Sichtbarkeitsversprechen.
Der Grund ist banal: Sie kostet mich nichts. Die Seite ist statisch und wird von einem Build-Skript erzeugt, das ohnehin Titel, Adresse und Beschreibung jeder Leistungs-, Referenz- und Magazinseite in der Hand hat. Aus denselben Daten, aus denen es Navigation und Sitemap baut, schreibt es am Ende eine llms.txt. Kein separater Pflegeaufwand, keine Datei, die nach drei Monaten veraltet ist. Kommt ein Beitrag dazu, steht er beim nächsten Build automatisch drin.
Was ich nicht tue: sie als Leistung verkaufen. Die Zeile „llms.txt-Optimierung für KI-Sichtbarkeit“ in einem Angebot wäre nach heutiger Beweislage nicht zu belegen. Bei einem Shop, der die Datei von Hand pflegen müsste, rate ich meist ab und stecke die Zeit in Crawlbarkeit, Dubletten und Produktdaten. Da liegt bei SEO für Online-Shops deutlich mehr.
Unsicher, ob dein Shop für KI-Suchen erreichbar ist? Im kostenlosen Shop-Check sehe ich mir Rankings, KI-Sichtbarkeit und Technik persönlich an.
Häufige Fragen
Schadet eine llms.txt meiner Sichtbarkeit?
Nein. Google schreibt ausdrücklich, dass die Datei weder hilft noch schadet, weil die Suche sie ignoriert. Wenn du sie ohne Aufwand erzeugen kannst, spricht nichts dagegen. Erwarte nur keinen Effekt auf Rankings oder KI-Zitate.
Brauche ich zusätzlich eine llms-full.txt?
Die Spezifikation kennt den Namen nicht. Version 2 empfiehlt stattdessen, einzelne Seiten zusätzlich als Markdown auszuliefern und per Link-Relation darauf zu verweisen. Für eine normale Website oder einen Shop ist beides optional.
Wie sehe ich, ob meine llms.txt abgerufen wird?
Nur über deine Server-Logs. Such nach dem Pfad, dann nach den Crawler-Namen. Zwei Dinge sind dabei wichtig: Ein Abruf beweist nur, dass die Datei geholt wurde, nicht dass sie verwendet wurde. Und ein 404 auf dem Pfad heißt, dass jemand nach einer Datei fragt, die du nie veröffentlicht hast.
Ist llms.txt eine Alternative zur robots.txt?
Nein, die Namensähnlichkeit führt viele in die Irre. Die robots.txt steuert, was Crawler abrufen dürfen, und wird von jedem großen Crawler ständig gelesen. Die llms.txt steuert nichts. KI-Zugriff regelst du über robots.txt, Meta-Angaben wie nosnippet und die Search Console.
Sollte ich llms.txt als Leistung einkaufen?
Nach heutiger Beweislage nein, jedenfalls nicht als Maßnahme für KI-Sichtbarkeit. Wer sie dir mit dem Versprechen verkauft, dass ChatGPT oder Perplexity dich danach häufiger zitieren, hat keine Daten.
Quellen
- Google: Optimizing for Generative AI Features on Google Search
- Google: AI features and your website
- Google Search Console-Hilfe: Freigabe von Inhalten für generative KI managen
- Chrome for Developers: Lighthouse-Audit llms.txt
- Jeremy Howard: The /llms.txt file, v2
- Ahrefs: We Analyzed 137K Sites, 97% of llms.txt Files Never Get Read
- EZY Research: We put llms.txt on 83 websites
- OpenAI: Bots
- Anthropic: Does Anthropic crawl data from the web
- Perplexity: Perplexity Crawlers
Das für deinen Shop umsetzen?
Drei Fragen, sofort eine Einschätzung, danach drei konkrete Punkte von mir persönlich. Kostenlos.
Weitere Artikel
aus dem Magazin.
Alle ArtikelSEO, GEO, LLMO, AEO, SBO, AIO: was dahintersteckt
SEO, GEO, LLMO, AEO, SBO, AIO: sechs Abkürzungen für ein Feld, das sich in drei Jahren nicht sechsmal neu erfunden hat. Die meisten beschreiben dieselbe Arbeit unter einem neueren Namen. Einer hat einen belegten …
Generative Engine Optimization: Anleitung mit Belegen
Generative Engine Optimization wird als neue Disziplin verkauft: eigene Dateien, Sondermarkup, Texte in mundgerechten Häppchen für die Maschine. Google selbst schreibt etwas anderes. Im offiziellen Leitfaden zur …
Query Fan-Out: So prüfst du die Abdeckung deiner Inhalte
Wer im KI-Modus von Google tippt „welcher Laufschuh passt bei Überpronation und 90 Kilo", sucht nicht nach diesem Satz. Google zerlegt ihn. Im Hintergrund laufen mehrere Suchanfragen gleichzeitig: zu Überpronation, …

