Werbung: Dieser Beitrag entstand in Zusammenarbeit mit deine-geo-agentur.de.
Eine Textdatei, von der Google schreibt, dass die eigene Suche sie ignoriert, gehört 2026 trotzdem zu den meistdiskutierten Dateien im Webdesign. Die llms.txt soll Sprachmodellen und KI-Agenten eine kompakte Übersicht der wichtigsten Inhalte einer Website liefern. Das gelingt ihr in einem eng umrissenen Feld, vor allem bei Dokumentationen, die Coding-Agenten lesen. Für Rankings in Google bringt sie nichts, für Nennungen in ChatGPT gibt es keinen Beleg. Wer das weiß, kann die Datei in unter einer Stunde sauber anlegen und die Erwartungen richtig setzen.
Kurz erklärt
- llms.txt ist ein Vorschlag von Jeremy Howard aus dem Jahr 2024, seit 10. August 2026 in Version 2 – kein Standard einer Normungsorganisation.
- Google Search nutzt die Datei laut eigenem Leitfaden nicht; sie hilft und schadet der Sichtbarkeit dort nicht.
- Chrome Lighthouse prüft in der Kategorie Agentic Browsing, ob eine vorhandene llms.txt fehlerfrei abrufbar ist.
- Die Datei steuert keinen Zugriff; dafür bleibt die robots.txt zuständig.
Was ist die llms.txt und woher kommt sie?
Eine Markdown-Datei unter /llms.txt, die in wenigen Zeilen beschreibt, worum es auf einer Website geht, und auf die wichtigsten Seiten verlinkt. Vorgeschlagen hat sie der Entwickler Jeremy Howard 2024 auf llmstxt.org, Version 2 folgte im August 2026.
Die Idee ist einfach. Webseiten sind für Menschen gebaut, mit Navigation, Bannern und Skripten. Ein Agent, der eine konkrete Frage beantworten soll, kommt mit einer kurzen, kuratierten Übersicht schneller ans Ziel. Pflicht ist laut Spezifikation nur eine H1 mit dem Namen des Projekts. Empfohlen sind danach ein Zitatblock mit der Kernaussage, optional erläuternder Text und Abschnitte unter H2-Überschriften, die Links mit je einem kurzen Kommentar enthalten. Version 2 hat drei Neuerungen gebracht. Eine llms.txt darf nun auch in einem Unterpfad liegen, etwa /docs/llms.txt, und gilt dann für alle URLs darunter; bei mehreren passenden Dateien zählt die spezifischste. Seiten können eine Markdown-Fassung unter gleicher Adresse mit der Endung .md anbieten. Und über die Link-Relationen rel=“alternate“ und rel=“describedby“ lassen sich beide Varianten im HTML auffindbar machen.
| Datei | Zweck | Wer wertet sie aus? |
|---|---|---|
| robots.txt | Regelt, welche Pfade Crawler abrufen dürfen (RFC 9309) | Suchmaschinen und die KI-Crawler von OpenAI, Anthropic, Perplexity |
| sitemap.xml | Listet alle indexierbaren URLs | Google, Bing und andere Suchmaschinen |
| llms.txt | Kuratierte Übersicht für Sprachmodelle und Agenten | Einzelne Agenten und Werkzeuge; Google Search nicht |
Was sagt Google zur Wirkung der Datei?
Google ist eindeutig: Für die Sichtbarkeit in der Google-Suche und ihren KI-Funktionen braucht es weder llms.txt noch andere KI-Textdateien. Die Suche ignoriert sie; wer sie für andere Dienste pflegt, hat davon weder Vorteil noch Nachteil.
Die Aussage steht im Leitfaden von Google Search Central zur Optimierung für generative KI-Funktionen, zuletzt aktualisiert am 10. Juli 2026. Sinngemäß heißt es dort, man müsse keine neuen maschinenlesbaren Dateien, KI-Textdateien oder Markdown-Versionen anlegen, um in der Google-Suche einschließlich AI Overviews und AI Mode zu erscheinen, weil die Suche sie nicht verwendet. Das ist keine Absage an die Datei an sich. Google trennt hier sauber zwischen dem Suchindex und anderen Nutzungen. Ein Hinweis auf diese anderen Nutzungen kommt ausgerechnet aus dem eigenen Haus: Chrome Lighthouse führt in seiner neuen Kategorie Agentic Browsing ein eigenes Audit, das den Abruf einer llms.txt testet. Fehlt sie und antwortet der Server mit 404, gilt der Test als nicht anwendbar. Angemerkt werden nur Serverfehler beim Abruf, denn die Datei ist nach Darstellung von Chrome derzeit optional. Wer keine llms.txt anbietet, wird dort also nicht abgestraft.
Wie legt man eine llms.txt Schritt für Schritt an?
In fünf Schritten: Kernseiten auswählen, Datei nach Schema schreiben, im Wurzelverzeichnis ausliefern, Abruf und Links prüfen, Pflege festlegen. Für eine typische Unternehmenswebsite ist das in weniger als einer Stunde erledigt.
- Auswählen: Zehn bis zwanzig Seiten, die das Angebot erklären – Leistungen, Preise, Über uns, Kontakt, die stärksten Fachartikel. Die Datei ist keine zweite Sitemap.
- Schreiben: H1 mit dem Firmennamen, darunter ein Zitatblock mit zwei, drei Sätzen zum Angebot, dann H2-Abschnitte mit Zeilen im Format „- [Titel](URL): kurze Beschreibung“.
- Ausliefern: Die Datei als /llms.txt in UTF-8 hochladen. Der Server muss Statuscode 200 liefern; Weiterleitungen und Login-Schranken sind zu vermeiden.
- Prüfen: Die Adresse im Browser und per Kommandozeile aufrufen, alle Links auf Erreichbarkeit testen und Lighthouse im Bereich Agentic Browsing laufen lassen.
- Pflegen: Bei jeder neuen Leistung oder geänderten URL mitziehen. Eine veraltete llms.txt mit toten Links ist schlechter als keine.
Welche Werkzeuge helfen bei Erstellung und Prüfung?
Für den Entwurf genügen ein Texteditor oder ein Generator, für die Prüfung Browser, Kommandozeile und Lighthouse. Wichtiger als die Datei selbst ist ein Test, ob KI-Crawler die Website überhaupt abrufen dürfen und können.
Für den Entwurf muss niemand Markdown von Hand setzen. Der kostenlose llms.txt-Generator von deine-geo-agentur.de, einer GEO-Agentur aus Hechingen, fragt Name, Kurzbeschreibung und die wichtigsten Seiten ab und baut daraus eine Datei nach dem Schema von llmstxt.org: H1, Zitatblock, Abschnitte mit kommentierten Links. Die Verarbeitung läuft laut Anbieter vollständig im Browser, eingegebene Daten werden weder übertragen noch gespeichert. Bemerkenswert ist die Einordnung auf derselben Seite: Einen Beleg, dass eine llms.txt die Nennungen in ChatGPT oder Perplexity erhöht, gebe es nicht, und Google werte die Datei nicht aus. Für die KI-Sichtbarkeit wichtiger ist oft eine zweite Frage, nämlich ob die Bots von OpenAI, Anthropic und Perplexity bis zu den Inhalten durchkommen. Dafür bietet dieselbe Agentur einen KI-Crawler-Check an, der 16 Bots gegen die robots.txt nach RFC 9309 prüft und die Startseite zusätzlich mit den jeweiligen Bot-Kennungen abruft, um Sperren durch eine Firewall sichtbar zu machen.
Wo liegen die Grenzen der llms.txt?
Die Datei steuert keinen Zugriff, garantiert keine Auswertung und ersetzt keine Inhalte. Eine öffentliche Zusage, dass ChatGPT, Claude oder Perplexity sie bei allgemeinen Fragen heranziehen, gibt es Stand September 2026 nicht.
Drei Missverständnisse halten sich hartnäckig. Erstens: Die llms.txt sei eine Art robots.txt für KI. Sie ist es nicht, denn sie erlaubt und verbietet nichts. Wer Trainings-Crawler wie GPTBot sperren oder Such-Crawler wie OAI-SearchBot zulassen will, braucht weiterhin Einträge in der robots.txt. Zweitens: Mehr Inhalt in der Datei bringe mehr Wirkung. Die verbreitete Praxis, unter llms-full.txt den gesamten Text der Website abzulegen, gehört nicht zum Vorschlag auf llmstxt.org und lohnt sich nur bei stabilen Inhalten wie einer Produktdokumentation. Drittens: Die Datei gleiche schwache Seiten aus. Kein Sprachmodell zitiert eine Seite, nur weil sie in einer Liste steht. Zitiert werden Seiten, die eine Frage präzise beantworten, im ausgelieferten HTML lesbar sind und von anderen Quellen bestätigt werden.
Fragen aus der Praxis
Schadet eine llms.txt dem Google-Ranking?
Nein. Google schreibt im Leitfaden zu generativen KI-Funktionen, dass die Suche solche Dateien ignoriert. Sie helfen der Sichtbarkeit nicht und schaden ihr nicht. Wer die Datei für andere Dienste oder Agenten pflegen möchte, kann das ohne Risiko für die Google-Suche tun.
Braucht ein kleiner Betrieb überhaupt eine llms.txt?
Nicht zwingend. Für eine Handwerks- oder Beratungswebsite mit wenigen Seiten ist der Nutzen gering, der Aufwand aber auch. Vorrang haben eine korrekte robots.txt, erreichbare Seiten ohne Bot-Sperre und klare Inhalte. Die llms.txt ist eine günstige Ergänzung, keine Pflicht.
Was ändert Version 2 für bestehende Dateien?
Bestehende Dateien im Wurzelverzeichnis bleiben gültig. Neu ist vor allem, dass zusätzliche Dateien in Unterpfaden wie /docs/llms.txt möglich sind und Markdown-Fassungen einzelner Seiten per .md-Endung und Link-Relation angeboten werden können. Anpassen muss niemand, erweitern kann man.
Fazit: Anlegen ja, überschätzen nein
Die llms.txt ist ein kleines, sinnvolles Stück Ordnung, aber kein Hebel für Reichweite. Google ignoriert sie ausdrücklich, für ChatGPT, Claude und Perplexity fehlt jede Zusage. Wer sie anlegt, gewinnt vor allem eine Übung in Priorisierung und eine sauberere Grundlage für Agenten. Mehr Wirkung verspricht, zuerst die Erreichbarkeit für KI-Crawler zu klären, wie es der Check der Hechinger Agentur von Felix Wilhelm anbietet, und dann an Inhalten zu arbeiten, die zitiert werden wollen.
Redaktion web-coach.eu: Die Redaktion schreibt über Webdesign, Technik und Suchmaschinen für Selbstständige und kleine Unternehmen. Grundlage dieses Beitrags sind die Spezifikation auf llmstxt.org, die Dokumentation von Google Search Central und die Lighthouse-Dokumentation von Chrome.
Quellen
- The /llms.txt file (Version 2), llmstxt.org, abgerufen 22.09.2026
- Google’s Guide to Optimizing for Generative AI Features on Google Search, Google Search Central, aktualisiert 10.07.2026
- Lighthouse-Audit llms.txt (Agentic Browsing), Chrome for Developers, abgerufen 22.09.2026
- RFC 9309: Robots Exclusion Protocol, IETF, September 2022
- Overview of OpenAI Crawlers, OpenAI, abgerufen 22.09.2026
Aktualisiert am 22.09.2026
