llms.txt schreiben: was die Datei kann und was nicht

Eine llms.txt ist eine kurze Markdown-Datei, die einem Sprachmodell sagt, was deine Seite ist und wo die wichtigen Unterseiten liegen. Sie ist schnell geschrieben. Ob KI-Crawler sie nutzen, ist eine andere und viel unsicherere Frage.

Veröffentlicht am 2. Oktober 2026 · 5 Min. Lesezeit

llms.txt ist ein Vorschlag, 2024 auf llmstxt.org veröffentlicht, für eine einzelne Markdown-Datei im Root einer Website, die einem Sprachmodell eine knappe Karte der Seite gibt: was sie ist und welche Seiten zählen. Die Idee: Ein Modell, das mit einem begrenzten Kontextfenster arbeitet, soll sich nicht durch Navigation, Scripts und Markup kämpfen müssen, um herauszufinden, was dein Produkt tut.

Dieser Beitrag behandelt das Format, ein vollständiges Beispiel, wie du jeden Teil gut schreibst, und dann den Teil, den die meisten Anleitungen auslassen: was die Datei leistet und was nicht.

Das Format

Die Datei liegt unter /llms.txt und ist in Markdown geschrieben. Der Vorschlag legt ihre Struktur in dieser Reihenfolge fest:

  1. Eine H1 mit dem Namen der Seite oder des Projekts. Das ist der einzige Pflichtteil.
  2. Ein Blockzitat mit einer kurzen Zusammenfassung: die zentralen Informationen, die man braucht, um den Rest der Datei zu verstehen.
  3. Optional weitere Absätze oder Listen mit Details. In diesem Teil keine Überschriften.
  4. Optional beliebig viele Abschnitte mit H2-Überschrift, jeder mit einer Liste von Links. Jeder Eintrag ist ein Markdown-Link, optional gefolgt von einem Doppelpunkt und einer kurzen Notiz zur Seite.

Ein Abschnittsname hat eine besondere Bedeutung. Ein Abschnitt mit der Überschrift ## Optional enthält Links, die übersprungen werden können, wenn ein kürzerer Kontext gebraucht wird, also gehören Seiten aus der zweiten Reihe dorthin. Weil der Vorschlag genau diesem Namen seine Bedeutung gibt, bleibt er auch in einer deutschen Datei englisch.

Der Vorschlag regt außerdem an, dass Seiten unter derselben URL mit angehängtem .md eine saubere Markdown-Version anbieten. Dieser Teil ist optional, und viele Seiten veröffentlichen eine llms.txt ohne ihn.

Ein vollständiges Beispiel

Hier ist eine komplette Datei für ein erfundenes Produkt, ein Buchhaltungstool namens Tallybook. Eine llms.txt kann in jeder Sprache geschrieben sein, dieses Beispiel ist auf Deutsch:

# Tallybook

> Tallybook macht aus der CSV-Datei, die eine Bank exportiert, eine
> kategorisierte Tabelle, die ein Steuerbüro akzeptiert. Es ist eine
> Web-App für Freiberufler in der EU, kostenlos für bis zu 200 Buchungen
> im Monat.

Tallybook verbindet sich nicht mit Bankkonten; Nutzer laden einen Export
hoch. Es liest CSV- und OFX-Dateien und exportiert CSV und XLSX. Es
erstellt keine Steuererklärungen und keine Rechnungen.

## Dokumentation

- [Erste Schritte](https://tallybook.example/docs/start.md): Datei hochladen, Kategorien prüfen, exportieren
- [Unterstützte Banken und Formate](https://tallybook.example/docs/formats.md): welche Exporte funktionieren und welche nicht
- [Kategorien](https://tallybook.example/docs/categories.md): die Standardkategorien und wie man sie ändert

## Preise

- [Preise](https://tallybook.example/pricing): die Grenzen der kostenlosen Stufe und der Bezahlplan

## Optional

- [Changelog](https://tallybook.example/changelog): datierte Liste der Änderungen
- [Über uns](https://tallybook.example/about): wer Tallybook baut
Ein erfundenes Beispiel. Die Domain .example ist reserviert und führt nirgendwohin.

Wie du jeden Teil schreibst

Die Zusammenfassung ist die wichtigste Zeile. Schreib sie aussagenorientiert, damit sie auch dann noch Sinn ergibt, wenn ein Modell nur diesen Satz zitiert: was das Produkt ist, für wen es ist und die eine Tatsache, die es unterscheidet. Lass das Stangenware-Vokabular weg, das so viele Landingpages füllt; „nahtlose All-in-One-Plattform“ sagt einem Modell genauso wenig wie einem Menschen. Der Beitrag über Stangenware-Phrasen hat eine Liste.

Schreib deine Grenzen in den Detailteil. Was das Produkt nicht kann, ist genau die Art Tatsache, die verloren geht, wenn ein Modell eine Marketingseite zusammenfasst. Sagst du es klar, wird eine Antwort über dein Produkt eher zutreffend als schmeichelhaft, und das ist auf lange Sicht besser für dich.

Verlinke die Seiten, die echte Fragen beantworten. Wie es funktioniert, Preise, unterstützte Plattformen, Grenzen, eine FAQ. Nicht jede Seite aus der Sitemap: Die Datei soll eine kuratierte Karte sein, und eine Liste von zweihundert URLs ist nur eine Sitemap in einem anderen Format.

Schreib hinter jeden Link eine Notiz. Mit der Notiz kann ein Modell entscheiden, ob sich eine Seite lohnt, ohne sie abzurufen. „Dokumentation“ ist eine nutzlose Notiz; „welche Dateiformate funktionieren und welche nicht“ ist eine nützliche.

Halte sie aktuell. Eine Datei, die das Produkt vom letzten Jahr beschreibt, ist schlimmer als gar keine, weil sie selbstbewusst falsch ist. Schreib ein Datum hinein oder führ einen kurzen Changelog-Abschnitt, und aktualisiere sie, wenn sich das Produkt ändert.

Liefere sie als reinen Text im Root deiner Domain aus und öffne sie danach im Browser, um zu prüfen, ob sie wirklich erreichbar ist und nicht von der Catch-all-Route einer Single-Page-App verschluckt wird. Wenn du einen Ausgangspunkt willst: Der kostenlose llms.txt-Generator entwirft eine in diesem Format aus deiner Startseite, deiner Sitemap und bis zu zwölf deiner Seiten. Das Ergebnis ist ein Entwurf zum Überarbeiten, keine fertige Datei. Die Datei von IntentGrid selbst liegt unter /llms.txt, falls du eine mit einem Absatz zum Produktstatus und einem Abschnitt mit benannten Grenzen sehen willst.

Was sie leistet

  • Sie gibt jedem Tool und jedem Menschen, der sie abruft, eine kurze, zutreffende Beschreibung deiner Seite in einem Format, das ein Modell leicht liest. Dazu gehören Entwickler, die die llms.txt eines Projekts in einen KI-Coding-Assistenten einfügen, und Tools, die gezielt nach der Datei suchen.
  • Sie bringt dich dazu, eine klare, zitierbare Beschreibung deines eigenen Produkts zu schreiben, und das verbessert meist auch deine Startseite und deine Meta-Descriptions.
  • Sie kostet sehr wenig: ein paar hundert Wörter und eine Linkliste.

Was sie nicht leistet

Hier lohnt sich ein nüchterner Blick. llms.txt ist ein Vorschlag, kein Standard, den Suchmaschinen oder KI-Unternehmen übernommen haben. Ob die Crawler hinter KI-Assistenten und Antwortmaschinen sie abrufen, und ob irgendetwas, das sie daraus abrufen, ihre Antworten beeinflusst, ist unsicher und weitgehend undokumentiert. Dass eine veröffentlichte llms.txt irgendetwas ändert, ist nicht garantiert.

  • Sie verbessert deine Rankings in der Suche nicht. Suchmaschinen ranken Seiten, und diese Datei ist kein Rankingsignal.
  • Sie bringt keinen KI-Assistenten dazu, dich zu zitieren. Ob du zitiert wirst, hängt davon ab, ob deine Seiten nützlich, zugänglich und vertrauenswürdig sind, nicht von einer Zusammenfassungsdatei.
  • Sie ersetzt kein gutes HTML. Wenn deine Seiten ihren Text erst im Browser rendern, sieht ein Crawler, der kein JavaScript ausführt, womöglich trotzdem eine leere Hülle, mit oder ohne llms.txt.
  • Sie steuert nicht, wer deine Seite crawlt. Dafür gibt es eine andere Datei.

Bevor du dich für irgendetwas darauf verlässt, prüf die aktuelle Dokumentation der konkreten KI-Produkte, die dir wichtig sind, statt dich auf das Wort irgendeines Blogbeitrags zu verlassen, diesen eingeschlossen.

llms.txt ist nicht robots.txt

Die beiden werden leicht verwechselt, weil beide im Root liegen und beide mit KI zu tun haben. Sie erledigen verschiedene Aufgaben.

Die robots.txt sagt Crawlern, welche Pfade sie abrufen dürfen. Die meisten KI-Unternehmen dokumentieren die User-Agents ihrer Crawler, etwa GPTBot und OAI-SearchBot bei OpenAI, ClaudeBot bei Anthropic und PerplexityBot bei Perplexity, und Google nutzt ein eigenes robots.txt-Token, Google-Extended, mit dem Seiten bestimmte KI-Nutzungen ihrer Inhalte ablehnen können. Mehrere Unternehmen unterscheiden zwischen Crawlern, die Trainingsdaten sammeln, und Crawlern, die Seiten abrufen, um die Frage eines Nutzers zu beantworten, also sperrt das Blockieren des einen nicht unbedingt auch den anderen. Die robots.txt ist eine Bitte, an die sich seriöse Crawler halten, kein Durchsetzungsmechanismus.

Die llms.txt erlaubt und blockiert nichts. Sie ist eine Beschreibung, angeboten für alle, die sie lesen wollen. Entscheide in der robots.txt, was gecrawlt werden soll, und beschreib mit der llms.txt, was da ist.

Das größere Bild, wie Antwortmaschinen eine Seite lesen und wie sich das vom klassischen SEO unterscheidet, findest du unter Schadet Website-Personalisierung dem SEO?, wo GEO, also Generative Engine Optimization, einen eigenen Abschnitt hat.