Nachschlagen
Was in einer llms.txt steht, Zeile für Zeile
Die Datei folgt einem Vorschlag von llmstxt.org. Sie ist Markdown, sie liegt im Wurzelverzeichnis, und sie hat eine feste Reihenfolge. Wer sie kennt, erkennt in zehn Sekunden, ob eine Datei taugt.
Die H1 ist der Name, sonst nichts
Die erste Zeile beginnt mit einem Doppelkreuz und trägt den Namen der Website, so wie du genannt werden willst. Kein Slogan, keine Rechtsform, keine Stadt. Ein Modell nutzt diese Zeile als Bezeichner, und ein Bezeichner mit sieben Wörtern taucht in keiner Antwort auf.
Der Blockquote ist der eine Satz
Direkt darunter steht eine Zeile mit einem Größerzeichen. Das ist deine Einordnung in einem Satz, und es ist die Zeile, die in einer Antwort am ehesten wörtlich auftaucht. Sie beantwortet, was du anbietest und für wen. Zwei Nebensätze sind genug, drei sind zu viel.
Danach der Fließtext, den niemand liest
Zwischen Blockquote und erster Überschrift darf ein Absatz stehen. Er ist der einzige Ort für Zusammenhang, also für das, was ein Mensch beim Erstgespräch als Erstes fragen würde. Verzeichnisse und Aufzählungen gehören nicht hierhin, dafür kommen die Abschnitte.
Abschnitte sind H2, Einträge sind Links mit Beschreibung
Jeder Abschnitt beginnt mit zwei Doppelkreuzen. Darunter steht je Zeile ein Link in eckigen Klammern, danach ein Doppelpunkt und ein Halbsatz, der sagt, was auf dieser Seite steht. Ohne diesen Halbsatz ist der Link wertlos, denn ein Modell entscheidet daran, ob es die Seite überhaupt öffnet.
Optional heißt wirklich optional
Ein Abschnitt mit der Überschrift Optional hat eine besondere Bedeutung. Er sagt einem Modell, dass es diese Seiten weglassen darf, wenn sein Platz knapp wird. Dort gehören Impressum, Datenschutz und Archivseiten hinein, nicht dein Angebot.
Die Datei liegt unter /llms.txt, im Plural
Der Standard heißt llms.txt mit einem s vor dem Punkt. Wer llm.txt hochlädt, hat eine Datei, die niemand abruft. Prüfe nach dem Hochladen mit einem Aufruf im Browser, dass die Adresse den Text zeigt und nicht deine 404-Seite.
Sie ersetzt weder robots.txt noch sitemap.xml
Die drei Dateien tun Verschiedenes und schließen sich nicht aus. robots.txt erlaubt oder verbietet den Abruf. sitemap.xml listet jede Adresse für die vollständige Erfassung. llms.txt ordnet ein und gewichtet, sie ist die einzige der drei, die eine Meinung hat.
Kein Crawler ist verpflichtet, sie zu lesen
llms.txt ist ein Vorschlag, kein Standard mit Gremium dahinter. Anthropic, OpenAI und Perplexity lesen sie in Teilen, Google verwendet sie nicht als Ranking-Signal. Der Nutzen liegt darin, dass ein Modell beim Zusammenfassen deiner Seite eine Vorlage findet, statt aus Navigation und Fußzeile zu raten.
Sie veraltet, sobald dein Angebot sich ändert
Eine llms.txt mit Preisen von letztem Jahr ist schlechter als keine, weil ein Modell die alte Zahl mit voller Überzeugung nennt. Setz dir eine Erinnerung auf denselben Tag, an dem du deine Preisseite änderst, und lies die Datei einmal von oben durch.