llms.txt: was sie kann und was nicht
Ein Vorschlag mit viel Werkzeugunterstützung und wenig Bestätigung von den Anbietern. Diese Seite trennt den Aufbau der Datei von den Erwartungen an sie.
KI-generiertDieses Bild wurde mit KI erzeugt · Yves Hoppe / KI / cmt
Eine Datei, die viele anlegen und wenige prüfen
Der übliche Ablauf: Jemand liest von llms.txt, ein Generator erzeugt in zwei Minuten eine Datei, sie wird hochgeladen und abgehakt. Geprüft wird danach nichts mehr, weder ob sie überhaupt ausgeliefert wird, noch ob sie je jemand abruft, noch ob ihr Inhalt nach einem halben Jahr noch stimmt.
Das kostet zunächst wenig und später doch etwas. Zum einen verschiebt die abgehakte Maßnahme die Aufmerksamkeit weg von den Dingen, die messbar wirken. Zum anderen steht am Ende eine veraltete Übersicht im Netz, die deine Inhalte falsch beschreibt, und genau das ist schlechter als gar keine Datei.
Umgekehrt gilt: Wer die Datei im Build erzeugt und dort aktuell hält, hat den Aufwand einmal und danach nie wieder.
KI-generiertDieses Bild wurde mit KI erzeugt · Yves Hoppe / KI / cmt
Der Aufbau im Detail
Der Aufbau
# Projektname > Kurzbeschreibung in zwei Sätzen ## Dokumentation - [Seitentitel](https://beispiel.de/seite.md): wozu die Seite gut ist ## Optional - 01 Titelzeile
# ProjektnameDie einzige Pflichtangabe. Eine Überschrift erster Ordnung mit dem Namen des Projekts, des Produkts oder des Unternehmens.
- 02 Blockzitat
> Kurzbeschreibung in zwei SätzenEin Blockzitat direkt darunter fasst zusammen, worum es geht. Hier gehört hin, was jemand wissen muss, der sonst nichts von dir kennt.
- 03 Abschnitt
## DokumentationBeliebig viele Abschnitte zweiter Ordnung gruppieren die Verweise. Die Namen wählst du selbst, sie sollten den Inhalt beschreiben und nicht deine interne Struktur.
- 04 Verweis
[Seitentitel](https://beispiel.de/seite.md)Ein gewöhnlicher Markdown-Link. Verweist er auf eine Markdown-Fassung statt auf die HTML-Seite, bekommt das lesende System sauberen Text ohne Navigation und Hinweisbanner.
- 05 Hinweis
: wozu die Seite gut istDer Text nach dem Doppelpunkt ist optional und trotzdem der nützlichste Teil. Er entscheidet, ob ein System den Verweis überhaupt aufgreift.
- 06 Sonderabschnitt
## OptionalDieser Abschnittsname ist im Vorschlag reserviert. Was hier steht, darf weggelassen werden, wenn nur wenig Platz zur Verfügung steht.
Wenn es nicht funktioniert
Das siehst du
Die Datei liegt richtig, im Serverlog taucht kein einziger Abruf auf.
Warum
Die meisten Systeme fragen /llms.txt schlicht nicht ab, unabhängig davon, wie sauber sie aufgebaut ist.
Was hilft
Filtere das Log nach dem Pfad, bevor du weiter investierst, und behandle die Datei als Nebenprodukt statt als Maßnahme.
Das siehst du
Der Aufruf liefert HTML, im Browser erscheint die normale Seite.
Warum
Der Pfad läuft in die Auffangregel der Anwendung, die für unbekannte Adressen die Startseite oder eine Fehlerseite ausliefert.
Was hilft
Lege die Datei als statische Ressource vor der Auffangregel an und liefere sie als text/plain oder text/markdown aus.
Das siehst du
Hinter den verlinkten Adressen stehen Seiten voller Navigation, Zustimmungsbanner und Skripte.
Warum
Die Datei verweist auf die üblichen HTML-Seiten, obwohl der ganze Zweck saubere Textfassungen sind.
Was hilft
Stelle je Seite eine Markdown-Fassung bereit, üblicherweise unter derselben Adresse mit der Endung .md, und verweise darauf.
Das siehst du
Die Angaben in der Datei stimmen nicht mehr mit der Website überein.
Warum
Sie wurde einmal von Hand geschrieben und danach nie wieder angefasst.
Was hilft
Erzeuge sie im Buildschritt aus derselben Datenquelle wie die Sitemap, dann altert sie nicht schneller als der Rest.
Das siehst du
Die Datei ist mehrere hundert Zeilen lang und listet alles auf.
Warum
Es wurde vollständig statt ausgewählt gearbeitet, damit fällt der einzige sichere Vorteil weg.
Was hilft
Beschränke dich auf die Seiten, die du auch einem neuen Kollegen am ersten Tag zeigen würdest, und schiebe den Rest in den Abschnitt Optional.
Fünf Fragen, bevor du eine llms.txt anlegst
- 01 Wird die Datei bei dir überhaupt abgerufen? Das Serverlog beantwortet es in Minuten.
- 02 Liefert dein Server sie als Text aus oder gerät sie in die Auffangregel der Anwendung?
- 03 Stehen hinter den Verweisen saubere Textfassungen oder die üblichen HTML-Seiten?
- 04 Entsteht die Datei im Build oder pflegt sie jemand von Hand?
- 05 Welche dreißig Seiten sind wirklich die wichtigen? Diese Antwort nützt in jedem Fall.
Was du danach entscheiden kannst
Ziel ist keine Meinung über den Standard, sondern eine begründete Entscheidung für die eigene Domain, die du in einem Satz erklären kannst.
Aufbau lesen und schreiben
Du erkennst am Quelltext einer llms.txt, ob sie dem Vorschlag folgt, und schreibst selbst eine, die ohne Generator auskommt.
Abrufe nachweisen
Du filterst das Serverlog nach dem Pfad und weißt danach, ob die Datei bei dir überhaupt geholt wird und von wem.
Auslieferung prüfen
Du erkennst die typischen Fehler, etwa eine als HTML ausgelieferte Datei oder einen Pfad, der in die Auffangregel der Anwendung läuft.
Aufwand abschätzen
Du unterscheidest den einmaligen Aufbau von der laufenden Pflege und entscheidest, ob eine Erzeugung im Build den Aufwand rechtfertigt.
Erwartungen einordnen
Du kannst intern begründen, warum die Datei allein keine Sichtbarkeit in Antworten herstellt und welche Maßnahmen das tun.
Abgrenzung zur robots.txt
Du weißt, dass Zugriffssteuerung nicht hierhin gehört, und verwechselst die beiden Dateien in der Diskussion nicht mehr.
KI-generiertDieses Bild wurde mit KI erzeugt · Yves Hoppe / KI / cmt
Was in der Datei steht
Der Aufbau ist bewusst schlicht und folgt einfachem Markdown: eine Überschrift erster Ordnung mit dem Namen des Projekts oder Unternehmens, darunter ein Blockzitat mit zwei bis drei Sätzen Zusammenfassung, danach beliebig viele Abschnitte mit Linklisten. Jeder Link besteht aus Titel, Adresse und einem kurzen Hinweis, wozu die Seite gut ist.
Eine Besonderheit sieht der Vorschlag vor: Ein Abschnitt mit der Überschrift „Optional“ markiert Verweise, die weggelassen werden dürfen, wenn wenig Platz zur Verfügung steht. Daneben steht in vielen Umsetzungen eine zweite Datei, llms-full.txt, die den vollständigen Text statt nur der Verweise enthält.
Wer sie tatsächlich abruft
Hier liegt der wunde Punkt. Kein großer Anbieter hat öffentlich zugesagt, /llms.txt abzufragen, und in Serverlogs taucht die Datei entsprechend selten auf. Wer wissen will, wie es bei der eigenen Domain aussieht, filtert das Log nach dem Pfad; das dauert fünf Minuten und ersetzt jede Vermutung.
Der Vergleich mit dem alten Keywords-Meta-Tag drängt sich auf, und er trifft einen Teil des Problems: Eine Angabe, die ausschließlich für Maschinen gedacht ist und von niemandem geprüft wird, lädt zum Übertreiben ein und verliert dadurch an Wert. Das ist kein Argument gegen den Aufbau der Datei, wohl aber gegen die Erwartung, sie allein bringe Sichtbarkeit.
Wann sich der Aufwand trotzdem lohnt
Zwei Fälle sprechen dafür. Erstens Dokumentation: Wer eine Software mit vielen Unterseiten pflegt, gibt Menschen wie Systemen mit einer gepflegten Übersicht eine echte Hilfe, und Entwicklerinnen und Entwickler kopieren solche Dateien tatsächlich von Hand in ihre Werkzeuge. Zweitens der Nebeneffekt: Wer die Datei erzeugen will, muss zuerst entscheiden, welche dreißig Seiten die wichtigen sind. Diese Entscheidung fehlt in vielen Redaktionen, und sie nützt unabhängig davon, ob die Datei je abgerufen wird.
Dagegen spricht der Aufwand, sobald die Datei von Hand gepflegt wird. Eine veraltete Übersicht ist schlechter als keine. Erzeuge sie im Build aus derselben Quelle wie die Sitemap, oder lass es.
Was die Datei nicht ersetzt
llms.txt steuert keinen Zugriff. Wer bestimmte Kennungen aussperren oder zulassen will, tut das in der robots.txt oder serverseitig, nicht hier. Sie ersetzt auch keine sauberen HTML-Seiten: Wenn hinter den Verweisen Seiten stehen, deren Inhalt erst per Skript nachgeladen wird, hilft die beste Übersicht nichts.
Dazu passende Kurse
Wie du solche Standards einordnest, statt jeder Empfehlung hinterherzulaufen, behandeln die Weiterbildungen für technische Suchmaschinenarbeit .
Die redaktionelle Seite, also welche dreißig Seiten überhaupt die wichtigen sind, gehört zu den Angebote für Redaktion und Inhaltsplanung .
Wie sicher bist du beim Thema wirklich?
Lesen fühlt sich schnell nach Können an. Ein kurzer Test zeigt dir, was davon schon sitzt und wo sich ein Kurs lohnt. Kostenlos, ohne Anmeldung, mit einer Erklärung zu jeder Antwort.
Die Inhalte wurden sehr gut vermittelt und Fragen wurden perfekt beantwortet.
Marco ist ein extrem guter Trainer, der mit seinem Fachwissen zum Thema KI sehr viel Expertise mitbringt.
Seminarleiter war sehr gut vorbereitet, Den Lehrstoff hat er ausführlich und praxisorientiert vorgetragen.
Häufige Fragen
Brauche ich llms.txt, um in KI-Antworten aufzutauchen?
Wo genau muss die Datei liegen?
Was ist der Unterschied zu llms-full.txt?
Schadet die Datei, wenn niemand sie liest?
Deine Ansprechpartner
Du bist dir nicht sicher, welcher Kurs oder welches Level zu dir passt? Wir beraten dich persönlich und kostenlos.
Yves Hoppe
Weiterbildung & Beratung
Hilft dir, aus dem KI-Programm den passenden Kurs für deinen Stand zu finden.
Norbert Jansen
Beratung & Inhouse
Plant mit dir Inhouse-Trainings, die auf eure Abläufe und euren Datenbestand zugeschnitten sind.
Neue Standards ruhig einordnen
Wer versteht, wie Abruf und Auswertung tatsächlich ablaufen, entscheidet bei der nächsten Empfehlung dieser Art in einer Viertelstunde statt in einer Sitzung.