llms.txt
Technischer Begriff
seit 2024
Community-Standard für KI-Crawler-Steuerung
llms.txt ist eine kurze Markdown-Datei im Wurzelverzeichnis deiner Website, die KI-Systemen eine kuratierte Übersicht deiner wichtigsten Inhalte liefert. Sie ist kein Gesetz und kein anerkannter Standard, aber sie ist eine öffentliche Aussage über dein Geschäft, die dieselbe Sorgfalt verdient wie jeder andere Werbetext.
→ InGuide-Guide
Guide zum Thema
Zehn Kapitel als PDF, mit Prüf-Ablauf und Checkliste zum Ausdrucken.
Was llms.txt ist
llms.txt ist eine einfache Textdatei im Markdown-Format, die am Wurzelverzeichnis einer Website liegt, unter https://deine-domain.de/llms.txt. Sie fasst zusammen, worum es auf der Seite geht, und verlinkt in kurzen Ein-Satz-Beschreibungen auf die Inhalte, die für ein KI-System am wichtigsten sind.
Vorgeschlagen wurde das Format im September 2024 von Jeremy Howard über das Projekt Answer.AI, als Reaktion auf ein konkretes Problem: Sprachmodelle haben nur ein begrenztes Kontextfenster, und eine vollständige Sitemap mit hunderten Seiten hilft ihnen dabei wenig. llms.txt soll stattdessen eine kuratierte, priorisierte Sicht liefern, direkt aus der Perspektive dessen, was für eine Maschine in diesem Moment relevant ist.
Die Datei bleibt bewusst simpel: ein Titel als Überschrift, ein einleitender Absatz als Kurzfassung, danach thematisch geordnete Abschnitte mit Links. Manche Anbieter ergänzen zusätzlich eine llms-full.txt, die denselben Inhalt ausführlicher oder als Volltext bereitstellt.
Wie sich das von robots.txt und sitemap.xml unterscheidet
Alle drei Dateien liegen am Wurzelverzeichnis, verfolgen aber unterschiedliche Zwecke. robots.txt regelt Zugang: Es sagt Crawlern, welche Bereiche sie besuchen dürfen und welche nicht, seit den neunziger Jahren ein etablierter Standard. sitemap.xml liefert ein vollständiges Inventar aller Seiten, meist maschinell generiert, ohne Gewichtung oder Auswahl.
llms.txt tut keines von beidem. Es sperrt nichts und listet nicht vollständig auf, sondern kuratiert: eine bewusste, redaktionelle Auswahl der Inhalte, die am ehesten eine gute Antwort tragen, mit einer kurzen Einordnung, warum das jeweils gilt. Das macht die Datei zu einer inhaltlichen Aussage, nicht zu einer technischen Auflistung.
Aufbau
Die vier Bausteine einer guten llms.txt
Die Datei bleibt bewusst schlicht. Vier Elemente tragen die gesamte Wirkung.
Vier Bausteine, zum Durchtippen
Name des Angebots, in einem Satz.
Hilft Klarer, eindeutiger Name, identisch mit dem Titel auf der Startseite.
Stolperfalle Ein Marketing-Slogan statt des tatsächlichen Namens, den niemand wiedererkennt.
Ein Absatz, der zusammenfasst, worum es geht.
Hilft Ein bis drei Sätze, die auch ohne Kontext verständlich sind.
Stolperfalle Eine lange Unternehmensvision ohne konkrete Angabe, was die Seite anbietet.
Themen-Blöcke mit kurzen Ein-Satz-Beschreibungen.
Hilft Jeder Link führt auf eine erreichbare Seite, die Beschreibung stimmt mit dem Seiteninhalt überein.
Stolperfalle Ein Link aus einer alten Kampagne, die Zielseite existiert längst nicht mehr.
Dieselben Inhalte ausführlicher, für Systeme mit größerem Kontextfenster.
Hilft Wird bei größeren inhaltlichen Änderungen automatisiert neu erzeugt.
Stolperfalle Einmalig von Hand erstellt und seither nie wieder angefasst.
Der verbreitete Irrtum
In vielen Ratgebern wird llms.txt so beschrieben, als würde sie automatisch für bessere Sichtbarkeit in KI-Antworten sorgen, vergleichbar mit einer Ranking-Stellschraube. Das trifft nicht zu. Die Datei ist kein anerkannter Standard einer Normungsorganisation; Stand Sommer 2026 liegt beim W3C ein erster Entwurf zur Standardisierung vor, mit offener öffentlicher Kommentierungsphase, aber noch keine verbindliche Fassung. Welche Systeme die Datei überhaupt abrufen und wie stark sie sie gewichten, unterscheidet sich von Anbieter zu Anbieter und ändert sich laufend.
Wer beides verwechselt, verspricht sich von einer einzigen Datei mehr, als sie halten kann. Die belastbare Formulierung lautet: llms.txt kann helfen, wo Systeme sie tatsächlich abrufen und auswerten, ersetzt aber nirgendwo inhaltliche Substanz, korrekte Auszeichnung oder technische Auffindbarkeit. Eine gepflegte Datei ist ein zusätzliches Signal, kein Ersatz für den Rest.
Wie ist dein Stand einzuordnen?
Der Zustand einer llms.txt liegt selten bei null oder hundert. Die vier typischen Lagen unterscheiden sich vor allem im Risiko.
Wähle die Lage, die auf dich zutrifft
Zeitleiste
Vom Community-Vorschlag zum W3C-Entwurf
Wie sich llms.txt seit 2024 entwickelt hat.
- 09/2024
Jeremy Howard schlägt llms.txt vor
Über das Projekt Answer.AI entsteht die erste Spezifikation als Reaktion auf begrenzte Kontextfenster von Sprachmodellen.
- Ende 2024
Anthropic bestätigt Unterstützung
Claude beginnt, llms.txt-Dateien bei unterstützenden Websites auszuwerten.
- Mitte 2025
Perplexity folgt
Weitere KI-Suchsysteme übernehmen das Format, dazu Entwicklungswerkzeuge wie Cursor und GitHub Copilot.
- 06/2026
W3C veröffentlicht ersten Standardisierungs-Entwurf
Der Entwurf 'AI Crawler Guidance Standardization' geht in eine öffentliche Kommentierungsphase von 90 Tagen. Noch keine verbindliche Fassung.
- laufend
Uneinheitliche Umsetzung bei den Anbietern
Kernsyntax gilt als stabil, Details werden von einzelnen Plattformen weiterhin unterschiedlich ausgewertet.
Wo llms.txt zum Compliance-Thema wird
Dieser Teil fehlt in den meisten Anleitungen. llms.txt ist keine Dekoration, sondern eine öffentliche Aussage über dein Geschäft, formuliert von dir selbst, in einer Datei, die jeder abrufen kann, Mensch wie Maschine. Was dort steht, muss stimmen.
Zwei Stellen sind besonders empfindlich. Die Ein-Satz-Beschreibungen neben jedem Link sind Werbeaussagen im Kleinen: Wer dort einen veralteten Preis, eine nicht mehr gültige Eigenschaft oder ein eingestelltes Angebot nennt, macht dieselbe Aussage wie im sichtbaren Seitentext, nur an einer Stelle, die selten jemand prüft. Und die Auswahl selbst kann irreführend wirken, wenn sie systematisch Pflichtangaben ausblendet und stattdessen nur werbewirksame Inhalte hervorhebt, während anderswo der Eindruck erweckt wird, die Datei sei ein vollständiges Verzeichnis.
Verschärfend kommt hinzu, dass tote Links in llms.txt leichter automatisiert entdeckt werden als ein einzelner kaputter Link mitten im Menü. Ein KI-System, das der Datei folgt und auf einer Fehlerseite landet, wertet das als Signal, dass die Datei nicht gepflegt wird, und das kann sich auf die Bewertung der ganzen Domain auswirken.
Die daraus folgende Grundregel gilt ohne Ausnahme: Jede Beschreibung und jeder Link in llms.txt muss mit der tatsächlichen Seite übereinstimmen, so wie sie heute aussieht, nicht so wie sie beim Erstellen der Datei aussah.
Was du konkret tun kannst
Fang mit den vier Bausteinen aus dem Abschnitt oben an: ein klarer Titel, eine ehrliche Kurzfassung, thematisch geordnete Abschnitte mit wenigen, aber richtigen Links. Widerstehe der Versuchung, die Datei als zweite Sitemap zu behandeln und alles hineinzupacken.
Prüfe anschließend jeden verlinkten Eintrag gegen die Zielseite: Ist der Link noch erreichbar, stimmt die Ein-Satz-Beschreibung noch, gibt es inzwischen eine treffendere Seite dafür. Genau hier hilft dieselbe Ein-Quelle-Logik wie bei anderen maschinenlesbaren Dateien: Wird llms.txt aus demselben System gespeist, das auch Navigation und Sitemap erzeugt, kann sie nicht unbemerkt veralten. Wird sie von Hand gepflegt und irgendwann vergessen, veraltet sie garantiert.
Für die Einzelprüfung reichen einfache Werkzeuge: ein Link-Checker für die Erreichbarkeit, ein Blick in die Analytics-Daten, ob KI-Crawler die Datei überhaupt abrufen, und die Frage an einen KI-Assistenten selbst, was er über deine Seite weiß. Was diese Werkzeuge nicht leisten, ist die inhaltliche Prüfung gegen alle 20 AppCore-Lösungen gleichzeitig, und genau das ist die Lücke, die der kostenlose Audit schließt.
Nächster Schritt
Vom Befund zur laufenden Pflege
llms.txt ist eines von vielen Signalen, die der AppCore Audit im Zusammenhang prüft.
AppCore Audit
Prüft deine Seite gegen alle 20 Lösungen auf einmal, einschließlich einer vorhandenen llms.txt.
Kostenfreien Audit startenAppCore CMS²
Der Umzug in ein compliance-natives System, in dem llms.txt und Navigation aus derselben Quelle stammen und nicht mehr auseinanderlaufen können.
Preis berechnenJahres-Abo
Laufende Überwachung: Drift-Monitoring schlägt an, sobald geprüfte Inhalte nachträglich abweichen, auch außerhalb der sichtbaren Seite.
So funktioniert das SystemDiagnose → Umzug → Vorsorge
Dieser Begriff erklärt das Prinzip. Ob deine eigene llms.txt-Datei vorhanden, aktuell und korrekt ist, zeigt dir der kostenlose Audit.