llms.txt: wozu die Datei da ist

Eine llms.txt ist eine einfache Textdatei im Wurzelverzeichnis, die einer KI in klarer Sprache sagt, worum es auf der Website geht und welche Seiten die wichtigsten sind. Sie ist kein verbindlicher Standard und ersetzt nichts, aber sie kostet eine Stunde und schadet nicht.
- Die llms.txt liegt unter /llms.txt und ist reines Markdown, kein XML wie die Sitemap.
- Sie ist ein Vorschlag aus der Praxis, kein von Google oder OpenAI bestätigter Standard.
- Kein Anbieter garantiert, dass er sie liest. Der Aufwand ist trotzdem gering genug, um es zu tun.
- Sie ersetzt weder Sitemap noch robots.txt noch gute Inhalte, sie kommt dazu.
- Getrennt davon ist die Entscheidung, ob KI-Crawler die Website lesen dürfen. Die steht in der robots.txt.
- Für regionale Betriebe ist Aussperren fast immer die falsche Entscheidung.
- Sinnvoll aufgebaut: Was ist das für ein Betrieb, was bietet er an, welche Seiten beantworten welche Frage.
Seit Antwortmaschinen Websites lesen, gibt es einen Vorschlag, wie man es ihnen leichter machen kann: eine Datei namens llms.txt. Sie wird in Fachkreisen viel diskutiert und von Betrieben selten umgesetzt.
Dieser Beitrag erklärt, was sie ist, was sie nicht ist, und wie eine sinnvolle für einen Handwerks- oder Industriebetrieb aussieht.
Was die llms.txt ist
Eine Textdatei unter `https://ihre-domain.de/llms.txt`, geschrieben in Markdown. Sie enthält in klarer Sprache:
- Wer der Betrieb ist und was er macht
- Welche Seiten es gibt und wofür sie da sind
- Wo die wichtigsten Antworten stehen
Der Gedanke dahinter ist einfach: Eine Website enthält viel Beiwerk, Navigation, Fußzeile, Schaltflächen. Ein Sprachmodell muss das erst aussortieren. Die llms.txt liefert stattdessen die Zusammenfassung direkt.
Was sie nicht ist: kein offizieller Standard, keine Garantie, kein Ersatz für die Sitemap. Sie wird von den großen Anbietern bisher nicht offiziell unterstützt.
- robots.txt: wer darf lesen
- sitemap.xml: welche Adressen gibt es
- Strukturierte Daten: was bedeutet was
- llms.txt: worum geht es hier
- Keine Zusicherung durch Anbieter
- Aufwand: etwa eine Stunde
Wie eine sinnvolle llms.txt aussieht
Kurz, konkret, ohne Werbesprache. Ein Aufbau, der sich bewährt hat:
Kopf: Name des Betriebs, ein Satz, was er macht, für wen, in welchem Gebiet.
Abschnitt Leistungen: Je Leistung eine Zeile mit Adresse und einem Satz, was dort steht.
Abschnitt Antworten: Die wichtigsten Fragen mit Verweis auf den Beitrag, der sie beantwortet.
Abschnitt Fakten: Gründungsjahr, Mitarbeiterzahl, Einzugsgebiet, Kontakt. Genau die Angaben, die eine Maschine sonst mühsam zusammensuchen müsste.
Wichtig ist der Ton: Kein Marketing. Ein Modell zitiert keine Superlative, es zitiert Angaben. „Ab 2.500 Euro einmalig" ist brauchbar, „führender Anbieter" ist es nicht.
Die andere Frage: KI-Crawler zulassen oder aussperren?
Das ist eine getrennte Entscheidung und wird in der robots.txt getroffen. Die großen Anbieter nutzen eigene Kennungen, etwa GPTBot, ClaudeBot, PerplexityBot und Google-Extended.
Wer sie aussperrt, kommt in den Antworten nicht vor. Für einen regionalen Betrieb ist das fast immer die falsche Entscheidung: Sie geben Sichtbarkeit auf und gewinnen nichts, weil Ihre Inhalte nicht Ihr Produkt sind.
Anders liegt es bei Verlagen, Kursanbietern oder Datenbanken, deren Inhalte selbst verkauft werden. Dort ist es eine echte Abwägung.
Ein häufiges Missverständnis: Das Aussperren von KI-Crawlern hat mit der klassischen Google-Suche nichts zu tun. Diese läuft über den normalen Googlebot und bleibt unberührt, es sei denn, man sperrt versehentlich beide aus. Genau das ist der teuerste Fehler in diesem Bereich.
Unsicher, was in Ihrer robots.txt steht?
Wir sehen nach, welche Crawler zugelassen sind und ob versehentlich etwas gesperrt ist. Dreißig Minuten per Google Meet, kostenlos.
Analysegespräch buchenSchritt 01 findet regelmäßig echte Probleme: In gewachsenen Websites steht gelegentlich noch eine Sperre aus der Bauphase.
Lohnt sich der Aufwand?
Ehrliche Antwort: Es gibt keinen Beleg dafür, dass eine llms.txt heute die Sichtbarkeit in KI-Antworten verbessert. Kein Anbieter bestätigt, dass er sie auswertet.
Wofür sie trotzdem gut ist:
- Sie zwingt zur Klarheit. Wer die zwanzig wichtigsten Seiten in je einem Satz beschreiben muss, merkt schnell, welche Seite keinen klaren Zweck hat.
- Sie kostet fast nichts. Eine Stunde einmalig, zweimal im Jahr zehn Minuten.
- Sie schadet nicht. Anders als manche technische Maßnahme gibt es kein Risiko.
Unsere Haltung: mitnehmen, aber nicht darauf bauen. Was tatsächlich über die Sichtbarkeit in KI-Antworten entscheidet, ist der Aufbau der Inhalte selbst.
Ein Muster für einen Handwerksbetrieb
Damit es greifbar wird, ein vollständiger Aufbau. Übernehmen Sie die Struktur, nicht die Angaben.
Kopfzeile: Der Betriebsname als Überschrift, darunter zwei Sätze: Was der Betrieb macht, für wen, in welchem Gebiet. Beispiel: „Elektrotechnik für Privatkunden und Gewerbe im Rems-Murr-Kreis. Schwerpunkte: Sanierung im Bestand, Wallboxen, Störungsdienst."
Abschnitt Leistungen: Je Zeile ein Verweis auf die Seite und ein Halbsatz dazu. „/wallbox/, Installation von Ladepunkten für Privathaushalte, Preisrahmen und Ablauf."
Abschnitt Häufige Fragen: Die Beiträge, die Fragen beantworten, mit der Frage als Beschreibung. „/blog/zaehlertausch-dauer/, Wie lange ein Zählertausch dauert und was er kostet."
Abschnitt Fakten: Gegründet, Mitarbeitende, Einzugsgebiet, Telefonnummer, Öffnungszeiten. Diese Angaben in einer maschinenlesbaren Form an einer Stelle zu haben, ist der praktischste Teil der ganzen Datei.
Ein Hinweis zur Länge: Für einen Betrieb mit fünfzehn Seiten sind fünfzig bis achtzig Zeilen richtig. Wer dreihundert Zeilen schreibt, hat eine zweite Sitemap gebaut, und die gibt es schon.
Was in der robots.txt stehen sollte
Bevor Sie über die llms.txt nachdenken, sollte die robots.txt sauber sein. Für einen regionalen Betrieb sieht sie typischerweise so aus:
- Alle Suchmaschinen erlauben. Kein pauschales Disallow.
- KI-Crawler erlauben, GPTBot, ClaudeBot, PerplexityBot, Google-Extended. Wer nicht gelesen wird, wird nicht zitiert.
- Verwaltungsbereiche sperren. Backend, Testumgebungen, interne Dateien.
- Sitemap angeben. Eine Zeile mit der vollständigen Adresse der Sitemap.
Zwei Fehler, die wir regelmäßig finden:
Die Sperre aus der Bauphase. Während der Entwicklung wird oft alles gesperrt. Wenn das beim Start niemand entfernt, ist die Website für Suchmaschinen unsichtbar, und niemand merkt es, weil die Seite ja aufrufbar ist.
Das Sperren von Bildern oder CSS. Wer Verzeichnisse mit Gestaltung oder Bildern sperrt, hindert Google daran, die Seite so zu sehen wie ein Besucher. Das kann die Bewertung der Darstellung auf Mobilgeräten beeinträchtigen.
Beide Fehler sind in fünf Minuten geprüft: Rufen Sie /robots.txt auf und lesen Sie, was dort steht.
Häufige Fragen
Ersetzt die llms.txt die Sitemap?
Nein. Die Sitemap listet alle Adressen für Suchmaschinen und ist etabliert. Die llms.txt beschreibt in Sprache, worum es geht, und ist es nicht.
Wie lang sollte sie sein?
Eine bis drei Bildschirmseiten. Wer die gesamte Website hineinkopiert, verfehlt den Zweck, es geht um Orientierung, nicht um Vollständigkeit.
Kann ich damit steuern, was über mich gesagt wird?
Beeinflussen ja, steuern nein. Was ein Modell antwortet, hängt von vielen Quellen ab, nicht nur von Ihrer Website.
Was ist mit Google-Extended?
Das ist die Kennung, mit der Google steuert, ob Inhalte für die KI-Produkte verwendet werden. Sie zu sperren beeinflusst die normale Suche nicht, nimmt Sie aber aus den Antworten heraus.
Haben Sie selbst eine?
Ja, unter webkreativagentur.de/llms.txt. Sie enthält Leistungen, Preise als Spanne, Einzugsgebiet und die wichtigsten Beiträge.
Der nächste Schritt
Rufen Sie zuerst Ihre robots.txt auf. Wenn dort ein pauschales Disallow steht, ist das dringender als jede llms.txt.
Verwandte Beiträge: KI-Suche: wie man in AI Overviews zitiert wird und KI-Suchmaschinen: wie Menschen jetzt suchen. Unser Vorgehen steht unter SEO für Industrieunternehmen. Oder anrufen unter 07903 943946.