llms.txt: KI-Assistent, der eine Frage beantwortet und die eigene Website als Quelle nennt

Herkunft des Vorschlags

Die llms.txt wurde im September 2024 von Jeremy Howard, einem bekannten KI-Forscher und Mitgründer von fast.ai, als Vorschlag veröffentlicht. Die Idee: Websites stellen unter der Adresse /llms.txt eine kurze Übersicht im Markdown-Format bereit, die Sprachmodellen erklärt, worum es auf der Website geht und wo die wichtigsten Informationen zu finden sind.

Der Hintergrund: Webseiten enthalten viel Navigation, Werbung, Skripte und Gestaltung. Für ein Sprachmodell mit begrenztem Kontextfenster ist es mühsam, daraus die eigentlichen Inhalte zu extrahieren. Eine kompakte Markdown-Datei könnte das erleichtern.

Aufbau

Der Vorschlag sieht eine einfache Struktur vor:

# SEOKönig

> SEO-Agentur aus Marienrachdorf im Westerwald mit 30 Jahren Erfahrung
> in Suchmaschinenoptimierung, Local SEO und Websites für viele Städte.

## Leistungen

- [SEO-Beratung](https://www.seokoenig.de/leistungen/seo-beratung): Strategie und Einzelberatung
- [Local SEO](https://www.seokoenig.de/leistungen/local-seo): Sichtbarkeit in Städten und Regionen

## Ratgeber

- [Was ist SEO?](https://www.seokoenig.de/ratgeber/was-ist-seo): Grundlagen verständlich erklärt
  • Eine H1 mit dem Namen der Website
  • Ein Zitatblock mit einer kurzen Zusammenfassung
  • Optional weitere Erläuterungen
  • Abschnitte mit Überschriften und Listen von Links mit kurzer Beschreibung

Ergänzend schlägt der Vorschlag vor, wichtige Seiten zusätzlich als Markdown-Version bereitzustellen und eine ausführliche Datei llms-full.txt mit dem gesamten relevanten Inhalt anzubieten.

Wer die Datei nutzt

Hier liegt der entscheidende Punkt: Die llms.txt ist ein Vorschlag, kein Standard, und die großen Anbieter haben sich bislang zurückhaltend geäußert.

  • Google hat erklärt, die llms.txt nicht zu nutzen. Google-Vertreter haben sie mit dem Keywords-Meta-Tag verglichen, also einer Angabe, die der Betreiber selbst macht und die deshalb wenig Aussagekraft hat.
  • Andere Anbieter haben keine verbindliche Unterstützung angekündigt. Einzelne Beobachtungen in Serverlogs zeigen gelegentliche Abrufe, aber keine systematische Nutzung durch die großen Such- und Antwortsysteme.
  • Entwicklerwerkzeuge und Dokumentationen: Die stärkste Verbreitung hat die llms.txt bei Softwaredokumentationen, wo Programmierwerkzeuge mit KI die Datei gezielt nutzen, um aktuelle Informationen zu einer Bibliothek zu laden.

Kein Rankingfaktor: Eine llms.txt verbessert weder Rankings in Google noch garantiert sie Nennungen in ChatGPT oder anderen Systemen. Wer das verspricht, verkauft mehr, als die Datei leisten kann.

Wann sich die Datei trotzdem lohnt

  • Geringer Aufwand: Für eine normale Website ist die Datei in kurzer Zeit erstellt, bei einem CMS mit Generator sogar automatisch.
  • Softwareanbieter und Dokumentationen: Hier gibt es einen echten Nutzen für Entwickler, die KI-Werkzeuge verwenden.
  • Vorbereitung auf künftige Nutzung: Sollte sich die Datei durchsetzen, ist man vorbereitet.
  • Ordnung schaffen: Die Erstellung zwingt dazu, die wichtigsten Inhalte der Website klar zu benennen, was auch für andere Zwecke hilfreich ist.

Was die Datei nicht ersetzt

Aufgabe Richtiges Werkzeug
Crawler erlauben oder sperren robots.txt
Alle Seiten für Suchmaschinen auflisten XML-Sitemap
Inhalte maschinenlesbar beschreiben strukturierte Daten
Sichtbarkeit in KI-Antworten Inhalte, Erwähnungen, klassisches SEO

Die llms.txt steuert nichts. Sie ist eine freiwillige Hilfe für Systeme, die sie lesen wollen. Wer KI-Crawler zulassen oder aussperren will, nutzt die robots.txt, siehe KI-Crawler.

Hinweise zur Umsetzung

  • Die Datei liegt im Stammverzeichnis unter /llms.txt.
  • Sie ist reiner Text im Markdown-Format, in UTF-8 kodiert.
  • Links sind absolute URLs.
  • Die Beschreibungen sind kurz und sachlich, ohne Werbesprache.
  • Die Datei wird aktualisiert, wenn sich wichtige Inhalte ändern, bei einer Website mit Generator automatisch.

Diese Website stellt selbst eine llms.txt bereit, die bei jeder Aktualisierung automatisch aus den Inhalten erzeugt wird.

Ein vollständigeres Beispiel

Für eine mittelgroße Unternehmenswebsite könnte eine llms.txt so aussehen:

# Müller Haustechnik

> Sanitär- und Heizungsbetrieb in Koblenz mit 25 Mitarbeitenden,
> tätig im Umkreis von 40 Kilometern. Schwerpunkte: Badsanierung,
> Wärmepumpen, Heizungswartung, Notdienst.

Gegründet 1987, Meisterbetrieb, Mitglied der Innung Koblenz.

## Leistungen

- [Badsanierung](https://www.example.de/badsanierung): Planung und Umbau, auch barrierefrei
- [Wärmepumpen](https://www.example.de/waermepumpe): Beratung, Förderung, Einbau, Wartung
- [Notdienst](https://www.example.de/notdienst): Erreichbarkeit, Einsatzgebiet, Kosten

## Ratgeber

- [Heizkörper entlüften](https://www.example.de/ratgeber/heizkoerper-entlueften): Schritt-für-Schritt-Anleitung
- [Förderung Wärmepumpe](https://www.example.de/ratgeber/foerderung-waermepumpe): aktuelle Programme und Ablauf

## Kontakt

- [Kontakt und Anfahrt](https://www.example.de/kontakt)

Die Datei ist kurz, sachlich und nennt die wichtigsten Einstiegspunkte. Mehr braucht es für die meisten Websites nicht.

Markdown-Versionen einzelner Seiten

Der Vorschlag sieht vor, dass Seiten zusätzlich unter derselben Adresse mit der Endung .md in einer reinen Textfassung erreichbar sind. Für Softwaredokumentationen ist das verbreitet, weil Entwicklerwerkzeuge diese Fassungen gezielt abrufen. Für normale Unternehmenswebsites ist der Nutzen derzeit gering. Wer es trotzdem umsetzt, sollte darauf achten, dass diese Fassungen nicht als doppelte Inhalte in den Suchindex gelangen, etwa durch ein Noindex im HTTP-Header oder einen Ausschluss in der robots.txt.

Kurz beantwortet

Muss ich eine llms.txt haben?

Nein. Es gibt derzeit keinen nachgewiesenen Nachteil, wenn sie fehlt. Wer den geringen Aufwand nicht scheut, kann sie anlegen.

Wird die llms.txt ein Standard?

Das ist offen. Die Entwicklung hängt davon ab, ob große Anbieter sie unterstützen. Bis dahin bleibt sie ein Vorschlag mit begrenzter Verbreitung.

Kann die llms.txt schaden?

Nicht, solange sie korrekte Informationen enthält. Eine Datei mit veralteten Angaben kann dagegen falsche Informationen verbreiten, wenn ein System sie liest.

Mehmet Oruc

Inhaber von SEOKönig · Ihr Personal SEO · Suchmaschinenoptimierung seit 30 Jahren

Informatikstudium, eigene Webkataloge und Suchmaschinen programmiert und verkauft, später Branchenportale, Onlineshops und rund 1.000 Webinstallationen für Kunden umgesetzt. Seit zwei Jahren arbeitet er intensiv mit KI-Systemen. Sein Schwerpunkt: komplexe Websites, die in vielen Städten und Themenfeldern gleichzeitig ranken müssen. Jeder Ratgeber entsteht aus dieser Projektpraxis und wird überarbeitet, sobald sich die Suchsysteme ändern.

Mehr über SEOKönig