Falcon Information – Zurück zur Startseite

Was ist eine Datei namens „llms.txt“? Format, praktische Anwendung und Bewertung der Ergebnisse.

`llms.txt` ist ein Dateiformat, das 2024 von der Community vorgeschlagen wurde. Es verwendet eine prägnante Markdown-Datei, um KI-Systemen eine schnelle und einfache Möglichkeit zu bieten, die Struktur und die wichtigsten Inhalte einer Website zu verstehen. Wir haben diese Lösung auf unserer Seite implementiert, aber wir möchten vorab Folgendes klarstellen: Google hat bereits erklärt, dass es `llms.txt` nicht verwendet. Es ist kein Standard, der für die Aufnahme oder Referenzierung von Inhalten erforderlich ist. Dieser Artikel erklärt Ihnen, wie Sie vorgehen können, und gibt Ihnen auch Auskunft darüber, welche Erwartungen Sie haben sollten.

Dieser Abschnitt

  • ·Ursprung und Positionierung
  • ·Formatrichtlinien
  • ·Art der Umsetzung auf dieser Seite
  • ·Ehrliche Bewertung der Wirksamkeit
  • ·Was sollte und was nicht eingesetzt werden?
  • ·Überprüfung nach der Implementierung

Woher stammt die Datei „llms.txt“? Was ist ihr Zweck?

Jeremy Howard von Answer.AI schlug llms.txt im 09/2024 aus einem praktischen Grund vor: Navigation, Werbung und Skripte überladen Webseiten und erschweren die Verarbeitung durch Sprachmodelle mit begrenztem Kontext. Eine klare Markdown-Zusammenfassung kann die Website und ihre wichtigsten Seiten beschreiben. Der Status ist entscheidend: Es handelt sich um einen Community-Vorschlag, nicht um einen offiziellen Standard einer Suchmaschine oder KI-Plattform. Davon sollte abhängen, wie viel Aufwand Sie investieren.

Wie sieht das Format aus?

Die Vorlage ist bewusst einfach gehalten und besteht aus einer Markdown-Datei, die im Stammverzeichnis der Webseite abgelegt wird. Die Struktur ist wie folgt: H1: Webseite-Name; Zitat (blockquote): Kurze Zusammenfassung der Webseite; H2: Liste mit Links, wobei jeder Link eine kurze Erklärung enthält. Zusätzlich gibt es eine optionale Datei namens "llms-full.txt", die den vollständigen Inhalt der Seite enthält und für Systeme gedacht ist, die lange Dokumente verarbeiten können. Beide Dateien sind reinen Textdateien und benötigen keine speziellen Überschriften.

  • H1: Name der Webseite oder des Projekts (erforderlich)
  • Zitat: Eine kurze Zusammenfassung eines Textes auf einer Webseite.
  • Abschnitt H2: Liste mit verknüpften Kategorien, jeweils mit einer Erklärung.
  • llms-full.txt (optional): Vollständige Version des Inhalts

Die Umsetzung auf dieser Seite: Dynamische Generierung, ohne manuelle Eingabe.

Wir verwenden im Next.js App Router den Route Handler, um sowohl `/llms.txt` als auch `/llms-full.txt` bereitzustellen. Der Inhalt dieser Dateien ist jedoch keine statische, von Hand erstellte Datei, sondern wird dynamisch aus derselben Datenquelle (den TypeScript-Dateien für Dienste, Fallstudien und Preise) generiert und während des Build-Prozesses mit `force-static` ausgegeben. Diese Lösung behebt das größte Problem bei manuell erstellten Dateien: Inkonsistenzen im Inhalt. Wenn Preise oder Dienstleistungen geändert werden, wird `/llms.txt` automatisch bei der nächsten Ausführung synchronisiert. Dadurch entstehen keine Situationen, in denen die Webseite und `/llms.txt` unterschiedliche Informationen enthalten – was für KI-Systeme zu veralteten Daten führen würde, und das wäre schlimmer als gar keine dieser Datei zu haben.

Ehrliche Bewertung der Ergebnisse: Google braucht es nicht

Dies sind Aspekte, die in den meisten Schulungen nicht erwähnt werden. Die offiziellen Google-Dokumente klären eindeutig, dass die KI-Funktionen keine zusätzlichen technischen Voraussetzungen erfordern. Auch die Mitglieder des Suchteams haben öffentlich erklärt, dass sie keine LLMs verwenden. Ob andere KI-Plattformen diese Dateien lesen und ob dies die Zitation beeinflusst, ist derzeit nicht offiziell bestätigt. Wir haben unsere eigenen Serverprotokolle überprüft und festgestellt, dass einige KI-Crawler diese beiden Dateien abgerufen haben. Allerdings ist „abgerufen“ und „Einfluss auf die Zitation“ zwei unterschiedliche Dinge, und die zweite Aussage lässt sich nicht überprüfen. Daher ist unsere Schlussfolgerung: „llms.txt“ ist eine kostengünstige Ergänzung, aber keine Kernaufgabe von GEO – die eigentliche Kernaufgabe besteht darin, den durchsuchbaren Inhalt und die primären Beweise zu verwalten.

Sollte es eingesetzt werden? Entscheidungskriterien

Gründe, die dafür sprechen: Sehr geringe Kosten (ein einziger Dateityp), keine bekannten Risiken, und falls die Plattform in Zukunft tatsächlich diese Technologie einsetzt, sind Sie vorbereitet. Gründe, die dagegen sprechen: Wenn jemand versucht, Sie für diese Dienstleistung zu bezahlen oder sie als "unverzichtbares Werkzeug für KI" zu verkaufen – dies steht im Widerspruch zu den offiziellen Positionen der Plattform und kann als Maßstab für die Glaubwürdigkeit des Anbieters dienen. Unsere Aussage an Kunden ist einheitlich: Es ist sinnvoll, dies zu tun, aber es hat eine geringere Priorität als technische SEO, Content-Evidence und Messungen.

Wie kann ich überprüfen, ob die Implementierung erfolgreich war?

Drei Dinge: Erstens, überprüfen Sie mit `curl` oder direkt über den Browser, ob die Antwort 200 lautet und der Inhalt aktuell ist. Zweitens, stellen Sie sicher, dass die Inhalte mit der Sitemap übereinstimmen – Seiten mit `noindex` sollten nicht in `llms.txt` erscheinen, da dies bedeutet, dass Sie den Inhalt, den Sie nicht öffentlich machen möchten, aktiv an das KI-System weitergeben. Drittens, überprüfen Sie regelmäßig die Serverprotokolle, um festzustellen, welche Crawler tatsächlich Inhalte extrahiert haben. Dies ist die einzige Quelle, um festzustellen, ob tatsächlich jemand auf die Inhalte zugreift.

Referenzen

Häufig gestellte Fragen

Was sind die Unterschiede zwischen „llms.txt“ und „sitemap.xml“?
`sitemap.xml` ist ein von Suchmaschinen unterstütztes Standardformat, das alle für die Indexierung geeigneten URLs auflistet, damit Suchmaschinen sie finden können. `llms.txt` ist ein Vorschlag der Community, der wichtige Website-Inhalte in einer für Menschen lesbaren Markdown-Datei beschreibt. Während `sitemap.xml` eine klare, offizielle Verwendung hat, gibt es derzeit keine Verpflichtung von Plattformen, `llms.txt` zu verwenden – beide dienen unterschiedlichen Zwecken und ersetzen sich nicht.
Ist die Datei „llms-full.txt“ unbedingt erforderlich?
Nicht unbedingt. Die Datei „llms-full.txt“ ist eine vollständige Version mit allen Inhalten und eignet sich für Websites, bei denen die Größe der Daten kontrolliert werden muss. Bei Websites mit vielen Seiten kann das Ausfüllen aller Inhalte zu großen Dateien führen, wodurch die wichtigsten Informationen verloren gehen. Auf unserer Seite wird „llms.txt“ für strukturierte Listen und „llms-full.txt“ für vollständige Absätze mit Dienstleistungen und Fallbeispielen verwendet.
Beeinflusst die Existenz von Dateien namens „llms.txt“ die KI-Referenzen?
Basierend auf den öffentlich verfügbaren Dokumenten der verschiedenen Plattformen ist dies nicht der Fall. Google verwendet diese Technologie ausdrücklich nicht. Auch andere Plattformen haben sie nicht als Voraussetzung festgelegt. Entscheidend bleibt weiterhin, ob der Inhalt überhaupt gecrawlt werden kann und ob er eine gewisse Glaubwürdigkeit aufweist. Es sollte als zusätzlicher Vorteil betrachtet werden, nicht als obligatorische Voraussetzung.

Haben Sie spezifische Anforderungen?

Kontaktieren Sie uns