// Study
llms.txt ist ein kuratierter Einstieg für Sprachmodelle. Die Datei ersetzt keine Website und keine Sitemap, sondern beschreibt relevante Inhalte, stabile URLs und ihren maschinenlesbaren Kontext.
robots.txt war ein Stoppschild. llms.txt ist ein Inhaltsverzeichnis. Es sagt nicht nur, was erlaubt ist, sondern was relevant ist.
Der kuratierte Pfad
Ein Agent braucht keine Navigation mit Hover-States. Er braucht kanonische URLs, präzise Summaries und stabile Bedeutungsanker. Genau deshalb erzeugt dieser Blog /llms.txt direkt aus dem Orbiter-Pod.
Die Datei ist klein, versionierbar im Build und nah am Inhalt. Jeder Eintrag verweist auf ein Dossier und trägt eine maschinenlesbare Summary.
// Test Run
Ein kleiner, kuratierter Agent-Index verbessert Orientierung und Retrieval gegenüber unstrukturiertem Crawling der gesamten Navigation.
Der aus content.pod generierte llms.txt-Endpunkt wird mit JSON Feed, Sitemap und Posts API verglichen. Geprüft werden kanonische URLs, Summaries, Aktualisierbarkeit und die gemeinsame Inhaltsquelle.
Es gibt noch keine Messung mit mehreren externen Sprachmodellen und keinen llms-full.txt-Endpunkt. Die Wirkung auf Retrieval-Qualität ist daher noch nicht quantifiziert.
- llms.txt wird beim Build direkt aus veröffentlichten Orbiter-Dossiers erzeugt.
- Alle Einträge verwenden dieselben kanonischen a83tech.com-URLs wie Feed, Sitemap und API.
- Machine Summaries werden nicht aus dem gerenderten DOM zurückgewonnen, sondern als redaktionelle Felder gepflegt.
- Der kompakte Index verweist auf detailliertere HTML- und JSON-Repräsentationen.
- Ein kuratierter Index ergänzt robots.txt und Sitemap, übernimmt aber nicht deren Aufgaben.
- Stabile Dossier-IDs und kanonische URLs sind wichtiger als eine große Menge automatisch erzeugter Metadaten.
- Die Qualität des Agent-Einstiegs hängt direkt von gepflegten Summaries, Claims, Quellen und Beziehungen ab.
- Welche Inhalte gehören in den kompakten Index und welche ausschließlich in llms-full.txt?
- Wie erkennen Agents aktualisierte oder ersetzte Dossier-Versionen?
- Soll der Index zusätzlich Beziehungen und Claim-Status ausgeben?
// Claims / Evidence
llms.txt kann als kuratierte Inhaltskarte dienen.
Kuratierte Summaries sind verlässlicher als rein automatische DOM-Extraktion.
Ein Agent-Index verbessert Retrieval-Qualität.
// Compare
- lead: Crawler aussperren war gestern. Wer heute gefunden werden will, deckt den Tisch: kuratierte Inhaltspfade für Sprachmodelle.
- cadence: essay
- visual: paired with figure
Crawler aussperren war gestern. Wer heute gefunden werden will, deckt den Tisch: kuratierte Inhaltspfade für Sprachmodelle.
robots.txt war ein Stoppschild. llms.txt ist ein Inhaltsverzeichnis. Es sagt nicht nur, was erlaubt ist, sondern was relevant ist.
Der kuratierte Pfad
Ein Agent braucht keine Navigation mit Hover-States. Er braucht kanonische URLs, präzise Summaries und stabile Bedeutungsanker. Genau deshalb erzeugt dieser Blog /llms.txt direkt aus dem Orbiter-Pod.
Die Datei ist klein, versionierbar im Build und nah am Inhalt. Jeder Eintrag verweist auf ein Dossier und trägt eine maschinenlesbare Summary.
- Es sagt nicht nur, was erlaubt ist, sondern was relevant ist.
- Der kuratierte Pfad Ein Agent braucht keine Navigation mit Hover-States.
- Er braucht kanonische URLs, präzise Summaries und stabile Bedeutungsanker.
- Genau deshalb erzeugt dieser Blog /llms.txt direkt aus dem Orbiter-Pod.
- Die Datei ist klein, versionierbar im Build und nah am Inhalt.
summary: curated markdown index at /llms.txt as canonical content map.
category: Protocol
keywords: [llms-txt, rag, content-map]
tokens: 1800
minutes: 8
slug: llms-txt-ist-das-neue-robots-txt
// Sources
- The /llms.txt file Jeremy Howard (2024). The /llms.txt file. llms-txt. https://llmstxt.org/
- JSON Feed Version 1.1 Brent Simmons; Manton Reece (n.d.). JSON Feed Version 1.1. JSON Feed. https://www.jsonfeed.org/version/1.1/
- Sitemaps XML format sitemaps.org (n.d.). Sitemaps XML format. sitemaps.org. https://www.sitemaps.org/protocol.html
- Robots Exclusion Protocol (RFC 9309) M. Koster; G. Illyes; H. Zeller; L. Sassman (2022). Robots Exclusion Protocol (RFC 9309). RFC Editor. https://www.rfc-editor.org/info/rfc9309/
// Live Context / LLMS
LLMS block
title: llms.txt ist das neue robots.txt — nur höflicher canonical: /blog/llms-txt-ist-das-neue-robots-txt source: content.pod/posts/llms-txt-ist-das-neue-robots-txt summary: curated markdown index at /llms.txt as canonical content map. human_summary: llms.txt ist ein kuratierter Einstieg für Sprachmodelle. Die Datei ersetzt keine Website und keine Sitemap, sondern beschreibt relevante Inhalte, stabile URLs und ihren maschinenlesbaren Kontext. keywords: llms-txt, rag, content-map category: protocol content_type: protocol language: de version: 2.0 review_status: human-reviewed author: Abteilung83 ai_contribution: Vergleich der maschinenlesbaren Endpunkte, Strukturierung der Testbeobachtungen, Validierung kanonischer URLs tokens: 1800 minutes: 8 findings: Ein kuratierter Index ergänzt robots.txt und Sitemap, übernimmt aber nicht deren Aufgaben. | Stabile Dossier-IDs und kanonische URLs sind wichtiger als eine große Menge automatisch erzeugter Metadaten. | Die Qualität des Agent-Einstiegs hängt direkt von gepflegten Summaries, Claims, Quellen und Beziehungen ab. sources: https://llmstxt.org/, https://www.jsonfeed.org/version/1.1/, https://www.sitemaps.org/protocol.html, https://www.rfc-editor.org/info/rfc9309/ relationships: supports:0x2F, references:0x2D suggested_prompts: - Welche Aufgabe erfüllt llms.txt im A83-System? - Vergleiche llms.txt, Sitemap und JSON Feed. - Welche Grenzen hat der aktuelle Agent-Index?