specification.website llms.txt v2 深度解读:如何让 AI 主动找到你,不用再猜根路径(附 rel=describedby 新玩法)
specification.website llms.txt v2 深度解读如何让 AI 主动找到你不用再猜根路径附 reldescribedby 新玩法【免费下载链接】specification.websiteWebsite specification — HTML, accessibility, security, SEO, agent-readiness. Platform-agnostic, sourced, MIT.项目地址: https://gitcode.com/gh_mirrors/sp/specification.website本文基于开源项目specification.website深度解读 llms.txt v2 规范llms.txt 是一个放在站点根目录的 Markdown 索引文件为 AI 提供你最重要的内容地图。v2 版本通过reldescribedby主动向 AI Agent 广播文件位置、按路径划分覆盖范围彻底告别猜根路径的旧玩法。文中附 HTTP Link 头实战示例与新手上手清单。llms.txt 是什么写给 AI 的站点 README/llms.txt是一个约定在你的站点根目录放一个纯 Markdown 文件给大语言模型一份人工筛选过的内容索引——哪些页面最重要、按什么顺序读一目了然。它和robots.txt是两回事别搞混了robots.txt是门禁决定谁可以访问、谁不能访问llms.txt是迎宾台不控制任何权限只是把最有价值的内容端到你面前。文件结构非常简洁# 站点名称 一句话简介 ## 板块名 - 页面标题: 一句说明一次抓取、零解析成本、没有导航和广告的干扰——这就是 AI 最喜欢它的理由。为什么 v1 是半成品让 AI 猜根路径v1 的核心假设是AI Agent 会主动来猜/llms.txt这个路径。这个假设有两个致命问题一个文件要为整个站点代言。根目录只有一份文件文档子站、博客、API 参考都挤不进去发了但不广播 白发。只有恰好已经假设了这条路径的 Agent 才能找到它其余人看都没看见。这正是 llms.txt v2 想要修复的失败模式。llms.txt v2 的三大变化v2 发布后llmstxt.org 提案在两年部署后完成修订核心就三件事 ① 用 reldescribedby 广播文件位置——不再猜路径这是 v2 唯一的硬性新增。你不再指望 AI 撞见根路径而是主动告诉它Link: /llms.txt; reldescribedby; typetext/markdowndescribedby是 IANA 注册表里的标准链接关系语义就是这里有一个机器可读的描述。可以写在 HTML 的head里可以写在 HTTP 响应头里也可以两者都写——响应头能触达那些根本不解析 HTML 的 Agent。② 按路径划分覆盖范围v2 支持路径级作用域/docs/llms.txt只描述/docs/下的页面/blog/llms.txt只描述博客。规则是文件覆盖其路径之下的页面最具体的文件获胜。大站不用再等一份没人愿意维护的全站文件可以一个板块一个板块地参与进来。③## Optional降级为纯约定v1 曾给## Optional标题赋予机器语义供上下文扩展工具识别v2 把这个语义连同配套工具一起删掉了。它现在只是一个写次要链接的有用惯例工具不会读它。reldescribedby 新玩法用 HTTP Link 头全时段广播HTTPLink响应头是link rel的兄弟——同样的语法、同样的注册关系区别是它跟着每个响应走包括 JSON 接口、PDF、甚至 304 空响应这些根本没有head的资源。实战要点只选IANA 注册的关系类型describedby、alternate、sitemap等自创 rel 会被爬虫无视URL 用尖括号...包裹多个链接用逗号分隔带上type和title参数让链接自带说明书Agent 不用多抓一次在CDN / 反向代理层配置最合适这样非 HTML 响应也能带上。specification.website 自己就是最佳示范在边缘配置public/_headers里每个响应都携带Link: /llms.txt; reldescribedby; typetext/markdownAI 无论从哪里进入站点都不需要猜一步。看看 specification.website 是怎么落地的这个站点把 llms.txt 当成了工程问题而非文档问题值得新手抄作业/llms.txt是构建期生成的生成逻辑在src/pages/llms.txt.ts和所有页面读同一份内容集合——页面结构一变索引自动跟着变不存在忘了更新配套/llms-full.txt把重点页面的完整 Markdown 拼接成一个文件小站点一次抓取拿全量上下文生成逻辑见src/content/spec/agent-readiness/llms-full-txt.md中的规范每页都有.md源码端点在任意页面 URL 后加.md即可拿到原始 Markdownllms.txt 里指向的链接因此点了就能用相关规范见src/content/spec/agent-readiness/markdown-source-endpoints.md。对应的规范文档和变更记录都在仓库里随手可查src/content/spec/agent-readiness/llms-txt.md— llms.txt 主规范已更新到 v2src/content/spec/agent-readiness/link-headers.md— Link 头发现机制src/content/changelog/2026-08-21-llms-txt-v2.md— 本次 v2 更新的变更记录5 分钟上手清单给你的站点加上 llms.txt v2 ✅建文件站点根目录放llms.txt首行# 站点名接一行摘要用##分板块列链接控制在几百行以内广播它head加link reldescribedby href/llms.txt或更好在响应头加Link: /llms.txt; reldescribedby; typetext/markdown双保险最稳指向 Markdown 源有.md端点就链接.md没有就先别乱指大站按路径拆/docs/llms.txt、/blog/llms.txt各管一摊最具体者优先验证直接抓取文件确认返回 200 和 Markdown再看响应头里reldescribedby是否真的存在。三个最容易踩的坑 ⚠️把它当 sitemap 罗列全站 URL要点是精选摘要里写营销话术模型会原样引用请说人话发布后不再维护过期的 llms.txt 比没有更糟——它在教模型错误的东西。常见问题Qllms.txt 是强制标准吗AI 真的在读吗A目前还是提案约定尚未成为正式标准模型厂商也从未公开确认自家爬虫是否读取它。但现实已经先行主流开发文档站普遍发布该文件Chrome 的 Lighthouse 也把它纳入了 agentic 浏览检查项。发布成本只是一个文件这笔账很划算。Q和 sitemap.xml 冲突吗A不冲突是互补。sitemap 穷举、只给机器看llms.txt 精选、人机共读。Q什么时候需要重新检查A每次信息架构调整之后。索引是承诺架构变了承诺就要跟着变。llms.txt v2 的本质变化只有一句话从等 AI 来猜变成告诉 AI 在哪。花五分钟把文件和reldescribedby配齐你的站点就完成了通往 AI 阅读时代的第一步。【免费下载链接】specification.websiteWebsite specification — HTML, accessibility, security, SEO, agent-readiness. Platform-agnostic, sourced, MIT.项目地址: https://gitcode.com/gh_mirrors/sp/specification.website创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

最新新闻

日新闻

周新闻

月新闻