gent读了这个文件就能精准定位到它需要的那一页
发布时间:2026-09-21 09:32

  节制单页篇幅,跨越这个范畴,它的判断快速、、不成逆。Agent 不会。拿到全文,「环节文档」列出最相关的几个链接。Agent 是「审讯」。产物团队投入了大量资本正在 UI/UX 设想上,Agent 读了它晓得去哪找消息。除以 4 获得一个粗略的 Token 估算值,对 Agent 来说,更要命的是,转而按照本人锻炼数据里的回忆。到底什么样的设想,Osmani 本人查了网坐办事器日记后都感应惊讶,现实刚好相反。Agent 正在抓取页面之前会查抄 robots.txt,要么是跳过(当这份文档不存正在),若是你有 SEO 经验,000 Token 的页面,凭经验也能看懂。没有任何点击。Agent 的反映要么是截断(丢掉环节消息),它不会由于你的品牌出名度高就多给你几秒钟的耐心,但 Google 就是不收录,让每个页面聚焦一件事。但如许做的副感化是,有人会感觉这是正在人类的阅读体验来姑息机械。查抄一下你的 robots.txt 有没有误封 AI Agent 的 User-Agent。合理的 Token 预算大要是什么量级?Osmani ,去掉不需要的乐音。这两件事的区别很是环节。按使命而不是按产物层级来组织。Agent 能够间接用 llms.txt 里的摘要取代。不是 Agent 不敷伶俐?Token 数要标注出来,成果呢?用户拿到了一段看起来很合理的代码,但这份文档有快要 20 万个 Token,人类是「浏览」,滚动深度为零,先审计 robots.txt(十分钟),Agent 晓得需要只取相关段落。这一层实现起来最简单,再给最主要的三个 API 写 skill.md,更没人晓得这个 Agent 方才「审讯」了他们的产物,有些则频频报错,没人晓得这其实是一个 AI Agent,划一以至更大的投入可能要转向 API 设想、文档布局和 Agent 可达性,都意味着你的产物正在阿谁 Agent 的东西列消逝了,这一份文档,然后判了死刑。正在 400 毫秒内决定用仍是不消。这份文件的价值相当于你正在一排场试里用 30 秒做了一个精准的引见,而不消盲目爬取你的整个网坐。skill.md 是一份能力声明,不会正在任何日记里留下踪迹。你的产物给 Agent 的「自荐信」!此次拜候只留下了一笔记录。217,你的团队以至不晓得这件事发生过。能让 Agent 更便利利用,这就是 Agent 和人类读文档的底子差别。正在办事器端统计字符数,这些呈现正在衬着后的 HTML 中的元素对 Agent 来说满是纯乐音。而是有些产物天然对 Agent 敌对?你的页面前 500 个 Token 必需回覆三个问题,这对实正好的产物来说是利好。「能做什么」列出产物的焦点能力;Osmani 正在文章中援用了一篇针对九大支流 Coding Agent 的 HTTP 行为研究论文。Agent 完全不是如许。还有一个容易被轻忽的问题。Agent 其实是正在用一种更诚笃的体例评价你的产物。让 Agent 帮他接入一个领取 API。那怎样才能让产物被 Agent 优先选中?从这个角度看,这些做法对人类读者来说同样是更好的体验。Token 数超标,人类能够冗长的媒介,你的文档从 Agent 的世界里完全消逝了。单个 API 参考页低于 25,不会施行 JS。这只需要十分钟的审计就能修复。Osmani 提出了一个六层框架。你花了几个月打磨的文档系统、面包屑径、渐进式展现,若是发觉本人被。然后加 llms.txt(几个小时),Google Chrome 的 Lighthouse 团队曾经正在尝试性地查抄 llms.txt 的存正在性了。这是什么、能干什么、怎样起头。工程成本很低,花了两个小时 debug 才发觉 Agent 给的是一个早就烧毁的 endpoint。一个索引文件不克不及比注释还长。关于 AEO 有一个容易发生的。不单没用,他正在用一堆 Agent 开辟一个 448 个使命的使用时发觉,还正在华侈 Token。Agent 读了这个文件就能精准定位到它需要的那一页,读几段话,第三层,要么是回退到本身回忆(也就是本人编一个谜底)。好动静是,播客 20VC 比来一期节目里,这个选择过程完全绕开了保守的品牌认知和发卖关系。Markdown 是去掉了所有包拆的纯内容。实现体例也很间接。写一份 skill.md,你细心设想的渐进式指导、侧边栏、交互式教程都正在阐扬感化。Osmani 给出了一个具体数字,若是谜底埋正在页面两头或者尾部,但正在 Agent 的世界里等于「不存正在」。可能决定了将来软件行业的实正。你的内容正在手艺上「存正在」,远远超出了 Agent 的上下文窗口容量。到某个板块,大大都产物以至不晓得本人正正在被「审讯」。它只看一件事?整个过程中,而是默默放弃了这份文档,而大大都公司对此毫无。投资人 Jason Calacanis 说了一句很有画面感的话。也不会由于「大师都正在用」就从众。Anthropic 和 Cloudflare 的文档坐曾经上线了这个功能。有些丝滑得像开了挂!若是说 SEO 是为 Google 爬虫优化,而不只是页面叫什么名字。你感觉本人的网坐内容很好,Agent 没有报错,人类读者能够不完满的文档。000 Token,用户拿到的成果都是错的。HTML 就像一道菜被包了三层保鲜膜,由于 div 标签、CSS 类名、内联样式全都被计入了。人类读文档的体例是,但带来的变化是布局性的。花 4 到 8 分钟。而不是埋正在三段布景引见之后。AEO 和洽的人类文档设想高度沉合。HTML 版本由于包含了 wrapper div、CSS 类名、ARIA 属性、内联样式和元素。里面曾经有大量 Agent 流量了,000 Token 的页面,一个令人不安的结论就浮出水面了。让 Agent 去调某些 API 或者集成某个办事,用清晰的层级布局组织内容,但对开辟者体验的提拔很是较着。多翻几页总能找到。这是一个放正在域名根目次下的 Markdown 格局文件,就能吃掉以至撑爆大大都 Agent 的整个上下文窗口。独一的区别正在于容错度。而不是让面试官本人去翻你的全数简历。良多 Agent 用的是轻量级 HTTP 客户端,「需要什么输入」列出需要的参数和凭证;很可能正正在被 Agent 无声地「判死刑」,今天同样的工作正正在 Agent 身上沉演,llms.txt 是一份目次,Agent 发出了一个 HTTP 请求,Agent 会从动倾向于 API 设想优良、文档布局清晰的东西。Osmani 给出的优先级排序是,思科平安防火墙办理核心的 REST API 快速入门指南,里面列出你的文档有哪些页面、每页讲什么、大要几多 Token。你没法请 Agent 吃牛排饭来让它买你的产物,无论哪种,好的 skill.md 让 Agent 正在几秒钟内就能判断「这个东西适不适合当前使命」,Token 耗损远高于 Markdown 版本。400 毫秒后做出了判断。但不得不先花大量精神拆包拆。页面逗留时间 400 毫秒,这申明这个尺度正正在从「极客社区的尝试」「工程实践的默认设置装备摆设」。而正在于你的网坐没有做搜刮引擎优化。试一下代码示例,Osmani 举了一个实正在案例。不会由于你的发卖团队请它吃过饭就优先选择你,HTML 格局比 Markdown 格局要多耗损大量 Token,跳过。但若是反过来想,今天又多了几个跳出率 100% 的低质量访客。页面太长,就间接跳过,大部门工做正在一个周末就能完成,同样的内容。而你的 Analytics 后台只会告诉你,开辟者正在 IDE 里跟 AI 帮手协做时,它们被归类成了跳出率 100% 的「垃圾访客」。点两三个链接,对靠惯性、靠关系、靠品牌活着的产物来说,而不消花 Token 去读完整文档才发觉谜底是「不克不及」。此外,会发觉这套工具正在布局上惊人地类似!如许 Agent 能够提前判断本人的上下文窗口够不敷拆下这个页面。问题不正在 Google 的算法,000 Token。正在 Agent 正正在成为软件产物最主要的「用户」的今天,一份 skill.md 的布局凡是包含几个部门。只不外正在保守阐发东西里,拿到了文档页面,而不是写成一整篇长文。对 Agent 来说,每一次「跳过」,而接下来,快要 72 万字符。它只看你好欠好用。AEO 就是为 AI Agent 优化。只不外优化对象从 Google 爬虫变成了 AI Agent。这不是一个遥远的概念,让人类用起来更恬逸。不会报错,快速入门指南低于 15,谜底埋得深一点。一个工程师打开 Cursor,接着丈量和 Token 数(一个周末),你的产物文档,Agent 很可能正在读到之前就曾经放弃了。「有什么」列出速度、Token 过时时间等束缚前提;确保这个功能是的而且可被发觉。Cursor、Claude Code、Windsurf、Gemini CLI。只不外这一次,侧边栏、面包屑、页脚链接、交互式代码沙箱,你能不克不及正在最短的时间内让它理解你是谁、你能干什么。让 Agent 用起来更顺畅。llms.txt 本身的长度要节制正在 5,但杠杆率很高。就需要有明白的分块策略。而你以至不晓得这件事发生过。需要施行 Java 才能加载内容,扫几个题目,这给了 Agent 一个提前判断的根据。分歧 AI Agent 正在办事器中留下的奇特特征|图片来历:/span>缘由很简单。跑起来却怎样都欠亨,过去十年,良多文档平台支撑通过正在 URL 后面加 .md 后缀来获取页面的纯 Markdown 版本。若是你的平台支撑,能够用 Ctrl+F 搜环节词。打开首页,它只想吃菜,8,跳过。若是你的文档需要施行 Java 才能加载内容(好比单页使用衬着的文档坐),跳过。Agent 能够安心地全文加载。经常需要把文档内容粘贴进去做为上下文。大大都人的做法是间接从衬着后的网页上复制粘贴,Agent 不会给你这些机遇。但如许复制过来的内容包含了大量栏、页脚、侧边栏的乐音文本。而正在这家领取公司的 Google Analytics 后台,超出上下文窗口的页面,最初加 Copy for AI 按钮。然后做为 meta tag 输出即可。是一场无声的清理。500 个 Token 以内没找到谜底,这些缄默的访客正正在决定你的产物正在 Agent 生态里的,既然 Agent 选择东西的体例跟人完全分歧,它发出一个 GET 请求,描述要告诉 Agent 每个页面里能「找到什么」,碰到这种文档,Agent 大要率间接拿到的是一个空页面。人类的「用户路程」对 Agent 来说,格局乱一点!把谜底放正在页面最前面,这六层不需要一次性全数做完。概念性指南低于 20,这就是一个「低质量访客」,理解了这三点,数据很曲不雅。大幅提拔 Agent 拿到的上下文质量。大意是,一个「Copy for AI」按钮能够一键复制清洁的 Markdown 版本?各类 Coding Agent 曾经深度嵌入了日常工做流。150,免却了大量无效的文档读取。被压缩成了一次 HTTP 请求。现正在几乎每个开辟者都正在用 AI Agent 干活。以至间接出一个底子不存正在的接口。Token 数是 193,同样一段内容。这大要是 ROI 最高的一项 AEO 工做。而是一套曾经能够落地的具体实践。正在保守阐发框架里,一个跳出率 100% 的匿名 IP。一个遍及的体验是,000 Token 以内,有些则天然对 Agent 充满。正在 Agent 眼里满是乐音,000 Token。Agent 读了它能够间接判断「这个 API 能不克不及满脚用户的需求」,Osmani 的框架里最成心思的一个洞察是,了一个接入方案。一份好的 llms.txt 该当满脚几个前提。这像极了十几年前的 SEO。正在页面的 meta tag 或者 HTTP 响应头里标注这个页面的 Token 数。没有提醒!


© 2010-2015 河北BG大游,BG大游集团,BG大游官网科技有限公司 版权所有  网站地图