
开放知识格式 v0.2 增加了信任层,但尚无 AI 代理读取。其真正价值在于迫使网站所有者以机器视角审视内容,通过诚实回答“来源、时效、背书”三问,揭示网站的结构与信任缺口。
一个由页面组成的网站,只给了机器所需信息的一半。它可以独立读取每个页面,但没有任何东西告诉它页面之间的关系,也没有任何东西告诉它正在阅读的内容是否仍然真实。这是两个独立的缺口。一段时间里,我只关注了第一个。Google 的开放知识格式(Open Knowledge Format,简称 OKF)是迄今我发现的最接近同时审视这两者的方法。
今年六月,我为这个网站构建了一个 OKF 包:八个相互链接的 Markdown 文件,每个对应一个概念。当时我说,这是押注于一个尚不存在的读者,因为今天没有 AI 代理会读取网站的 OKF 包,也许永远不会有。这仍然是事实。但我没有明确说的是,读者从来不是重点。
页面本身从来不是理所当然的。我们从印刷品中继承了这种形式——网站就像一排杂志版面,有首页、栏目、一堆整齐的小包——以至于我们习惯了,不再意识到这是一种选择。当技术 SEO 专家 Jono Alderson 做客播客时,他将我们都复制的这种形态归因于 Google 对网站应有样子的印记,并称剩下的大部分只是宣传册,一个曾经是信息源的躯壳。
机器从未同意过这一切。它不想要你的主页;它想要的是意义以及各部分如何连接。页面从来只是为我们人类准备的,也许,一直以来,都有点愚蠢。
目前,OKF 的价值与机器读取你的包无关。将来可能更有价值,如果代理真的读取已发布的包,那么已经拥有包的网站会领先一步。但今天,价值在于另一件事:构建一个 OKF 包会迫使你以机器的方式审视你的网站和你的业务。
这听起来很软,直到你真正尝试。要编写一个包,你必须说明你实际知道什么,哪些概念重要,以及它们如何相互连接。大多数网站从未声明过这些。它们有页面,而页面之间的关系只存在于某人的头脑中。当你将它们以机器可跟踪的图形形式写下来时,你会发现那些你一直含糊不清的部分。
我在六月找到了自己的含糊之处。编写包迫使我用机器可跟踪的形式声明:WebMCP 位于 Machine-First Architecture 之下,llms.txt 与其余身份工作属于同一种赌注。这些关系是真实的,但网站上没有任何地方体现。它们只存在于我的头脑中,而一个逐页读取的机器永远无法恢复它们。声明它们不是无用功。这是 No Hacks 所知的知识形态第一次存在于我之外。
所以,首先要澄清:任何将 OKF 视为“实现它然后被引用”的人,都搞反了。没有任何东西会引用它。它是一个穿着导出格式外衣的自我审计。应将其视为对机器需要你提供什么的描述,而非你部署的产品。
六月的包处理了第一个缺口:结构。每个概念相互链接,因此机器可以看到平面页面从未明说的关系。7月25日发布的 v0.2 增加了第二个缺口:信任。它为每个概念添加了一小组字段:内容来源、生产者及时间、验证者及验证者是人还是机器、何时应视为过时,以及生命周期状态。
这些都不令人兴奋。它们是本应一直存在的元数据,让机器不仅能问“你说了什么”,还能问“我能相信它吗”。
值得注意的设计选择是 Google 留白的地方。它记录信号,但不计算信任分数。其理由,用其原话:“分数是主观的,不能跨消费者移植,写下的那一刻就过时了。”消费者读取原始信号并自行决定。这是正确的做法,与行业其他部分不断做出的举动相反——给你一个它对自己工作产生的单一数字,并要求你信任它。可检查的记录信号胜过被告知相信的分数。
我将自己的包升级到 v0.2,看看需要什么。添加字段很快。但诚实地填写它们并不快,而这正是镜子变得锋利的地方。
让我停下的字段是“过时日期”——机器应在该时间点停止信任概念,除非重新检查。它迫使你做出一个通常可以回避的决定:这个内容实际上老化得多快。我的 llms.txt 概念设置了三个月,因为围绕它的故事不断变化。我的 Machine-First Architecture 概念设置为一年,因为框架变化不大。v0.1 让我假装每个概念都同样新鲜。v0.2 让我明确说出哪些会腐烂。
v0.2 中我无法使用的一个部分值得承认,因为它告诉你该格式的真正用途。v0.2 添加了一种发布数字及重新计算它的认可方式。我的包是概念而非指标,所以没有可证明的东西。这没问题。它为数据管道而建,而非知识地图,假装否则就会变成整个练习旨在揭露的“打勾”行为。
OKF 今天没有任何作用。没有代理读取它,有点像 llms.txt;没有排名依赖它;没有访客因为它而来。它是一个有前景的方向,但目前是空的。Jono 在同一集节目中的更黑暗观点仍然成立:大多数网站已经是正在离开的人类受众的躯壳,而没有人——无论是 Google 还是 OpenAI——有可行的答案。
OKF 以无与伦比的清晰度向你展示问题。解决它是另一项工作,而没有人做到。所以,这里是做法,且根本不需要接触 OKF:
取你最重要的页面,问 v0.2 对每个概念提出的三个问题:
一个页面如果说“这是做 X 的最佳方式”,但无法回答这三个问题,那么它就不是一个信息源,而是一份传单。
OKF 不会解决这个问题。但如果你诚实地回答这三个问题,你至少会知道你的网站哪些部分是真实的,哪些只是外壳。而这,正是机器需要的第一步。
SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

欧盟AI法案第50条要求AI生成内容必须标注,但提供了四项豁免:艺术/讽刺深度伪造、出版商人工编辑、标准编辑辅助工具、交互式AI明显使用。文章深入解析每项豁免的适用条件及存在的模糊性。

Snapchat宣布停止推荐完全由AI生成的视频,转而奖励真人创作内容,此举与欧盟AI透明度法规及Z世代对AI的焦虑有关,对SEO和内容创作者有重要启示。

本文详细解析如何让ChatGPT索引你的网站,包括概念澄清、索引机制、具体操作步骤和衡量方法。适合营销人员和SEO从业者阅读,帮助你提升在AI搜索中的可见性。
获取最新的 SEO 与 GEO 技术资讯。
我们尊重您的隐私,随时可以取消订阅。