Google 悄悄搞了个 OKF:AI 时代的知识格式标准,国内还没人聊

2026年6月,Google Cloud 发了一个叫 OKF(Open Knowledge Format)的东西。两个月过去了,国内讨论模型、MCP、Agent 的文章铺天盖地,但 OKF 几乎没人提。

我翻完文档之后只有一个感觉:这玩意儿可能被严重低估了。

OKF 是个啥?

一句话:定义 AI 时代的知识应该以什么格式存在。

HTML 定义了网页怎么写,JSON 定义了数据怎么传。OKF 想定义的是:一个组织的知识,应该用什么格式存,才能让人和 Agent 都能读、能改、能验证、能迁移。

技术上极其简单——就是一个 Markdown 文件目录,加上 YAML 头部元数据。长这样:

company-knowledge/
├── index.md
├── metrics/
│   ├── revenue.md
│   └── active-users.md
├── policies/
│   └── revenue-recognition.md

每个 .md 文件代表一个知识概念——可以是一条业务规则、一张数据表定义、一项公司政策。文件路径就是这条知识的"身份证"。YAML 头部标注类型、状态、来源:

type: Metric
title: Revenue
description: 公司财务口径下的已确认收入
status: stable
sources:
  - revenue-policy

听起来太简单了对吧?HTML 刚出来的时候也就是一堆尖括号。标准的力量从来不在于复杂。

它跟 MCP、Skills 是什么关系?

过去两年 Agent 基础设施在快速分层。模型负责脑子,MCP 负责接手脚(连数据库、调 API),Skills 负责教招式(封装任务流程)。

OKF 回答的是另一个问题:Agent 应该知道什么?这些知识可不可信?

打个比方:MCP 让 Agent 能伸手拿东西,Skills 教 Agent 怎么干活,OKF 试图给 Agent 一套长期记忆——能跨系统迁移、能版本管理、能标注"这条已经过期了"。

Skills 侧重程序性知识(怎么做),OKF 侧重陈述性知识(什么是真的、为什么是真的、谁说的、现在还管不管用)。

真正关键的东西:知识可信度

OKF 最新版(v0.2)开始加了一个能力:标注知识的来源、验证状态、时效性。

这事为什么重要?

过去文档是人写的,默认作者知道自己在写什么。但以后大量知识是 Agent 生成的——AI 写出了一条业务规则、一段产品说明、一个技术决策。你怎么信它?

OKF 的思路是:让知识文件自带"可信度标签"。Agent 读的时候不只是看到内容,还知道: - 这是什么类型的知识 - 谁产生的(人还是 Agent) - 经过谁审核 - 有没有过期

一个能力很强但用错了知识的 Agent,只会更高效率地制造错误。这个道理搞 Agent 的人都懂。

光尘阁怎么看这件事

读完 OKF 的规范,我脑子里冒出几个判断。

第一,OKF 跟 GEO 是同一条逻辑。 GEO 的核心是什么?让 AI 搜索能正确引用你的内容。OKF 呢?让 Agent 能正确读取你的知识。两者都在回答同一个问题:当 AI 成为信息消费者的时候,你的内容/知识应该长什么样才能被正确理解。做 GEO 的人,OKF 这个方向值得盯。

第二,知识格式标准化 = 新的信息差窗口。 Google 推 OKF 不是搞慈善。谁先把自己的知识按 Agent 友好的格式组织好,谁的网站在 AI 搜索里就更"好吃"。HTML 时代的 SEO 卷了二十年,OKF 时代的知识结构化现在基本是空地——先占坑的人红利最大。

第三,企业真正的护城河会迁移。 模型是租的,Agent 框架可以换,工具接口可以迁。但一个组织长期沉淀下来的业务知识——客户分类规则、事故复盘、决策逻辑——这些东西才真正属于自己。OKF 的价值不是技术本身,是它第一次给"组织知识"定义了一个开放、可迁移的格式。

现在入局早不早?

非常早。OKF 才发布两个月,生态刚刚冒芽: - Google 自己出了规范、示例和工具 - 开源社区开始做知识校验、索引、可视化的轮子 - OpenWiki 等项目已经在尝试把 OKF 跟 Agent、MCP、GitHub 工作流打通

类比 HTML 的话,现在大概相当于 1993 年——标准有了,浏览器还没普及,但看懂的人已经开始建网站了。