GEO信源布局:别只顾着写,先确认AI能找到你

上篇讲了怎么写AI才愿意引用:结构化四件套、答案胶囊、可摘抄段落。

但有一个更残酷的问题没聊:你写好了,AI能找到你吗?

答案是:大概率不能。

不是你的内容不好。是你根本没进AI的「信源池」。

先看一个扎心的数字

Ziptie.dev 在2026年3月做了一项研究,跑了大量AI引用数据,结论让人后背发凉:

AI引用的URL中,只有12%同时出现在Google搜索结果前10名。

什么意思?你在Google排第一,不代表AI看得见你。这套体系和SEO是两套完全不同的操作系统。

更狠的是:AI每次回答一个问题,检索系统只抓5到10个文档。没有第二页。没进这个5-10的集合,你的内容对AI来说就不存在。

所以信源布局的本质问题不是「写什么」,是「怎么让自己进那个5-10的候选池」。

AI的信源池怎么构成的

AI选信源不是黑箱。业内叫RAG(检索增强生成),四个阶段,每个阶段都在筛人:

阶段一:拆问题。 你说「5万以内的家用纯电车推荐」,AI不按这句话搜。它把问题拆成「5万以下电车安全测试」「家用纯电空间对比」「冬季续航实测」「充电成本计算」四五个子查询,各自独立检索。

这带来一个反直觉的事实:51%的AI引用来自子查询,不是用户的原始问题。你优化了一个关键词,但AI可能从你完全没想到的角度找到你:或者找不到你。

阶段二:双引擎检索。 关键词匹配(BM25)+ 语义搜索并行。前者抓精准词,后者抓意思相近的内容。你的内容得至少在一个引擎里被命中。

阶段三:重排序。 这是最致命的环节。几百个候选文档进来,交叉编码器只留5-10个。筛的标准叫什么?信息增益:你比已有的其他源多提供了什么新东西。如果你的内容和别人说的一样,你会被系统性淘汰。重复=不可见。

阶段四:合成引用。 模型拼答案,附上引用标记。这个阶段才用到了上一篇讲的「答案胶囊」和「可摘抄段落」。

这四个阶段走完,大量内容在阶段三就被干掉了。不是写得不好,是没提供增量信息。

不同平台的「品味」完全不同

一个容易忽略的事实:ChatGPT、Perplexity、Google AI Overview,三个平台的选源逻辑差异巨大。你不能用同一套策略打三个平台。

从Ziptie.dev的45万条引用分析来看:

ChatGPT:百科全书偏好。 每响应平均引用59条(最多)。Wikipedia占7.8%,是所有平台中最「教科书」的。你得像一本权威参考书一样组织内容。

Perplexity:社区听众。 Reddit占6.6%,10-15年的老域名占26%。它信「老家伙」和「群众声音」。新站想在Perplexity出头,比ChatGPT难得多。

Google AI Overviews:独立王国。 和其他平台的语义相似度只有0.48,意味着它的选源逻辑跟谁都不一样。YouTube占18.2%,它是唯一重视频的平台。

一句话:ChatGPT要权威感,Perplexity要资历和社区信号,Google AIO要另一套东西。你得做选择题:先集中火力打一个平台。

怎么才能进信源池

四个路径,按优先级排:

① 实体一致性(最基础,也最容易被忽略)

AI判断你是谁,不是看你的首页自我介绍,是看全网对你的一致性描述。品牌名、产品名、创始人名、地址:这些实体信息在所有平台(官网、Wiki、行业协会、媒体报道、企查查、地图)必须统一。

不一致的后果:AI觉得「光尘阁」「光尘阁 GEO」「光尘阁GEO平台」是三个不同的东西,每个的权重都分散了。查一下你的品牌在全网的叫法,统一掉。

② 第三方佐证(权重最高,也最难)

Ziptie.dev的数据很清楚:被引用最多的页面,反向链接反而更少。AI不看链接数,看的是「别的可信源有没有提到你」。

具体做法:媒体报道、行业报告引用、协会成员名单、Wikipedia条目、政府公示:这些外部信号比你自己网站上的任何文字都管用。新闻稿不如一篇被正规媒体引用的报道;官网的产品介绍不如维基百科上的一句话。

③ 结构化数据(技术层面的快捷键)

Schema标记、llms.txt:这些让AI的检索系统不用「猜」你是谁。研究表明,带有完整schema标记的内容被引用概率提升2-3倍。不是玄学,是AI验证实体身份时,结构化的机器可读数据比自然语言快得多。

④ 主题簇(架构层面的布局)

上篇提到决策型>比较型>信息型。这里补一个架构维度:单个页面很难捕获所有子查询。一个「电车推荐」主题下,你需要多个互相关联的页面:安全测试一篇、空间对比一篇、冬季续航一篇、充电成本一篇。它们之间互相链接,形成一个「簇」。

当AI拆解用户问题时,不同的子查询会落到你这个簇里的不同页面。只靠一篇长文做不到这一点。

信源布局的节奏策略

结合之前的六大平台引用时间窗口数据,信源布局不是一次铺完。按节奏来:

新内容上线第一周:冲百度AI和千问:这两个平台前3天引用占55%,前18天占95%。窗口短,必须抢。

上线后4-120天:主攻Kimi和豆包。Kimi前3天引用只有6%,它不抢首发。中期是甜蜜区间,持续更新回报最高。

120天以上:DeepSeek的主场。老内容在DeepSeek的引用占比达32%。你现在写的每篇东西,半年后在DeepSeek才是最值钱的时候。

Google AIO单独对待:它的选源逻辑和其他平台只有0.48的相似度。不要指望一套优化打所有。选你的主力平台,先在一个池子里站稳。

最重要的三条原则

回到最初的问题:AI引用你不是因为你写得多,是因为你在它的信源池里。

怎么进去?三条铁律:

  1. 全网实体统一。别让AI把同一个品牌当成三个不同的东西。
  2. 第三方证据比你自说自话重要十倍。媒体引你、行业报告提你、协会名单有你,比你首页写一万字都管用。
  3. 提供别人没有的信息增量。重复别人的内容,在第一轮重排序就被淘汰了。原创数据是你最坚固的护城河。

内容做得好是入场券。信源布局才是上牌桌的资格。