AumCreate

WordPress 的 GEO:AI 搜索怎么找到您的站

· 2026年9月23日 对照真实界面核对

GEO 是 Generative Engine Optimization,生成式引擎优化,让 ChatGPT、Perplexity、Claude 和 Google 的 AI 结果能用您的站。在 WordPress 上它归结为五件事:能被机器引用的回答、和屏幕上一致的结构化数据、前后一致的「你是谁」、一份 llms.txt 索引,以及一个想清楚了的「放哪些 AI 爬虫进来」的决定。

这一页是总览。想知道自己的站有没有毛病,同一片地在八个具体的错那页;只想做 llms.txt 那一件事,它有自己的一篇

五件事都不需要换平台、也不需要订阅什么,标准的 WordPress 就能做完;而且每一件做完都能自己验。最后这半句比听起来重要,市面上大部分 GEO 建议压根没法验证。

读者变成模型之后,什么变了

搜索引擎给页面排序,然后把人送到其中一个。生成式引擎是读几份资料、自己写一个答案,再决定用谁的那句话、给谁署名。所以问题从「我排第几」变成了「我这句话值不值得被引用,以及机器认不认得出它出自我这里」。

权重因此落到了三件排名报表从来不显示的事上:您的回答单独拎出来还成不成立;页面上的事实有没有一份机器读得到的版本;以及那些会注明出处的爬虫,到底进不进得来。

第一块,被单独引用出去也站得住的回答

把答案写在靠上的位置,自包含,两三句话,把周围的东西全删掉还读得通。不写「如上所述」,不写那种要铺四段才成立的答案。

  • 一页回答一个问题。一页答五件事,结果是五件都轮不到它。
  • 数字、价格、时长、上限写进句子里,别放在图里,也别藏在三次点击之外。
  • 把小标题写成问句比写成名词更容易被引用:模型在找的就是一个问题。

怎么验:把标题遮住,只读开头两句。它们要是回答不了标题,这一页后面写什么都救不回来。

第二块,和页面对得上的结构化数据

结构化数据是「人看到的那些东西」的机器可读副本:商品和它的价格、文章和它的日期、问题和它的答案。它缺了或者不全的时候,屏幕上什么都不会显得不对:这正是它能躺几个月没人发现的原因。

  • Product、Article、FAQPage、Organization、BreadcrumbList 基本覆盖一个企业站需要的东西。类型不是越多越好。
  • 每一个必填字段都要有、而且是真的。少一个必填项,整条富媒体结果会被静默扣掉。
  • 标记必须和页面一致。标记里的价格跟屏幕上不是同一个,比没有标记更糟。

怎么验:把页面丢进结构化数据测试工具,警告也要读,不是只看错误。这条我们自己吃过亏,商品页上一直有图,标记里却没有 image,富媒体结果被关了三周,而每一页看上去都没问题。

第三块:用同一种说法讲「你是谁」

一个模型在回答「X 是谁做的」时,是在用它能找到的碎片拼一个实体。如果您的名字、简介、所在地、链接在自己站上、在 wordpress.org 上、在 GitHub 上、在领英上各是一种说法,每一个版本都在降低其他版本的可信度。

  • 站上只定义一次 Organization,生成一份到处复用,别每页各写各的。
  • 所有有您资料的地方用同一段简介。复制过去,别重新发挥一遍。
  • 把您自己掌握的那些主页链出去,让这些碎片能互相连上。

怎么验:搜自己的品牌名,像个陌生人那样读前五条结果。如果它们描述的是四家不同的公司,那这件事要排在这一页其他所有事的前面。

第四块:llms.txt,它只是索引

llms.txt 是放在站根的一个纯文本清单,指向值得读的那些页。它很便宜、没有坏处,而它是索引,它没法让单薄的页面变得值得引用。让它从真实内容里生成,别手写;并且确认站上只有一个东西在生成它。

具体怎么做:哪些插件提供、两个都开着谁会赢、怎么确认现在到底是谁在发,在 llms.txt 那一篇。我们自己的在 /llms.txt,欢迎打开看。

第五块,决定放哪些爬虫进来

AI 爬虫不是一类。有一批抓页面是为了引用您、链接您:OAI-SearchBot、PerplexityBot、Claude-SearchBot、Google-Extended。另一批只拿内容、什么都不送回来:GPTBot、ClaudeBot、CCBot、Bytespider。看到名字带 AI 就全拦,您损失的是转介流量,换回来的是零。

  • 做决定之前先看到底哪些爬虫真的来过。这场争论大多数时候是在没有这份证据的情况下发生的。
  • 搞清楚每种手段有多强:在门口挡掉是真的挡;robots.txt 里的规则只是一个请求,规矩的运营方会遵守,别的不会;noai 响应头很弱,但不花钱。
  • 顺手别把 Googlebot、Bingbot 一起拦了,做链接预览的那几个也留着。

整件事怎么验

给自己一个小时,跑这五条。每条要么过要么不过,没有一条需要付费工具。

  • 打开自己的三个页面,只读开头两句。它们回答标题了吗?
  • 同样这三页丢进结构化数据测试。零错误,然后把警告读完。
  • 搜自己的品牌名。前几条结果描述的是一家公司还是好几家?
  • 打开自己站的 /llms.txt。它存在吗?随便点三条,落点值得读吗?
  • 看一个月的爬虫记录。会署名的那几个进得来吗?您本来想拦的还在不在来?

这些做不到什么

没有一条能保证模型会引用您,谁承诺这个都是在卖他交付不了的东西。它们能做的是把「你会被跳过」的那些理由去掉:答案埋得太深没法引用、事实只给人看、身份读起来像四家公司、以及把本来会给您署名的那扇门关上了。

这五块您都能自己做,这一页就是照着「能自己做」写的。不想自己做的话,我们按一口价代做:$199、三个工作日,含核对清单。

常见问题

GEO 是不是换了个名字的 SEO?
重叠的比名字看起来多:结构干净、内容是真的、标记写对,两边都吃。不同在目标:搜索引擎给页面排序,生成式引擎组织一个答案、挑用谁的那句话。所以权重挪到了「能不能被引用」和「屏幕上那些东西有没有机器可读版本」上。
我需要装什么特别的插件吗?
不需要。结构化数据和 llms.txt 有好几个 SEO 插件都能出,包括免费的;爬虫那一侧是一条 robots.txt 规则,外加:如果您要的是真挡住而不是请求,一个能把爬虫挡在门外的东西。真正要紧的是每样东西**只由一个东西生成**,别让两个插件在背后悄悄打架。
多久能看出变化?
比排名变化慢,而且要看的地方不一样:会署名的那些爬虫还回不回来,以及您的页面有没有开始在它们回答的那些问题上出现。两件都不是一周能看出来的,也都不在排名查询工具里。
该不该拦 GPTBot?
这是生意上的决定,不是技术决定。GPTBot 是拿去训练模型的,不给您带访客;OAI-SearchBot 抓页面是给 AI 搜索用的,会引用您。拦前者、放后者是一个说得通的立场。因为两个名字里有同一家公司就把两个都拦掉,通常不是人们真正想要的。

这篇教程里的插件

AumViso元标签、Schema、站点地图和 llms.txt 都在一处:让搜索引擎和 AI 读得懂这个站所需要的那一整套管道。插件页面