AumCreate

GEO 常犯的八个错,以及怎么核对您有没有犯

· 2026年9月23日 对照真实界面核对

大多数 GEO 问题都不稀奇:把本来会给您带访客的爬虫一起拦了;发了一个 llms.txt 但底下没有内容撑着;或者页面上的事实只给人看,机器那一端是空的。下面八条,每条都带一个您现在就能跑的核对方法。

这里说的 GEO 是 Generative Engine Optimization:生成式引擎优化,也就是让 ChatGPT、Perplexity、Claude、Google 的 AI 结果找得到您、并且愿意引用您。不是地理,也不是地区页。想先看全貌而不是病症,从 WordPress 的 GEO 那页开始。

每一条都按同一个格式写:错在哪、怎么核对您有没有这个问题、怎么改。没有一条需要您订阅什么或者换一个平台。

一、把 AI 爬虫一刀切全拦掉

错在哪:有人拍板「不能让 AI 拿我们的内容」,于是看到名字里带 AI 的就全拦。但这些爬虫不是一类。有一批是会把访客送回来的:OAI-SearchBot、PerplexityBot、Claude-SearchBot、Google-Extended 抓页面是为了引用您、链接您;另一批只拿内容,什么都不送回来。拦掉第一批,您什么都没得到,却把转介流量一起关掉了。

  • 怎么核对:先看清楚过去一个月到底哪些机器人来过、叫什么名字,再做任何决定:记一份爬虫日志是最省事的办法。大多数站长是在不知道来过哪些机器人的情况下争论要不要拦 AI。
  • 怎么改:按行为判断,不按「AI」这两个字判断,而且这是一道生意题。如果买家必须来您站上才能成交:看 demo、下载文件、下单,那被提及的价值高于损失的那次点击,放行训练类爬虫是站得住的选择。这个站就是这么定的:我们的 robots.txt 全部放行,而且是刻意的。反过来,如果您的内容本身就是产品、一段摘要就替代了这次访问,那结论就相反。唯一肯定不对的,是照着名字定。

二、把 robots.txt 当成围墙

错在哪:在 robots.txt 里写一条规则,就认为这件事做完了。robots.txt 里的规则只是一个请求。公开声明会遵守的运营方会遵守;任何决定不遵守的东西就是不遵守,这个文件拦不住它。

  • 怎么核对:加完规则之后,看那个爬虫还出不出现在您的日志里。
  • 怎么改:真要拦住,就在门口挡掉,页面根本不发给它;robots.txt 那条留着当礼貌版本。您要清楚自己此刻靠的是哪一种。

三、发了 llms.txt,底下却没有内容撑着

错在哪:站上出现了一个 /llms.txt,里面列的页面内容单薄、过期,或者跟文件里写的不是一回事。这个文件是索引,不是内容的替代品。这条还有第二种长法:两个插件都想发 /llms.txt,赢的那个不是您配置的那个。

  • 怎么核对:在浏览器里打开您自己的 /llms.txt,随便点开三条。如果某个页面说的跟文件里写的不一样,问题出在文件。
  • 怎么改:让索引从真实内容里生成,别手写;再确认现在到底是哪个插件在发它:这件事本身就够写一篇

四、答案埋在第五段

错在哪:页面先铺背景、讲定位、讲故事,真正的答案在三屏之后才出现。人会略过它;而一个在总结这一页的模型,没有任何理由挑您这句,而不是挑别人那句先出现的。

  • 怎么核对:把标题遮住,只读页面开头两句。它们回答了这一页标题里问的那个问题吗?
  • 怎么改:在靠上的位置放一段自包含的回答,两三句话,单独被引用出去也读得通,不带「如上所述」。

五、事实只给人看,机器那一端是空的

错在哪:页面看起来什么都不缺,而它背后的结构化数据少了一个搜索引擎算必填的字段。屏幕上一切正常,所以没人会发现。这一条是我们自己踩的:商品页一直是有图的,但 Product 结构化数据里没有 image:而那是商家信息的必填项。富媒体结果被扣了三周,而每一页看上去都没问题。

  • 怎么核对:把自己的商品页、文章页、问答页丢进结构化数据测试工具跑一遍,警告也要读,不是只看错误。
  • 怎么改:把「同一个事实的机器可读版本」当成页面的一部分,不是装饰:只在屏幕上有、标记里没有,这两边迟早会漂开。

六、关键事实只在图里,或者要等 JavaScript 跑完才有

错在哪:价格、规格表,或者答案本身,存在一张截图里,或者靠前端脚本取回来再渲染。有些爬虫会执行 JavaScript,很多不会,而几乎没有一个会从图片里读字。这个事实对人是在页面上的,对机器是不存在的。

  • 怎么核对:看网页源代码(不是开发者工具的元素面板),在里面搜您在乎的那个数字。如果送达的 HTML 里没有它,就当它不存在。
  • 怎么改:把事实写进 HTML,图留着当插图,别让它当唯一出处。

七、拿撑不住的数字充权威

错在哪:「已服务 10,000+ 团队」「效率提升 70%」「评分 4.9」,而没有人能追溯这些数字是怎么来的。模型会拿别处的资料交叉核对;一个在别的地方都查不到的数字,降低的是整页的可信度,不是提高。

  • 怎么核对:页面上每个数字都问一句「一个陌生人去哪儿核实它」。如果答案是「只能信我们」,那它在帮倒忙。
  • 怎么改:用能核对的事实,包含什么、有多少个、多少钱、下一步会发生什么:核不了的就去掉。

八、「最后更新」是个摆设

错在哪:页面上的日期,或者标记里的 dateModified,要么每次部署都动,要么从来不动。两种都让它失去意义。时效信号只有在是真的时候才起作用;一个声称自己是最新的、内容却停在一年前的页面,比一个老老实实标着旧日期的页面更糟。

  • 怎么核对:挑三个页面,问「它标的那个更新日当天,到底改了什么」。
  • 怎么改:内容变了才动日期,站重新构建一次不算。

先做哪一条

只做一件事的话:先看清楚到底哪些爬虫真的来过,然后像第一次见到这一页那样读自己的开头两句。这两件事占了「会被引用的站」和「不会被引用的站」之间的大部分距离。

不想自己弄?这件事我们按一口价做:$199、三个工作日,交付时给您同一份核对清单,您自己能验。

常见问题

GEO 和 SEO 是两回事吗?
重叠的部分比名字看起来多。结构干净、内容是真的、标记写对,这两边都吃。不同在目标:搜索引擎是给页面排序,生成式引擎是组织一个答案、决定用谁的那句话。所以权重挪到了「能不能被引用」上:自包含的回答、能核对的事实、以及屏幕上那些东西的机器可读版本。
我需要 llms.txt 吗?
它很便宜,也没有坏处,但它是您内容的索引,不是内容的替代。它指向的页面要是单薄,这个文件什么也改变不了。先把页面做对。
拦掉 GPTBot 会影响我在 Google 的排名吗?
不会。GPTBot 不是 Googlebot,拦它跟 Google 搜索没关系。真正值得想两遍的是 Google-Extended(它关系到 AI 功能而不是排名),以及那几个面向搜索、引用您时会链回来的 AI 爬虫。
怎么知道这些做完有没有用?
看两件事:会带来转介流量的那几个 AI 爬虫还回不回来;以及您改过的那些页面,有没有开始在它们回答的那些问题上出现。两件都不是一周能看出来的,也都不是一个排名查询工具看得到的。

这篇教程里的插件

AumViso元标签、Schema、站点地图和 llms.txt 都在一处:让搜索引擎和 AI 读得懂这个站所需要的那一整套管道。插件页面