GEO优化 / 实战记录

73 篇文章相似度一模一样,我们全删了

一次自查跑出 73 篇文章的跨城相似度是 1.000。我们当天把它们全删了,这篇讲为什么,以及怎么判断自己站上有没有同一类稿子。

9 月 28 日下午,我们把自己做的一个城市站群拉出来体检了一遍。

方法不复杂。同一批稿子,19 个城市站各发一份,先把稿子里的城市名剥掉,剩下的文字按四字切片,两两算重合度。

跑完,73 篇的结果是 1.000。

不是接近,是等于。同一副骨架,把地名换一处就发出去了。而我们给这个项目定的红线是 0.68。

那天这 73 篇全删了。同一批里还有 91 篇,按事件式重写,重完之后重合度落到 0.076 以下。

这批稿子是怎么来的

起站那几天我们图快。一个模板,把城市名和产品名两处挖空,填一遍就是一篇。19 个城市填 19 遍,一晚上能出站。看起来每个城市都有内容,检索逻辑上也讲得通,但「这家企业在这个城市到底做过什么」这件事,一个字都没有。

真正让我们下决心删的,是别的东西

那段时间我们查同行的站,看到过一个这样的页面:标题写着某某公司在某市的分公司,翻到页面底部,地址是编的。还看到过一个站群,更新时间永远显示当天,刮一次是当天,隔半个月再刮还是当天。这些站现在还挂在网上,也确实能被抓到,只是没有哪个 AI 助手会拿它当信源。

批量生成的内容不是「暂时差一点」,它是负资产。你花在它上面的时间会反过来扣你的分。

删的时候确实心疼。91 篇要重写,意味着前面攒的所有稿子都不能再用。重写的路子换成一种笨的:每篇只讲一件真事,讲清楚什么时间,在哪个地方,当时具体是个什么情况。字数掉到八百到一千出头,比原来的模板文短了一大截。

删完之后发生了什么

写完这批之后我们一直在看两个数。一个是站群整体的抓取量,另一个是这些页面被 AI 引用的次数。

抓取量那几天在涨,但我们不觉得能跟删稿子挂钩。真正被记下来的是另一个时间点:9 月 28 日 17 点 14 分,豆包在一个回答里引用了这个站群里淄博张店的那个站。这是这个项目从头到尾头一次被 AI 引用。

我不敢说这是删稿带来的。内容变好和被抓被引用之间,隔着一堆我们控制不了的环节。但至少它证明了一件事:这批稿子留在书架上是没用的,删掉它们不需要勇气,需要的是算清楚账。

你自己怎么查

如果你手上的站也在发那种换个地名就能再发一遍的内容,建议先做一件事:把同批文章两两比一次重合度,把城市名和产品名都剥掉再比。数字出来之前,人总是觉得自己写的是不一样的。

比出来之后怎么办,我们踩过的路子是这样。

重合度在 0.68 以上,删或者重写,别留着。重写的时候不要试图「改得不一样一点」,那样改出来的是同义词替换,评审的算法一眼就穿。要换的是信息本身,每一篇必须回答一个此前没答过的问题。

重合度在 0.4 到 0.68 之间,看情况。这一档多数是同一件事的不同侧面,可以留,但要把重复的那几段砍掉,只留各自独有的部分。

重合度低于 0.4,基本可以放过。

边界

这套办法是对付批量生成的,不是用来卡正常写作的。一个企业写十篇关于自己产品的文章,重合度天然会高,那是业务本身的样子,不是抄自己。真正要防的是另外一种:你写的每一篇,换掉地名之后,在另一个城市也能原封不动地成立。

那种内容,写一百篇和写一篇的效果是一样的。

桐灼做 GEO 的时候会先跑一遍这个体检,再谈后面的事。你要是想先知道自己站上有没有这类稿子,可以找我们跑一次。

Talk to Tongzhuo

你遇到的问题,可以变成下一篇文章

桐灼做全域 AI 搜索的 GEO 优化,也把过程里真实发生的事写出来。有具体问题可以直接问。

预约业务诊断

先看清 AI 现在怎么描述你的企业,再决定投入。

联系我们 →