← 返回博客/博客·2026 · 08 · 25·22 min

公开 GEO 实验(四):我们被提及归零,别家的自家站还在被引

R4~R7 四轮同分母 495 条有效样本(11 个有效引擎 × 45 题,题集经实查一致),引见 YinJen 被提及数 24→18→4→0。同一批回答里别家一直被点名,且其自家官网持续出现在引用列表:zhituishidai.com 四轮 1/7/3/8、aidso.com 3/17/26/11,我方 zhimahang.com 是 1/2/2/0。本期兑现第 2 期欠下的公开承诺,并更正两处我们自己查出的口径错误。

引见 GEO 团队
生成式引擎优化 · 引见 YinJen
站内 canonical 版|slug: public-geo-experiment-issue-4 时区:监测数据一律北京时(库存 UTC,已换算),发布与内部动作日期一律 PDT;每处日期都标了时区。 数据窗口:已跑完的监测轮次 R4~R7,末轮 R7 = cy_5104f371776e,北京时 2026-08-18 08:38 ~ 08-20 17:18;进行中的轮次一个数都不放,连「趋势观察」也不放。数字全部出自我们自家的监测库,口径见第二节。 编号:「第 N 期」只指本系列文章期数(本文第 4 期),监测轮次一律写 R4~R7。两套编号不通用。

摘要:R4~R7 四轮分母同为 495 条有效样本(= 11 个当轮产出有效样本的引擎 × 45 道题),题集经实查一致。我们自己的品牌「引见 YinJen」被提及数 24 → 18 → 4 → 0。同一批回答里别家一直被点名,而且他们的自家官网一直在引用列表里zhituishidai.com 四轮 1 / 7 / 3 / 8 条,aidso.com 3 / 17 / 26 / 11 条,我方 zhimahang.com 是 1 / 2 / 2 / 0。归零的是我们。⚠️ 这些数只能说明在这 45 道题面、11 个有效引擎里,谁的名字被写进了回答、哪些域名被写进了引用列表,不能说明份额或优劣。本期同时兑现第 2 期欠下的一句承诺,并公开更正两处我们自己查出来的错误。

《公开 GEO 实验》是智码航拿自家品牌做的公开实验:真实用户会问的问题按轮次丢给 AI 引擎跑,回答正文与引用来源原样存下来,好看不好看都发。先认两件事:一、断更了——上一期发于 2026-07-29(PDT),到发稿日 2026-08-25(PDT)已隔 27 天,而那篇文末写着「每周更新一期」;二、第 2 期那句承诺至今没对外兑现,第五节交代。

一、四轮对位表

项(分母均为当轮 495 条 status='ok' 回答,按 cycle_id 切轮)R4R5R6R7
cycle_idcy_b4e0…cy_f0ac…cy_2c2f…cy_5104…
轮容量(下发行数)540540540540
有效样本status='ok'495495495495
正文提及·引见 YinJen(四别名并集)241840
正文提及·AIDSO(拉丁串 LIKE BINARY76848763
正文提及·AIDSO(中文「爱搜」)76858571
正文提及·智推时代(干净并集口径)54463934
引用列表出现 zhimahang.com(我方)1220
引用列表出现 zhituishidai.com1738
引用列表出现 aidso.com3172611

四轮结构同构:每轮 12 引擎 × 45 题 = 540 行下发,claude 那 45 行整轮未跑(见下节),有效样本都是 495 = 11 个有效引擎 × 45 题

能横比的前提实查过:R4、R5、R6 分别与 R7 做 prompt_id 交集均为 45/45——分母相等只说明有效行数相等,题集一致才是四列能横着看的依据。但「正文提及」那四行彼此不能横比:我方是四别名并集(引见 / 智码航 / yinjen / zhimahang,含中文),AIDSO 两行分别是纯拉丁串与纯中文,智推时代是三串并集,匹配规则不同,每行只能自己跟自己纵向比。底下三行「引用列表」是同一把尺子(主机名匹配),可以互相比。

R7 里 AIDSO 出现在 24/45 道题11/11 个有效引擎上(口径 = 拉丁串 LIKE BINARY '%AIDSO%',与表中 63 同源;中文口径的题面覆盖未取数),我们在同一批题、同一批引擎上是 0。「这个品类 AI 不推荐具体产品」这个自我安慰,站不住。

二、口径说明:怎么数的,两处更正,三处盲区

1. 按 `cycle_id` 切轮,不按日期切。 四轮时间窗互相重叠(R6 末条落在北京时 08-20 15:45,比 R7 开轮还晚),按日期切会把不同轮混进同一格。

2. 有效样本 495,不是 540。 540 是轮容量。claude 那 45 行四轮全部 status='skipped'message='engine not logged in',被登录预检拦下、正文全空——是根本没被问,不是问了没答,不计入分母。归因:我方账号登录态失效造成的采集缺失,与该引擎的服务本身无关。 它自北京时 2026-07-28 起连续四轮全跳过,本文结论都不覆盖它

产品口径与实验口径分开:引见 YinJen 的监测覆盖是 12 个 AI 引擎,三档定价均覆盖 12 个,差别只在监测规模;而这套公开实验连续四轮只有 11 个引擎产出有效样本,495 = 11 × 45。文中「11 个引擎」一律指后者。

3. 提及怎么数,外加一条分界。 先取 mention 标志位,再绕开它、用四别名对 495 条正文全文扫描,两种数法四轮完全对齐(24 / 18 / 4 / 0);别名表 brand_aliasesupdated_at 是北京时 07-12,早于 R4。我们对自己只报了并集口径,没拆报纯拉丁与纯中文两套,这是口径不对称,下期补齐。 分界:「正文被提到」取自 `response_text`,「进了引用列表」取自 `citations`,全文分开统计、分开报数。

4. 更正之一:一处口径污染。 智推时代那格原本用 response_text LIKE '%GENO%' 数,而数据库默认排序规则大小写不敏感,三个对象被混进同一格:GENOGenOptimaDageno / dageno.ai

`Dageno / dageno.ai` 与智推时代 / GenOptima 是不同主体。 核实方式:zhituishidai.com 经 DoH 解析加页面标题双重核对,标题为「智推时代 GenOptima — AI搜索时代的品牌共识操作系统」,核对时间 2026-08-25(PDT)——这同时是「GenOptima 与「智推时代」同指一家」的依据;dageno.ai 的主体信息与之不一致。旁证:R7 里干净口径命中的 34 条回答引 dageno.* 的是 0 条,同轮 495 条里有 7 条引了它,场合完全不重叠。除「不同主体」外不作任何其他属性判断(初稿「海外 GEO 工具厂商」这个定语给不出核实依据,已删)。

拆开重数(R4~R7,分母各 495):GENO 43 / 32 / 28 / 23,GenOptima 15 / 25 / 24 / 15,纯误命中 6 / 4 / 1 / 6。干净口径 = GENOGenOptima ∪ 中文「智推时代」,LIKE BINARY 区分大小写 = 54 / 46 / 39 / 34;污染口径是 53 / 45 / 35 / 32,趋势一致、数字不同,按干净的发。内部曾有稿子据污染口径把 dageno.ai 当成智推时代的自家域名写进分析,那是错的,发稿前已作废。由此定纪律:污染口径上做过的二次统计一律重跑,第四节那张表就是重跑后的。

5. AIDSO 那两行:两种写法互不包含。 依据先给:aidso.com 经 DoH 解析加页面标题核对,标题为「AIDSO爱搜-GEO搜索排名优化平台」、og:site_name 为「AIDSO爱搜」,核对时间 2026-08-25(PDT);据此认定两串同指一个主体,但仍分两行报——R6 拉丁 87 > 中文 85,R7 反过来 63 < 71,不是包含关系。R7 的实测集合差(分母同为 495 条 ok,按 cycle_id 切轮):同时命中 62、只中文 9、只拉丁 1、并集 72。⚠️ 71−63=8 是净差,读成「8 条只写中文名」是错的。智推时代同轮:交集 23、只中文 8、只拉丁 3、并集 34,与上表那格印证。

6. 更正之二:「别家的自家域名一次没被引」这个旧判断,作废。 它错在先拿错了域名:查的是一个已停放、不再对应该厂商的域名,查出 0 就当了结论。用核实后的官网域名重查,结论反过来——zhituishidai.com 四轮分别出现在 1 / 7 / 3 / 8 条回答的引用列表里,aidso.com3 / 17 / 26 / 11 条;R7 那 8 条里,3 条同时在正文命中干净口径(kimi 1、hunyuan 2),另 5 条引了该域但正文没出现品牌名(perplexity 3、hunyuan 2)。所以本期真正的对比不是「大家都不靠自家站」,而是:别家的自家站在被引,我们那一格归零了。 这与第 4 条是同一类错误的两面:拿错对象查一遍,查出 0 就下结论。

7. 三处盲区。

  • R7 有 124/540 行被就地重跑覆盖(原地改写状态与正文),原始失败记录已抹掉,本轮真实采集失败率测不出
  • R7 的 495 条 ok 里有 7 条其实不是回答:2 条是引擎侧报错文案被记成 ok,5 条是拒答。
  • R7 gemini 的 45 条回答 `citations` 全为空数组(引用采集故障,正文正常)。加上 claude 未跑,R7 的引用类统计(第一节表后三行的 R7 列、第四节信源表)只建立在 10 个引擎的引用数据上;R4~R6 的引用统计为 11 个引擎有引用输出(claude 未跑)。⚠️ 三个数不是一回事:12 是产品监测覆盖口径,11 是本实验产出有效样本的引擎数,10 是 R7 实际有引用输出的引擎数。

三、我们是怎么归零的

先排除三种「假零」。不是没答出来:R7 的 495 条无一为空,平均长度约 1796 字符(R6 是 1806)。不是检测器坏了:绕过标志位的四别名扫描在 R4/R5/R6 分别命中 24/18/4,与标志位完全对齐,到 R7 才归零。不是那些题没被问到:R5、R6 曾命中过的 19 道题(R5 豆包 15、R6 kimi 2、R6 Perplexity 2)拉成队列复核,本轮全部被重新问到、全部 `status='ok'`、全部不再提及我们。这是实测,不是抽样推断。

所以这个 0 是真的:问了,答了,只是回答里没有我们。

为什么?只有一个推断,且必须标明是推断。站内 13 篇文章里,现存可查证进过引用池的只有 4 篇

文章形态被引(URL 行数)引擎轮次
《2026 国内 GEO 监测工具怎么选》横评型3kimiR4 / R5 / R6
《怎么衡量 AI 提及率》方法型2kimiR5 / R6
《引见 YinJen 是什么》定义型1kimiR5
《怎么让豆包、DeepSeek、夸克引用你》信源科普型1chatgpt不属 R4~R7(周期化前散跑)

口径写死:判定对象 = citations主机名命中我方站点域名的 URL 行(域名级,不是文章级正文命中),7 行状态均为 ok,落在 6 条回答上(R5 有一条回答同时引了两篇)。按 cycle_id 切轮,R4~R7 的回答条数 = 1 / 2 / 2 / 0、URL 行数 = 1 / 3 / 2 / 0;另 1 个 URL 行属周期化前的散跑(cycle_idNULL),不计入四轮。引擎归属逐行核对过:四轮内那 6 行全部是 kimi,周期外那 1 行是 chatgpt。

另外三类形态——实验日志型(本系列前三期)、客户案例型、埋点方法型——至今没进过引用池。 但边界要补:前三期有两篇至今未被 Bing 收录,而收录是被引的必要非充分条件,所以这个观察里混着「形态」和「根本没进索引」两个原因,拆不开。产能也如实写:08-03 ~ 08-24(PDT,含两端)这三周只发了 1 篇,其余日子为 0

推断:这更像形态错配,不像渠道问题。 但它只是推断——被引集中在单一引擎、样本量是个位数、只有一个商户一个品类的题集,撑不起因果结论。而且我方被提及归零与我方站点被引归零虽同期发生、方向一致,却不能互为佐证:没有提及时本就很难产生我方引用,两者同源,不是两条独立证据。

四、被引的信源分布:只记录观察

R7 里按干净口径命中智推时代的那 34 条回答,引用来源按主机名归并后的分布(重跑结果,已替换初稿那张污染口径的表):

主机名出现的回答数
ithome.com14
cnblogs.com11
baike.baidu.com7
blog.csdn.net / cet.com.cn / finance.sina.com.cn / jiemian.com / tech.ifeng.com各 5
163.com / baijiahao.baidu.com / csdn.net / developer.volcengine.com / m.jiemian.com各 4
配表脚注(必读):n = 34(R7 命中干净口径的回答数),其中 31 条带 ≥1 条引用、3 条无引用,去重后共 232 个「回答 × 主机名」对,0 条解析失败。归并规则:同一条回答内同主机名只计 1 次,跨回答累加。 主机名归一化 = 转小写 + 去协议 + 去路径/query/fragment + 去端口 + 去前导 www.,子域名不合并。差 1~2 次不具区分力,本表只看「哪些域名出现过」,不用于名次比较,更不用于投放决策。n=4 处 5 个并列,为保完整实际列出 13 个。

观察一:这 13 个都是公开的第三方平台,但别读成「引用列表里只有第三方」。 经核实官网域名的两家厂商,自家站都在引用列表里出现过(见第一节表末两行);具体到这张按 34 条切的表,zhituishidai.com3 条,落在 n≥4 门槛以下所以看不到。第三方确实仍是大头(ithome 14、cnblogs 11 对自家站 3),「第三方内容值得投」这个判断因此成立——但论据不是「人家不用自家站」,人家的自家站一直在被引。

观察二:其中三个平台我们有资产或有过资产(博客园、CSDN、火山引擎社区),而我们的站外资产(7 个平台 9 篇文章)文章级命中累计为 0(R7 未单独取数)。同样的平台、同样的引擎,被引的不是我们。

不能说的也说清楚: 这批数据只能说明在这 45 道题面、11 个有效引擎里,哪些域名被写进了回答的引用列表,回答不了「他们做了什么」;我们不评价做法、不推测手法、不推定动机。这份分布还只来自 10 个引擎。

五、兑现第 2 期欠下的那句承诺

第 2 期(2026-07-22 发布,PDT)的原话是:「下期若仍是 0,我们会公开下调知乎在这套打法里的权重。」

后来:第 3 期(07-29,PDT)没照原样执行,判据从「渠道无价值」改成「形态错配」,承诺被推到下一个观察窗;2026-08-11(PDT)内部用 R4~R6 三轮合并的引用数据做了一次平台排序,据此把知乎专栏降了权;然后断更。内部动了,对外没说。 这是一次实打实的承诺违约,不是「延后」也不是「口径调整」。现在补上。

降权的依据。 ⚠️ 该排序基于 2026-08-11(PDT)取数时点的 R4~R6 数据,R6 当时尚未跑完——不是三轮完整重跑。该时点样本为 821 条带引用的运行、7,317 条引用、11 个引擎有引用输出(claude 未跑)。发稿前按完整 R4~R6 复核过一次(1,108 条带引用运行、10,230 条引用),平台排序结论未变,但为如实反映当时的决策依据,此处保留 08-11 快照值并标明其为快照。按域名归并到「平台」,只统计我们能投稿的,排序主键取覆盖引擎数而非引用总量——被 9 个引擎引过的,信号强于只被 1 个引过的。结果:知乎专栏 2/11 个引擎(84 条引用),微信公众号同为 2/11(111 条);火山引擎社区 10/11、博客园 9/11、CSDN 9/11、腾讯云社区 9/11。我们自己发的那篇知乎专栏,在这批引用数据里没出现过。

结论只下到证据能支撑的那一层。 这两个渠道覆盖引擎数最低(各 2/11),据此下调它们在 GEO 这本账里的优先级成本侧没取数,因此不作「性价比」判断(初稿写了「性价比低」,那是拿没测量过的维度下判断,已改)。处置是降权,不是停:它们可能承担品牌、私域承接等职能,按那个职能评估,别混进 GEO 这本账里算。

这条依据本身的边界: 「引擎引过哪些平台」是必要条件、不是充分条件——我们在 CSDN、火山都有文章,文章级命中仍是 0;平台选对只是第一步,能否被收录、能否被选中是后面两步。而且这批数据来自单一商户的 45 道 GEO 品类题,换个品类结论多半不同。

第 3 期写下的六个观察项,本期答上四个(Perplexity 那两道新题 R7 归零;知乎专栏 R4~R6 无出现;我方站点被引 1 / 2 / 2 / 0;火山那篇 R7 未取数、此前三轮为 0),长尾题与地区题两项未取数,记欠账

六、下一步

不承诺效果,只写打算改什么。

  1. 内容形态重投,不加产能。 往横评型、方法型、定义型这三类投,理由只有一个:它们是现存唯一可查证进过引用池的形态。这不构成「投了就会被引」的预期——样本只有个位数,且其中混着「没被收录」这个原因。
  2. 把自家站被引单列为常驻观察项。 本期最锋利的一格是我方 zhimahang.com 从 1/2/2 掉到 0,而同表另外两个域名没有归零。只作观察,不设目标值。
  3. 厂商名称与域名核对列入每轮例行检查。 本期两处更正都出在这一步的缺失上,两次都是「拿错对象查一遍、查出 0 就下结论」。
  4. claude 那一路要么恢复登录,要么长期标注为未测。 连续四轮零样本还含糊写成「12 个引擎跑了一遍」是不诚实的,同时要写清那是我方登录态问题、不是引擎服务问题。

这批数据够不着的地方:不能证明任何一次内容动作有效或无效,不能证明谁家产品更好或份额更大;被提及不等于被推荐,更不等于有人因此选了你;换个行业跑同一套方法,结论几乎必然不同。我们没做因果实验,所以本系列不写因果句。 规矩不变:改数公开改,改判据公开改,欠下的承诺公开认。这一期我们自己是 0,照发。

想知道自己的品牌在 AI 回答里长什么样:引见 YinJen(也叫「智码航引见」)做的就是这件事——覆盖 12 个 AI 引擎的持续监测,同一批问题按轮次自动跑,回答正文与引用来源原样存下来;每轮实际产出有效样本的引擎数会随登录状态波动,本期为 11 个,产品里会标注。14 天免费试用、无需信用卡,下载,价格见定价页

关于作者
引见 GEO 团队

引见(YinJen)的生成式引擎优化(GEO)研究与实战团队,长期监测内容在 ChatGPT、Claude、Gemini、Perplexity、豆包、DeepSeek 等主流 AI 引擎中的引用与可见度。本系列均为一手实操记录。

了解引见如何帮你做 GEO →