想被 AI 引用,内容该发在哪?11 个引擎、7317 条引用的实测答案
实测 11 个 AI 引擎、7317 条引用后的五个答案:各引擎给出的来源数量相差十倍;有自家内容平台的引擎会明显更多引用自家生态;真正跨引擎通用的信源只有 30 个,占全部域名的 1.9%;平台选对了不等于会被引用。附可投稿平台清单、引用集中度对比与数据边界说明。
实测 11 个 AI 引擎、7317 条引用后的五个答案:各引擎给出的来源数量相差十倍;有自家内容平台的引擎会明显更多引用自家生态;真正跨引擎通用的信源只有 30 个,占全部域名的 1.9%;平台选对了不等于会被引用。附可投稿平台清单、引用集中度对比与数据边界说明。
下面逐个回答。所有结论都来自同一批实测数据,方法和口径写在第一节,可复算。
问题本身不复杂:当 AI 回答一个带推荐性质的问题时,它给出的来源是从哪来的?
难的是这个问题没法泛泛地答——换个品类、换个问法,答案可能完全不同。所以只能在一个具体样本里数清楚。
我们的做法:
分五层——核心品类、长尾问答、地区相关、技术与集成、竞品对比
三条口径先说清楚,免得被读成通用结论:
信源结构多半完全不同。本文所有结论只在这个品类内成立。
所以「某平台被引 378 次」不等于「378 篇不同的文章」。
其数据偏弱,文中会单独标注。
这是最先应该看的一件事,因为它决定了「被引用的机会」有多大。
| 引擎 | 每次回答平均给几条来源 | 中位数 | 单次最多 |
|---|---|---|---|
| 文心一言 | 20.0 | 20 | 20 |
| 豆包 | 16.8 | 17.5 | 20 |
| DeepSeek | 11.4 | 12 | 15 |
| 腾讯元宝 | 10.9 | 15 | 20 |
| 智谱 | 9.2 | 8.5 | 20 |
| 阶跃 | 9.0 | 8 | 17 |
| 通义千问 | 7.3 | 7 | 15 |
| Kimi | 5.9 | 6 | 16 |
| ChatGPT | 4.6 | 4 | 13 |
| Perplexity | 3.7 | 3 | 9 |
| Gemini | 1.9 | 2 | 4 |
文心和 Gemini 之间差了十倍。
文心的均值正好卡在 20,中位数也是 20,单次最多还是 20——这个形状说明它是顶格给满的: 只要有素材就取到上限。豆包接近同一模式。
反过来,Perplexity 均值 3.7、Gemini 均值 1.9,是精选少数的模式。
这对内容投放的直接含义是:同样一篇文章,进入文心答案的概率结构上就比进入 Gemini 高得多, 因为前者每次要填 20 个坑,后者只填 2 个。如果你的目标是「被引用」这个动作本身, 先把资源压在给来源多的引擎上,命中期望更高。
| 引擎 | Top 5 |
|---|---|
| 文心一言 | 百家号 217、B站 118、CSDN 101、知乎专栏 79、中国发展网 61 |
| DeepSeek | GitHub 63、百度百科 46、阿里云社区 35、腾讯云社区 32、新榜 31 |
| 腾讯元宝 | 微信公众号 106、腾讯新闻 39、今日头条 27、中国经济网 26、火山引擎社区 23 |
| 豆包 | 抖音 187、今日头条 124、博客园 48、搜狐 37、CSDN 33 |
| 阶跃 | 神马搜索 117、博客园 60、网易 31、CSDN 31、IT之家 30 |
| 智谱 | CSDN 45、博客园 43、火山引擎社区 33、今日头条 32、腾讯搜索 27 |
| Kimi | 博客园 77、火山引擎社区 25、IT之家 20、搜狐 15 |
| 通义千问 | 界面新闻 90、IT之家 56、中国商网 38、今日头条 30、中国经济网 23 |
| Perplexity | 博客园 48、腾讯云社区 36、网易 29、火山引擎社区 17、阿里云社区 15 |
| ChatGPT | arXiv 40、Reddit 18、火山引擎社区 18、TechRadar 12 |
| Gemini | 凤凰财经 21、新浪财经 12、SimilarWeb 6、YouTube 5 |
几个能直接读出来的差异:
与所有国产引擎都不重叠。
把每个引擎的引用按「是否属于同一家公司旗下的内容平台」归类:
| 引擎 | 总引用 | 自家生态占比 | 主要来源 |
|---|---|---|---|
| 豆包(字节) | 938 | 36% | 抖音 187、今日头条 124 |
| 文心(百度) | 1278 | 22% | 百家号 217、百度系其他 |
| 元宝(腾讯) | 1077 | 15% | 微信公众号 106、腾讯新闻 39 |
| 通义(阿里) | 438 | 2% | 阿里云社区 9 |
| DeepSeek / Kimi / 智谱 / 阶跃 | — | 0% | 这几家本身没有自有内容平台 |
豆包三分之一的引用来自抖音和今日头条。 这个比例高到不能当噪声看。
但要注意反例:DeepSeek、Kimi、智谱、阶跃这四家自家生态占比是 0——因为它们根本没有 自家内容平台。这说明上面那个偏向不像是「模型偏爱自己人」,更像是数据可得性的差异: 手上有现成的内容库,就更容易从那儿取。
通义只有 2% 也支持这个解释:阿里有内容生态,但在这个品类下阿里系内容本来就少。
这是整批数据里最反直觉、也最有用的一条。
1,610 个被引域名里,按「被几个引擎共同引用过」分布:
| 被几个引擎引用 | 域名数 | 占比 |
|---|---|---|
| 10 个 | 3 | 0.2% |
| 9 个 | 3 | 0.2% |
| 8 个 | 7 | 0.4% |
| 7 个 | 7 | 0.4% |
| 6 个 | 10 | 0.6% |
| 5 个 | 23 | 1.4% |
| 4 个 | 27 | 1.7% |
| 3 个 | 69 | 4.3% |
| 2 个 | 195 | 12.1% |
| 只有 1 个 | 1,265 | 78.6% |
近八成的域名,只有一个引擎引用过。
也就是说:绝大多数内容只能打动一个引擎。你在某个小站上被 DeepSeek 引了, 不代表豆包、文心会看同一个地方——大概率不会。
被 6 个以上引擎共同引用的「通用信源」总共只有 30 个。其中普通人能投稿的部分:
如果目标是「让尽可能多的 AI 都能看到你」,可选范围其实非常窄。
| 平台 | 覆盖引擎 | 引用总数 |
|---|---|---|
| 火山引擎开发者社区 | 10/11 | 149 |
| 博客园 | 9/11 | 378 |
| CSDN | 9/11 | 287 |
| 腾讯云开发者社区 | 9/11 | 161 |
| 网易号 | 9/11 | 111 |
| 搜狐号 | 8/11 | 123 |
| 阿里云开发者社区 | 8/11 | 86 |
| SegmentFault | 8/11 | 37 |
| 今日头条 | 5/11 | 214 |
| 掘金 | 5/11 | 20 |
| 微信公众号 | 2/11 | 111 |
| 知乎专栏 | 2/11 | 84 |
知乎专栏和微信公众号都只有 2/11。
这两个是中文互联网上体量最大的内容平台之一,但在这套题的引用池里,只有个别引擎会引它们: 公众号主要被腾讯自家的元宝引,知乎专栏主要被文心和 DeepSeek 引,其余引擎基本不取。
这不是说这两个平台没价值——是说如果你投入它们的目标是「被 AI 引用」,那这个目标大概率落空。 它们承担品牌、私域、承接这些职能时,得按那些职能去评估,别混进同一本账里算。
同样是被引,有的引擎来来回回就那几个源,有的则很分散:
| 引擎 | Top10 域名占其全部引用 | 域名总数 |
|---|---|---|
| 通义千问 | 69.9% | 70 |
| 文心一言 | 62.4% | 195 |
| Gemini | 60.2% | 47 |
| 阶跃 | 59.3% | 120 |
| 豆包 | 56.3% | 256 |
| Perplexity | 47.4% | 126 |
| 智谱 | 44.0% | 225 |
| ChatGPT | 39.2% | 144 |
| Kimi | 36.1% | 228 |
| 腾讯元宝 | 28.1% | 483 |
| DeepSeek | 25.1% | 413 |
通义千问只认 70 个域名,前 10 个就占了七成——这是一个几乎封闭的池子,新内容很难挤进去。
DeepSeek 和元宝正相反:分别有 413 和 483 个域名,前 10 个只占两三成,长尾非常长。 对新内容来说,这两个引擎的门槛结构上要低得多。
把 Q1 和这一节合起来看,会得到一个有意思的排序:元宝和 DeepSeek 既给的来源多(10.9 / 11.4 条)、 池子又分散(28% / 25%),是新内容最容易挤进去的两个;通义千问则是给得少(7.3 条) 又极集中(70%),最难。
这一节是全文最重要的,也是最容易被跳过的。
上面所有排名说的都是「引擎引用了哪些平台」。它不等于「你在这些平台发文就会被引用」。
这中间还隔着两步:
我们自己就卡在这两步上。
我们在四个平台发过内容——两家技术社区、一个问答社区、一个资讯平台,一共 6 篇。 把这 6 篇的文章 URL 逐条拿去和 7,317 条引用做精确匹配,结果是:
0 次。一次都没有。
而同一窗口内,这四个平台的域名在引用池里出现了几百次——全部是别人的内容。
这里有个很容易读错的地方,值得单独说:
域名进了引用池 ≠ 你的文章进了引用池。
我们自己在这上面判错过一次。当时看到某技术社区域名被引 89 次,很自然地想知道「其中有多少是我们的」, 就用了一个路径通配去标记「我方文章」——结果把那个社区上所有人的文章都算成了自己的, 得出「被引 22 次」的结论。改成拿真实文章 ID 逐条精确匹配之后,实际是 0。
一个让人以为「这条路走通了」,一个说明「一篇都没进去」。这两个结论会导向完全相反的资源分配。
所以:任何「我的内容被 AI 引用了」的判断,必须落到 URL 或 ID 级的精确匹配, 不能用域名、不能用路径通配。
既然平台是对的、内容却没进去,那就去看进去的是什么。
我们拆了引用池里被引最多的那篇头条文章(被引 9 次),特征如下:
合作 FAQ 全梳理》——和题集里「品牌 AI 可见度监测工具哪家好?」几乎是同义句
第四条尤其重要:它排除了「排队排不上」这个解释。新内容一周内可以进池, 那我们发了两周还是 0,原因就不在时间。
对比之下,我们那 6 篇的共同特征是:标题是陈述句(「某某实验第 N 期」)、篇幅两三千字、 开头直接进正文、一篇只讲一个数据切片。
结论不是「必须去写那种榜单」——那涉及另外的取舍。但有四件事是可以照做的,且不需要 评价任何竞品、也不需要自我推销:
| 可照做 | 说明 |
|---|---|
| 标题直接写成用户会问的那句话 | AI 匹配的是问题,不是主题 |
| 篇幅足够覆盖一整个问题簇 | 一个话题问完,而不是一期数据 |
| 开头列明「本文回答哪几个问题」 | 这是写给机器读的结构 |
| 一篇覆盖完整问题簇 | 而不是按周切片、每期只讲一部分 |
这篇文章本身就是按这四条写的。 它是不是有效,得看下一期的引用池数据, 现在下结论为时过早。
综合前面几节,可以给出一个不依赖直觉的判断顺序:
第一步:看它是不是通用信源。 被 6 个以上引擎共同引用的域名只有 30 个(1.9%)。如果目标平台不在这个范围内, 那么在它上面发内容,最多只能打动一两个引擎。这一步能排除掉绝大多数平台。
第二步:看你要打的那个引擎,给几条来源、池子多分散。 如果只想打某一个引擎(比如某个品类的主要流量来源),那么看它的引用密度和集中度: 给得多、池子散的引擎(元宝 10.9 条 / 28%,DeepSeek 11.4 条 / 25%)容易进; 给得少、池子集中的(通义 7.3 条 / 70%)很难。
第三步:确认你的内容能被收录。 这一步最容易被跳过,也最容易卡死。没进搜索索引的页面,不可能进引用池。 发布之后要实际去查收录,不能假设「发了就等于收了」。
第四步:发布后按 URL 精确核对,不看域名。 这是唯一能真正回答「我的内容有没有被引用」的方法。
四步里,前两步靠数据,后两步靠纪律。 大多数人只做了第一步的直觉版 (「这个平台大,应该有用」),然后跳过后三步。
同一批引擎,问不同层次的问题,来源分布会变:
| 题层 | Top 5 信源 |
|---|---|
| 核心品类(不带品牌名的需求题) | 博客园 206、CSDN 128、IT之家 97、百家号 95、抖音 89 |
| 竞品对比(直接问某个产品) | IT之家 61、博客园 44、CSDN 40、火山引擎社区 39、中国经济网 36 |
| 长尾问答(具体场景的口语提问) | 百家号 46、微信公众号 39、博客园 35、CSDN 30 |
| 技术与集成(偏实施层) | CSDN 43、百家号 42、腾讯云社区 40、抖音 34、B站 31 |
| 地区相关(带地域限定) | 博客园 65、百度百科 24、今日头条 20、百家号 16 |
两个值得注意的点:
引擎更倾向于取媒体评测而非社区讨论。
说明它在偏实施的问题上权重更高。
这意味着「该发哪个平台」这个问题,还得再往下拆一层:你想被哪一类问题引用。
写在最后,因为它决定了上面所有结论能用到什么程度:
任何单窗口读数都不能当基线,至少要三个点才谈得上趋势。
前者是必要条件,不是充分条件。
引见(YinJen)的生成式引擎优化(GEO)研究与实战团队,长期监测内容在 ChatGPT、Claude、Gemini、Perplexity、豆包、DeepSeek 等主流 AI 引擎中的引用与可见度。本系列均为一手实操记录。
了解引见如何帮你做 GEO →