导语

96project「AI推荐生态进入第二阶段」专题④|发布于2026年8月12日。文中8.3%来自中文生成式搜索学术研究;约40%的“幽灵引用”来自商业机构Writesonic的数据并经行业媒体报道,两组数据样本、平台和定义不同,不能直接横向比较或外推为所有AI平台的固定规律。

一份漂亮的GEO报告,可能什么也没有证明

想象一下这样的项目复盘:

品牌内容被AI引用了127次,引用率提高了35%,多个页面进入了来源列表。

会议室里的人很满意。直到有人问:AI的正文里说出品牌名字了吗?它有没有把品牌与那项研究、方法或产品优势联系起来?用户看完答案,知道为什么应该选择这个品牌吗?

现场突然安静。

这正是GEO最容易制造的虚假繁荣:品牌把“页面被机器使用”误认为“品牌被用户认识”,把“答案里出现链接”误认为“推荐理由已经形成”。

7月发布的一项中文生成式搜索研究,让这个问题第一次变得非常具体。

研究覆盖四个主流平台的Web和App界面、614个查询,并对每个查询、平台和界面重复三次。研究者从214119条原始记录中构建了160860条清洗后的引用记录。

结果显示:进入引用池的品牌,最终被答案明确呈现的总体比例只有8.3%;在包含联系信息的被检索来源中,只有12.4%的联系信息进入了答案。

换句话说,被检索、被引用和被呈现,是三件不同的事。

什么是“幽灵引用”

7月29日,Search Engine Land报道了另一组商业机构数据。Writesonic分析约1600万次品牌出现后发现,约40%的AI引用没有在回答正文中说出来源品牌。文章把这种现象称为“幽灵引用”。

例如,品牌A花费大量资源完成一项原创研究。AI在回答中写道:“一项分析发现,40%的引用没有说出来源品牌。”来源栏里确实链接了品牌A的网站,但正文没有告诉读者这项研究来自谁。

机器使用了内容,品牌却没有随内容一起旅行。

这组数据来自GEO服务商,属于特定30天窗口的商业研究快照,作者也明确说明,它不能证明幽灵引用形成的原因,更不能直接证明对点击、记忆、信任或销量的影响。

但它揭示的问题是真实的:引用率和品牌可见性必须分开测量。

为什么内容会被引用,品牌却被拿掉

### 第一,AI需要的是事实,不一定需要事实的主人

用户问“如何判断某类产品是否安全”,AI可能提取一个标准、数字或方法,却认为来源机构的名字对完成答案并非必要。

内容完成了证据任务,品牌没有完成认知任务。

### 第二,品牌与内容的归属关系不够清楚

研究报告、案例和方法论没有稳定作者信息,页面标题只写通用问题,正文多次使用“我们”却不说明“我们是谁”。

人类也许能从Logo看懂,机器未必能稳定建立“观点—证据—品牌”的关系。

### 第三,品牌只是发布者,不是被讨论的对象

有些内容很有用,但可以由任何机构发布。页面提供了知识,却没有说明品牌为什么在该领域具有独特经验、方法或责任。

AI把它当成一个可替换的资料来源,而不是一个值得记住的专业实体。

### 第四,答案空间有限

生成式答案会压缩多份来源。并不是每个被引用页面都能在正文获得同等位置。来源栏可以很长,正文里的品牌名额却很少。

进入证据池只是参加比赛,不代表站上领奖台。

GEO必须拆开六个不同结果

96project建议至少区分六层指标。

### 1. 收录

页面能否被平台抓取或进入可用索引。

### 2. 检索与引用

用户提问时,页面是否进入检索上下文,是否以链接或来源形式出现。

### 3. 品牌提及

答案正文是否明确说出品牌、人物、产品或机构名称。

### 4. 认知正确

AI是否正确理解品牌是谁、做什么、服务谁以及边界在哪里。

### 5. 推荐及推荐理由

AI是否在合适场景将品牌列为合理候选,并给出真实、准确、可验证的选择理由。

### 6. 行动

用户是否进一步核验、咨询、预约、导航、加购、购买或合作。

这六层不能用一个“综合AI排名分”盖住。

因为一个页面可能被引用,却没有品牌提及;品牌可能被提及,却被错误定义;品牌可能被正确推荐,却因为价格、库存、服务或行动路径问题没有转化。

品牌怎样避免变成AI的免费资料库

### 让核心知识带着清楚的归属

原创研究、方法、案例和数据,应明确机构、作者、发布日期、更新时间、研究对象、样本、方法和限制。

不是在每句话里机械塞品牌名,而是让知识的责任主体清楚可识别。

### 把观点与品牌能力连接起来

一篇内容不能只有“这个行业怎么做”,还要回答:品牌为什么有资格讨论这个问题?它的经验、产品、案例和方法如何支持结论?

这不是硬植入,而是建立实体关系。

### 建立可复述的品牌原话

品牌需要一套稳定、准确、自然的定义:是谁、解决什么、适合谁、凭什么以及边界在哪里。

AI可以压缩长篇内容,但如果没有清晰原话,它很可能只带走事实,不带走品牌。

### 用外部信源确认归属

当专业媒体、行业机构、客户和合作伙伴以自己的语言确认“这项方法来自谁、解决了什么”,品牌与知识的关系会更加稳定。

外部验证的作用不是复制官网,而是确认官网主张不是自说自话。

为什么一次测试尤其危险

中文生成式搜索研究还发现,在带发布日期的被引用页面中,高时效问题的拟合半衰期约为39天,低时效问题约为68天。

这不等于所有品牌内容都会在39天或68天后失效,但它提醒我们:来源新鲜度会随问题类型变化,AI可见性具有时间窗口。

同一个问题换个平台、入口、联网状态、措辞或日期,结果都可能不同。

因此,96project默认监测豆包、DeepSeek、千问、Kimi、文心一言,并记录原始回答、引用、追问路径和重复结果。

品牌需要看的不是一张最好看的截图,而是一段时间里的结果分布。

96project如何重新定义GEO验收

对于不同经营任务,指标重点也应不同。

引用率仍然重要,但它只是链条中的一环。

真正的目标不是让AI多用几次品牌内容,而是让内容中的真实价值能够带着品牌身份进入答案,形成正确认知、可信推荐和合理行动。

  • 认知纠错看重大错误、主体消歧和冲突关闭;
  • 品牌建设看定位关联、认知正确和场景覆盖;
  • 可信选型看推荐理由、证据追溯和异议覆盖;
  • 增长项目看有效咨询、加购或成交,同时标注非GEO因素;
  • 长期治理看事实新鲜度、资产覆盖、更新责任和复测结果。

结语:AI认识了你的内容,不等于认识了你

在传统搜索里,用户点击链接以后,大概率会看到页面Logo、导航和品牌介绍。

在生成式搜索里,AI可能只取走一句话、一个数字或一种表达,再把它融进自己的答案。

因此,品牌的竞争不只是“能否成为来源”,还包括“知识归属能否被保留”“品牌角色能否被正确表达”“推荐理由能否随事实一起出现”。

被引用,是内容的胜利。

被正确理解、可信提及并有理由推荐,才是品牌的胜利。

如果GEO报告没有回答这两者之间的差距,它展示的越漂亮,企业越可能在虚假繁荣里走得更远。

### 资料核验来源

  • 论文:《What Do Chinese-Language Generative Search Engines Cite and Surface? A Large-Scale Empirical Study》,2026年7月17日。https://arxiv.org/abs/2607.15771
  • Search Engine Land:《Ghost citations: Why AI search cites your content, not your brand》,2026年7月29日。https://searchengineland.com/ghost-citation-problem-ai-483794
  • 论文:《Optimizing Visibility in Generative Engines: A Critical Survey of Generative Engine Optimization (2023-2026)》,2026年7月15日。https://arxiv.org/abs/2607.14035
  • 96project:《核心体系》《中国AI平台与信源》《执行、监测与验收》。
更新与纠错

时效性平台规则、产品信息与市场数据会变化。若发现事实需要更新,请通过 18613826678 联系 96project;我们会保留核验与修订记录。