Controlled source audit · 2026-08-24
来源很多,仍然可能没有形成证据。
我们用16个企业采购与GEO运营问题,在5个主流模型入口中保存了80份首次完整回答。目的不是评选平台,也不是证明某家公司被推荐,而是回答一个更基础的问题:模型展示的“来源”,到底能不能复核。
样本时间:2026年8月22日至23日;审核时间:2026年8月24日。
先看拆分后的数字
- 80份回答共披露971条来源记录。
- 769条可以解析为HTTP或HTTPS地址;清理常见追踪参数、片段和尾部斜杠后,得到699个唯一URL。
- 202条是不可解析为HTTP(S) URL的非URL文本记录;这些记录集中在11份回答中。现有采集字段没有证明它们全部都是来源标题。
- 另有16份回答正文完整,但没有披露任何可见来源。
因而,“完整回答”“有来源栏目”“有可打开URL”“来源支持相邻结论”必须分别记录。把它们合并成一个来源总数,会掩盖真正的证据缺口。
不同平台的来源呈现方式差异很大
平台回答数可解析URL / 非URL文本
百度AI搜索16317 / 0
DeepSeek16139 / 0
豆包16100 / 0
千问16213 / 0
腾讯元宝160 / 202
这里的差异只描述本轮界面实际披露的结果。它可能受入口、检索模式、页面版本、问题和时间影响,不能外推为平台永久能力,更不能用来宣称某个平台“更权威”。
URL可以打开,仍不等于结论可信
每条来源至少还要继续回答四个问题:
- 匿名访问时能否打开到固定页面,而不是登录墙、跳转页、搜索页或失效页?
- 页面的作者和责任主体是谁,是原始事实、平台转载、个人观点,还是商业投放?
- 页面正文是否真的支持模型回答旁边的那句话,而不是只与主题大致相关?
- 来源是否有日期、适用范围和更新状态,结论在本次观察时是否仍然有效?
本轮高频来源中既有技术社区,也有大量榜单、测评和营销稿。技术平台的域名不能替代作者与证据审核;同样,一篇文章被多个模型反复展示,也不能自动升级为独立第三方背书。
我们怎样处理这80份回答
80份回答已经通过“问题、正文和来源披露是否采集完整”的审核,但正式观测仍为零。带URL的53份回答继续核对可访问性与结论支撑;11份只有非URL文本来源的回答需要人工解析;16份无来源回答作为负面样本保留。审核采集完整,不代表批准回答中的公司排名、效果数字或推荐结论。
这也是企业采购GEO监测服务时值得现场确认的一点:系统能否同时导出问题原文、回答正文、来源原值、采集时间、入口模式、审核状态和历史版本,而不是只展示一张汇总图。
样本限制
- 样本只有16个问题和两个相邻日期,不代表所有行业与所有问题。
- 统计的是模型界面披露的来源,不代表模型内部训练数据或完整检索链路。
- 本页没有把来源出现次数解释为内容质量、平台权重或因果效果。
- 本页没有评选GEO服务商,也没有证明答源经纬已经被模型自然提及或推荐。