我用 20 个问题测了 DeepSeek:一个新站会被引用吗?
做 GEO(生成式引擎优化)的人很多,但公开的测量记录很少。我先把自己的网站当实验对象:在动手优化之前测一次基线,然后公开结果,包括不好看的结果。
这篇讲三件事:怎么测的、测出了什么、这个结果能说明什么(以及不能说明什么)。
先说结论
这个结果并不意外:据我目前能确认的情况,本站在 Bing 里没有任何收录结果(其他搜索引擎我还没有确认,也还没有提交 sitemap)。但“意外与否”和“有没有数据”是两回事,数据是之后所有对比的起点。
怎么测的
题库固定,只测一次。20 条查询分两组:GEO 组 10 条,例如“郑州GEO优化”“郑州企业怎么让DeepSeek搜到”;扫码点餐组 10 条,例如“郑州扫码点餐系统”“郑州小餐馆怎么做扫码点餐”。每条既有商业意图(想找服务商),也有问题意图(想知道怎么做)。题库一旦冻结就不再改措辞,否则以后复测没法对比。
每条新开一个会话。避免上一条的上下文影响下一条。每条只问一次,不挑“好看的那次”。
完整留存原始证据。整段原始回答、来源列表和截图都已保存,目前在我本地,没有随网站公开。
只记录四项是 / 否的文本匹配:
| 检查项 | 含义 | 命中条数 |
|---|---|---|
| 回答中提到“张白杨” | 人名出现 | 0 / 20 |
| 回答中提到 zhangbaiyang.com | 域名出现 | 0 / 20 |
| 来源列表出现 zhangbaiyang.com 的页面 | 站点被引用 | 0 / 20 |
| 来源列表出现该查询对应的目标页 | 目标页被引用 | 0 / 20 |
我刻意没有做综合分数,也没有做“语义相似度”之类的打分。文本匹配粗糙,但任何人都可以复核;综合分数看起来高级,却很容易变成无法验证的数字。
测出了什么
站点本身是 0 / 20。更有价值的是另一面:DeepSeek 在回答这些问题时,引用的是哪些来源。统计 20 条回答的来源列表,出现次数最多的域名是:
- zhuanlan.zhihu.com(知乎专栏):42 次
- developer.aliyun.com(阿里云开发者社区):22 次
- baike.baidu.com(百度百科):18 次
此外还有腾讯云开发者社区等内容平台,以及几家做点餐系统的小型厂商官网。我从这里读到两点,它们是对这一次测试的解读,不是普适规律:
- 在这批问题上,AI 搜索更多是在引用内容平台上的文章,而不是各家公司官网。对一个新站来说,只做官网不够:别人在 AI 的来源列表里看到你,前提是你的内容出现在 AI 会去读的地方。
- 小厂商的官网也会被引用,说明这条路不是封死的——前提是页面被收录,并且内容与问题匹配。
这个结果不能说明什么
限制
- 只测了 DeepSeek 一个平台,只跑了一次。AI 的回答每次都可能不同,一次结果不代表稳定状态。千问、豆包等没有测。
- “命中”是文本匹配,不是语义评分。
- 基线对应的网站版本是 900f422,不是“优化之前”的版本:测试时郑州 GEO 与扫码点餐的页面和站内入口已经上线,所以它是此后每次改动的起点,而不是从零开始。
- 这个结果本身不说明任何做法有效或无效。我现在没有证据证明“做了某件事就能提升 AI 可见性”,这正是接下来要验证的。
如果你也想给自己的公司测一次
不需要任何工具,一个下午就能完成。
- 写 10–20 条真实客户会问的问题,不要写只有自己人才会问的话。
- 固定措辞,抄在表格里,之后不改。
- 每条新开会话问一次,保存完整回答、来源和截图。
- 记 3–4 个是 / 否字段:有没有提到你、有没有引用你的官网、事实对不对。
- 先别急着改官网。先看清楚问题出在“没被找到”“被说错了”,还是“没有可被引用的来源”——三种情况的处理方式完全不同。
可以直接用题库模板来设计问题和记录结果;测完之后怎么自查、先改什么,见 官网在 DeepSeek 里搜不到怎么办:8 项自查 和 企业信息一致性检查表;GEO 本身是什么,见 什么是 GEO。
接下来我打算做什么
- 让网站被搜索引擎收录(提交 sitemap 等基础动作)。
- 把真实经验写成文章,发到 AI 常引用的平台。
- 隔一段时间,用同一套 20 条题库在 DeepSeek 上复测,把新旧结果放在一起;如果没变化,我也会如实写没变化。
完整题库和逐条结果见 GEO 实验室,测量方法见 GEO Visibility Benchmark;如果想了解我如何为企业做这件事,见 企业 GEO 优化服务(先测量、再修正、再复测,不承诺排名或推荐)。