中国 AI 引擎适配:从国际方法到本土落地

前九课的方法,都是在"通用 AI 引擎"的框架下讲的——ChatGPT、Claude、Perplexity 这些国际引擎。但你的目标是中国的商户,他们用户的 AI 是秘塔、Kimi、豆包、通义千问、百度 AI 搜索。

这一课不是新方法,而是把前九课翻译成中国引擎的语言。逐项过一遍:哪些要改、哪些不用。

先认清中国 AI 引擎的地形

中国 AI 引擎分两类,抓取逻辑完全不同。

第一类:联网搜索型(秘塔、Kimi、豆包、通义千问的"联网"模式)。 用户提问 → 引擎实时抓取网页 → 引用来源。这一类和 Perplexity、ChatGPT 搜索同构——它们真的会抓你的站,前九课的方法全部直接适用。这是你的主要目标。

第二类:闭卷问答型(不联网,靠模型记忆)。 用户提问 → 引擎凭模型参数里的知识回答,不实时抓取。这一类不抓你的网页。它引用什么,取决于模型训练数据和模型内部的知识。对这类引擎,你的站能不能被引用,靠的是"你的内容进入了模型训练数据"——这就是第八课说的训练爬虫的价值,也是为什么你的 GEO 站不该拦 GPTBot、ClaudeBot、CCBot。

关键判断:你的文章全部是联网搜索型的菜。 要验证,就是去搜一搜。

逐方法适配表

前九课的方法在中国不是作废重来,而是按中国引擎偏好做增量调整:

方法(前九课) 中国版适配 你要做的
AI 爬虫 Baiduspider + bytespider + 秘塔爬虫 已放行(robots.txt 已含前两个,通配符兜底秘塔)
引用来源 优先中文权威源:知乎、百度百科、学术期刊 文章里多用中文源
结构化数据验证 百度搜索资源平台"抓取诊断" 用 json-ld.org 验证语法,再用百度抓取诊断
实体平台 知乎 + 百度百科 + 小红书 + 百家号 知乎已建,百度百科待建
监控 手动搜秘塔/Kimi/豆包 每周搜一次,记录基线

这张表的中心思想:方法不变,验证口径和引用源变成中国的。

站点中国适配现状审计

你的 jiyou.site 针对中国引擎,已经有八成地基,剩下两成是增量。逐项看:

已就绪的四项:

爬虫放行。 robots.txt 已放行 Baiduspider + bytespider,通配符兜底所有未列爬虫(含秘塔、豆包、通义的爬虫)。中国引擎能进。

结构化数据。 已用 JSON-LD(Article + Person + Organization + FAQPage),语法经 json-ld.org 验证。

实体锚点。 知乎已建,GitHub 已建。中国引擎识别"纪优 = GEO 研究者"有据可查。

中文内容。 全部中文原创,正是秘塔、Kimi、豆包偏好的来源。

需要增量的三项:

结构化数据验证——百度视角。 json-ld.org 验证的是"语法对不对",但百度有自己的偏好。百度资源平台登录后有"抓取诊断"工具,能模拟百度爬虫看它抓到你什么。动手项: 登录 ziyuan.baidu.com,用"抓取诊断"抓 jiyou.site 首页,确认百度爬虫能拿到 JSON-LD。这一步确认的是"百度会不会读你的结构化数据"。

引用来源——中文权威源。 你的文章里外链主要是 arXiv(英文论文)。中国引擎引用时偏好中文权威源(知乎、百度百科、中文期刊)。动手项: 后续文章多挂中文源。但注意——不要为了中文而中文,GEO 的核心是"每个声明附可查证来源",中文源和英文源都能被验证就行,只是中国引擎更认中文。

百度百科实体。 百度百科是百度 AI 搜的核心引用源。你的知乎已建立实体锚点,但百科是另一块拼图。这块有准入门槛,下文单独讲。

监控:这一课的核心作业

前九课教你怎么"被引用",这一课该教你怎么"看到被引用"。不做监控,你做的一切都是盲的。

监控的方法是手工搜索,五步:

  1. 打开秘塔 → 搜"GEO" → 看引用来源有没有 jiyou.site
  2. 打开 Kimi → 搜"GEO" → 同上
  3. 打开豆包 → 搜"GEO" → 同上
  4. 打开通义千问 → 搜"GEO" → 同上
  5. 打开百度 AI 搜 → 搜"GEO" → 同上

把结果记下来,作为基线,以后每周重复。

一个关键提示:别只搜"GEO"。 要搜和你文章标题、内容相关的长尾问题,比如"怎么让 AI 引用我的内容"、"自足段落怎么写"、"生成式引擎优化是什么"。你文章里正好是这些答案。长尾问题比大词更容易被你的站命中——因为竞争者少。

现在你的站内容还少、权重还低,大概率搜不到——但这是你的基线。以后每周搜一次,看着自己从"搜不到"到"被引用",就是 GEO 生效的证明。

百度百科实体:门槛与实操路线

百度百科是百度 AI 搜的核心引用源,但它不接受随便建。对词条有明确要求,绝大多数个人建不了。核心三条:

  1. 词条要有"关注度"。 要求有可靠来源佐证——权威媒体(人民网、新华网、行业垂直媒体)报道过,或是有影响的作品、头衔。一个普通人没有媒体报道,词条会以"关注度不足"被驳回。
  2. 不能自建自条目。 用自己账号建自己或自己公司的词条,容易被判定为"商业推广"或"利益冲突"直接拒绝。
  3. 要有可查证的公开信息。 百科要求内容有出处,不能是"我自我介绍"。

所以: 以"纪优"目前的公开足迹(一个自建站 + 一个知乎),基本建不了个人词条。这是实话,不是劝退——是把现实门槛讲清楚,别浪费时间撞墙。

但你能建两个东西:

口子 A:让"纪优"先有媒体报道,再申请词条。 百科审核看的是"有没有权威来源"。如果你能拿到一次行业媒体(GEO/SEO 垂直媒体的专访或案例报道),把报道链接作为来源提交,个人词条的通过率会大幅上升。这条路慢,但是正路。

口子 B:给"概念"建词条,而不是给"人"建。 比建"纪优"更容易的是建**"生成式引擎优化(GEO)"这个词条**——它是行业概念,你有研究、有原创文章、有论文依据(Princeton GEO 研究),这类概念词条比个人词条好过得多。建好"GEO"词条,里面提到"纪优的研究",就把你的实体接进去了。

正确的顺序分三阶段:

第一阶段(现在):把地基夯实。 继续写文章,让 jiyou.site 和知乎内容变多、被更多引擎引用。你被引用得越多,公开足迹越足。

第二阶段(内容够多后):先建"GEO"概念词条。 当你有 5-10 篇成体系的 GEO 文章、知乎有稳定更新后,尝试建"生成式引擎优化(GEO)"词条,把研究脉络写进去。这比个人词条可行。

第三阶段(有媒体报道后):建"纪优"个人词条。 拿到一次行业媒体引用、报道后,再申请个人词条,把百科、知乎、网站三方打通。

核心判断: 百度百科是**"水到渠成"型资产,不是"主动争取"型。它现在对你不是瓶颈——你真正的瓶颈是公开影响力还没攒够**。当你搜"GEO"能看到 jiyou.site 出现时,才是去建百科的时机。

三个常见问题

中国 AI 引擎会抓我的网站吗? 分两类。联网搜索型(秘塔、Kimi、豆包、通义的联网模式)会实时抓你的网页,前九课的方法全部适用;闭卷问答型不抓网页,靠模型记忆,能否被引用取决于你的内容是否进入了训练数据(这也是为什么不拦训练爬虫的原因)。

前九课的国际方法在中国还适用吗? 基本适用。联网搜索型的中国引擎和 Perplexity、ChatGPT 搜索同构。要调整的是:引用源优先中文权威源、结构化数据用百度视角验证、监控对象换成中国引擎。

怎么监控 jiyou.site 被中国引擎引用? 手工搜索五步:秘塔、Kimi、豆包、通义、百度 AI 搜各搜一次"GEO"或长尾问题,看引用来源有没有 jiyou.site,记录下来作为基线,每周重复。看着自己从"搜不到"到"被引用",就是 GEO 生效的证明。