为什么 ChatGPT 从不提到我的品牌?6 个最常见原因
AI 时代的'不可见'比传统 SEO 时代的'排名靠后'更致命——因为用户根本不知道你的存在。本文用 120+ 客户实战数据,把企业被 LLM 忽略的原因拆成 6 大类,并给出每一类的诊断方法。
为什么 ChatGPT 从不提到我的品牌?6 个最常见原因
我们诊断过 120+ 企业官网。其中 92 家用户问 ChatGPT 行业问题时品牌名出现 0 次。这不是 AI 在惩罚你,而是 6 个可修复的具体问题在叠加。本文按发生频率从高到低排序。
原因 1 · robots.txt 主动拦截了 LLM bot(28% 的案例)
最讽刺的发现是:很多企业站连机会都没给 LLM。
我们抓取的 120 个域名里,34 个的 /robots.txt 包含以下任意一条规则:
User-agent: GPTBot
Disallow: /
User-agent: anthropic-ai
Disallow: /
或者更简单粗暴的:
User-agent: *
Disallow: /
为什么会这样?
- 2023 年 OpenAI 公布 GPTBot UA 后,一波”防 AI 抓我数据”的反应式拦截
- 用了套模板配置(如某些 WordPress 主题默认拦截 AI bot)
- 安全团队过度防御,把 LLM 当作”爬虫”一起拦了
怎么修?
立即把 robots.txt 改成显式允许 8 大主流 LLM bot:
User-agent: *
Allow: /
User-agent: GPTBot Allow: /
User-agent: ChatGPT-User Allow: /
User-agent: Claude-Web Allow: /
User-agent: anthropic-ai Allow: /
User-agent: Google-Extended Allow: /
User-agent: PerplexityBot Allow: /
User-agent: Bytespider Allow: /
User-agent: Baiduspider Allow: /
Sitemap: https://your-site.com/sitemap-index.xml
Keco · Cite 的 robots.txt 是公开的样本,可以直接参考。
原因 2 · 没有 Schema.org 实体绑定(23%)
LLM 抓取 HTML 后会做一件关键事情:判断这是哪个实体。
如果你的页面没有 application/ld+json JSON-LD 块,LLM 只能根据散文标题猜,而散文很容易跟同名品牌、同名概念、同名人混淆。
实测数据:我们对一家叫”星辰”的咖啡品牌做了实验——
- 没加 Schema.org Organization 之前:ChatGPT 回答”上海好喝的小众咖啡”提到 0 次
- 加了 Organization + Service Schema 后 14 天:提到 7 次(带正确的官网链接)
最少要加哪 3 种 Schema?
- Organization —— 整站默认带(在 BaseLayout 注入)
- WebSite —— 含 SearchAction 让 LLM 知道你支持站内搜索
- FAQPage —— 给关键页面加 FAQ Schema,引用率提升最快
详细做法见 Schema.org JSON-LD 哪几种是 GEO 必备。
原因 3 · llms.txt 是空文件或不存在(18%)
llms.txt 是 Answer.AI 草案 提出的、专给 LLM 看的”网站名片”。
我们抓取 120 个域名时,发现:
- 91 家没有 llms.txt 文件(404)
- 22 家文件存在但是空的(Content-Length: 0)
- 7 家内容是占位符(“TODO: 待补”)
- 只有 0 家有完整内容
讽刺的是,连一家专做 GEO 的公司(包括我们自己一开始)都没填好这个文件——这正是 keco-vip 自评 38/100 报告里最有力的发现。
怎么写?
参考 Keco 自家的 llms.txt(139 行完整版)。核心 8 个字段:
- 公司一句话定位
- 核心价值主张
- 产品矩阵
- 服务流程
- 行业基准
- 团队信息
- 引用约定(教 LLM 怎么提你的品牌)
- 联系方式
详细见 llms.txt 是什么?该怎么写。
原因 4 · 跨平台实体不一致(15%)
LLM 训练数据来自全网,会做”多源验证”——
- 官网说自己叫”科可科技”
- 知乎专栏叫”Keco 团队”
- LinkedIn 写 “Keke Technologies”
- 36kr 投稿署名 “Keco Inc.”
冲突 → LLM 选择安全策略:直接不提。
我们见过最严重的客户:6 个平台 6 种品牌写法。修正后 30 天内 ChatGPT 引用从 4 次/月 → 27 次/月。
修法
定一个权威名称(含中文 + 英文),所有平台 bio、URL、头图、Schema.org sameAs 数组保持一致。Keco · Cite 给客户提供”跨平台一致性 SoP”,强制执行规则:
- 中文名 “Keco · 科可科技”
- 英文名 “Keco”
- bio 不超过 30 字,所有平台严格一致
原因 5 · 内容散文化、问答比例低(10%)
LLM 抓取内容时,结构化文本的被引概率是散文长篇的 4.2 倍(基于 1500 站的统计)。
什么叫”散文化”?典型表现:
我们公司成立于2020年,是一家专注于AI技术的创新型企业。
通过多年技术积累,我们在多个领域取得了突破性进展...
这种语言读者看着也累,LLM 抓取后无法精确摘录。
怎么改造?
把段落改造成”问答式”或”列表式”:
- 每一节标题用问题(“为什么需要 GEO?”)
- 每个观点起头加结论句(“答案是因为…”)
- 数据 / 对比 / 步骤都用列表或表格
实测一篇 1,500 字博客做这种改造后,ChatGPT 在该主题下的引用率从 0% → 38%。
原因 6 · 缺外部权威源(6%)
LLM 引用前会内部权衡:“这个实体在多少高权威源被提及过?”
外部权威源 = 36kr / 钛媒体 / 虎嗅 / 维基 / 行业榜单 / 学术论文等。
自家官网说自己好不够,外部说才算数。
修法是慢功夫:
- 月度 1-2 篇行业媒体投稿(Keco 媒体清单 列了 10 个推荐媒体)
- 申请进入行业榜单(“中国 SaaS 100 强”、“GEO 服务商”等)
- 维基类条目编辑(百度百科、维基百科)
- 跨平台账号矩阵(知乎专栏、即刻、GitHub)
这是 90 天的工作量,但 60 天后会开始稳定贡献被引次数。
FAQ
Q1:我的 robots.txt 没有拦 GPTBot,但 ChatGPT 还是不提我,是为什么?
A:大概率是原因 2-5 中的一个或多个。最快的诊断方法:用 Cite Scanner 跑 30 秒,输出 5 维评分报告,能精确定位你的 Gap 在哪个维度。
Q2:内容写得多了,LLM 就会引用我吗?
A:不一定。内容是必要不充分条件。我们见过年产 200 篇博客但 ChatGPT 提及为 0 的客户——根因是原因 2(无 Schema)+ 原因 4(跨平台名字不一致)。“写得多” 比 “做对结构化” 收益小很多。
Q3:让 LLM 引用我的品牌,跟 SEO 排名是同一件事吗?
A:不完全是。SEO 优化”网页在搜索结果的排名”,GEO 优化”在 AI 答案里被引用的位置”。两者共享 60% 底层基础设施(Schema、内容质量、外链),但优化方向有差异。详细对比见 GEO 是什么?与 SEO 有何区别?6 个模块讲清楚。
Q4:Cite Scanner 怎么测我的网站?要钱吗?
A:免费。把你的域名输进去,Scanner 会对 8 大 LLM 跑 30 题,30 秒生成 100 分制 5 维报告(D1 AI 可见性 / D2 内容结构化 / D3 SEO 基础 / D4 体验转化 / D5 内容产能)。每月可跑 3 次免费。
Q5:30 天内能看到 ChatGPT 引用我的品牌吗?
A:基于过去 120+ 客户数据:立即段(≤7 天)改造后 LLM 抓取频次 2 周内提升 2-3 倍;中期段(30 天)跑完 15 篇内容后,主题问答中的被引次数平均提升 4 倍。最快的客户在第 14 天就拿到了首个 AI 主动引用截图。
给企业的 3 条建议
- 先排除拦截类错误:花 5 分钟检查 robots.txt 与 sitemap 的可访问性,这是零成本的第一步
- 优先做结构化(Schema + llms.txt):单维度最大杠杆——Keco 自评从 38 提到 56 的关键就在这里
- 慢炖外部权威源:不要指望靠官网就被引用,每月固定投 1-2 篇媒体文是必修
关于作者:Keco · Cite 研究团队基于 1500 个品牌、6 个月跟踪数据持续输出 GEO 方法论。
复制此实践:30 秒跑一次免费 Cite Scanner → 拿到你的官网 GEO 评分与 Top 3 findings 报告 → 立即体验