Insights·2026-08-07

Bing Webmaster Tools — 从 GSC 导入站点并查看 AI 引用

Bing Webmaster Tools 是微软免费提供给站长的控制台,可以看作 Google Search Console(GSC) 的必应版:查看收录状态、搜索查询、站点地图和外链,并可直接提交 URL。如果已经在用 GSC,注册只需一步——在添加站点的界面选择左侧的 Import 并连接 Google 账号,GSC 中已完成所有权验证的站点会连同站点地图一起导入,无需再改 meta 标签或 DNS 记录。此外,自 2026 年 2 月起新增了 AI Performance 报告,免费显示 Microsoft Copilot 与必应 AI 摘要引用你页面的次数。

Bing Webmaster Tools 요약 도식 — 위에 GSC Import 3단계(Import 선택, Google 계정 연동, 사이트 체크 후 Import), 가운데 IndexNow curl 명령 터미널, 아래 AI Performance 핵심 넷(grounding query, citation share, ChatGPT 미포함, 인용은 순위가 아님)
GSC Import 3단계와 발행 직후 IndexNow 호출, 그리고 AI Performance에서 볼 것과 못 볼 것.

Bing Webmaster Tools 是什么

这是微软免费提供给站点所有者的管理控制台,地址是 bing.com/webmasters。除微软账号外,也可以用 Google 账号或 Facebook 账号登录,无需安装任何软件。

界面与 Google Search Console 几乎一一对应:哪些页面被收录、哪些查询带来了展现和点击、站点地图是否正常、谁链接了你、robots.txt 是否有语法错误。用过 GSC 的人几乎不需要重新学习。

有三样东西是 GSC 没有的。第一,直接提交 URL 的配额很大,每天一万条。第二,IndexNow 密钥在这个界面签发和管理。第三,2026 年新增的 AI Performance 报告。这三点才是今天注册必应的实际理由。

只看搜索份额,理由并不充分。在韩国用必应搜索的人并不多。但必应索引现在的价值,不在于人手动输入的搜索框,而在于 AI 生成答案寻找依据时会经过的那个位置。

ChatGPT 的搜索爬虫不是必应爬虫——先纠正这个前提

谈 GEO 时最常见的一句话是:ChatGPT 用必应,所以必须在必应注册。这只对了一半,而错的那一半会在实操中出事。

先看抓取。OpenAI 公开记录了自家的四个爬虫:OAI-SearchBot(用户代理 OAI-SearchBot/1.4)负责让站点出现在 ChatGPT 的搜索功能中,GPTBot(GPTBot/1.4)为模型训练收集内容,ChatGPT-User(ChatGPT-User/1.0)在用户要求打开某个链接时抓取,OAI-AdsBot(OAI-AdsBot/1.0)用于校验广告落地页的安全性。每个爬虫的 IP 段都公开在 openai.com/searchbot.json 之类的地址上。

也就是说,因 ChatGPT 而出现在服务器日志里的用户代理不是 bingbot,而是 OAI-SearchBot。在 robots.txt 中允许或屏蔽的对象也是它。把站点注册到必应,与 OpenAI 的爬虫毫无关系。

检索环节呢?OpenAI 帮助中心只写了 ChatGPT 搜索有时会与其他搜索提供方合作,并把必应列为其中一家合作方。是有时,是其中之一。这不等于全部走必应,而且从外部无法判断哪个问题走了哪条路径。

相反,Microsoft Copilot 是明确的。必应自己写明 AI Performance 报告覆盖 Microsoft Copilot 和必应中的 AI 生成摘要,而 ChatGPT 这个词一次都没有出现。

结论是:注册必应能确定回收的是 Copilot 和必应 AI 摘要,ChatGPT 只是间接的,而且无法测量。仍然要注册——因为成本只是连接一次账号,而不是因为 ChatGPT 有保证。混淆这条界线,之后就会把报告里的数字误读成 ChatGPT 的成绩。

方案 A——从 Google Search Console 导入(推荐)

如果已经在用 GSC,就没有必要再验证一次所有权。必应会直接承认 GSC 的验证结果。

第一步。打开 bing.com/webmasters 登录。进入添加站点的界面后会弹出选择方式的窗口,左侧是从 Google Search Console 导入(Import),右侧是手动添加(Add your site manually)。点击左侧的 Import 按钮。

第二步。界面会说明将要导入哪些数据。点击 Continue,用 Google 账号登录,并授权必应读取你的 Search Console 数据。

第三步。GSC 账号下的站点列表会显示出来,每个站点旁边标着站点地图数量和你的权限角色。勾选要导入的站点,点击 Import。

到这里就结束了。导入的站点自动处于已验证状态,站点地图也一并带过来,上传文件或修改 DNS 的步骤整段消失。

有两个上限:一次最多 100 个站点,一个账号最多 1000 个。超过 100 个就重复同样的流程,也可以从多个 Google 账号分批导入。

数据最多需要 48 小时才会填充。刚导入完界面是空的并不代表失败,第二天再看。

有一点要注意。导入是把验证委托出去,而不是永久豁免。必应会定期回到 GSC 账号重新确认所有权。如果之后访问权限消失,就必须重新连接,或者改用下面方案 B 的 meta 标签或 DNS 方式。

方案 B——手动添加时的三种所有权验证

展示 Bing 手动添加站点时的三种所有权验证方式(XML 文件、meta 标签、DNS CNAME)及该 meta 标签代码的示意图。

如果不用 GSC,或者不想连接 Google 账号,就直接添加站点。输入网址后,必应会给出三种验证所有权的方式。

第一,XML 文件。下载必应生成的 BingSiteAuth.xml,原样上传到站点根目录。能通过 FTP 或静态托管上传文件的环境,这是最简单的。

第二,meta 标签。把名为 msvalidate.01 的 meta 标签放进首页的 head 中。像 Next.js 或 WordPress 这种在模板里加一行很容易的环境,这条路更快。

第三,DNS CNAME 记录。把必应指定名称的 CNAME 指向 verify.bing.com。这是按域名级别验证,一次覆盖所有子域名,即使整站重做也不会失效,长期看最稳固。

选择标准很简单:能上传文件就用 XML,能改模板就用 meta 标签,能改 DNS 就用 CNAME。三选一即可。

meta 标签方式——在 <head> 中加一行
<meta name="msvalidate.01" content="这里填必应给的验证码" />

注册之后要做的三件事——站点地图、URL 提交、IndexNow

只注册然后关掉页面,什么都不会发生。要让收录真正跑起来,还需要三步。

第一,站点地图。如果是从 GSC 导入的,它已经在里面了,只需在 Sitemaps 界面确认。没有的话就直接提交 sitemap.xml 的地址。必应建议每天至少刷新一次站点地图。发文频繁的站点,最好确认每次构建都会重新生成站点地图。

第二,URL 提交。大多数站点每天可以直接提交多达一万条 URL。必应在 2019 年把配额从每天 10 条提高到这个数字,一直保持至今。发布新文章后立刻提交那条 URL,不必等爬虫自己找上门。

第三,IndexNow。这不是必应专属功能,而是一个协议。生成 8 到 128 个字符的密钥(英文大小写、数字、连字符),把以该密钥命名的文本文件上传到站点根目录,然后在内容新增、修改或删除时通知 API。单次 POST 最多可以发送一万条 URL。

单独强调 IndexNow 是有理由的。参与的引擎不只有必应,还有 Naver、Yandex、Seznam、Yep 和 Amazon。对韩国的站点来说,光是名单里有 Naver 这一点就值得接入。接好之后,只是在发布脚本末尾多一次请求而已。

各引擎的频率上限不同且未公开。收到 429 响应说明超限,看 Retry-After 头之后再发。

IndexNow——发布后调用一次
curl -X POST https://api.indexnow.org/indexnow \
  -H 'Content-Type: application/json' \
  -d '{
    "host": "example.com",
    "key": "这里填自己生成的密钥",
    "keyLocation": "https://example.com/这里填自己生成的密钥.txt",
    "urlList": [
      "https://example.com/insights/new-post"
    ]
  }'

AI Performance 报告——能看到什么

这个界面于 2026 年 2 月 10 日以公开预览的形式上线,显示你的页面被 AI 生成答案作为依据引用的次数,覆盖 Microsoft Copilot、必应中的 AI 生成摘要,以及未具名的部分合作方集成。

基础指标有四个。Total Citations 是所选时间段内在 AI 答案中作为来源展示的引用总数,Average Cited Pages 是每天平均有多少个不同页面被用作来源,Grounding Queries 是 AI 检索被引用内容时使用的关键短语,另外还有按页面统计的引用活动。

其中实操价值最大的是 grounding query。关键在于,它不是用户实际输入的句子,而是 AI 为了找依据文档在内部重写出来的查询。人问得很长,模型会改写成简短且适合检索的形式。看清自己的文章命中了哪些重写查询之后,把标题和小标题调整到那套词汇上,就是 GEO 的实际工作——靠观测而不是靠猜。

2026 年 6 月 16 日又新增了四项预览功能。Intents 把 grounding query 归入信息型、商业型、导航型、学习与解决、研究、创作、本地等意图类别。Topics 把单个查询聚成主题簇。Citation Share 是同一个 grounding query 下,全部引用中你的站点所占的比例。Compare 可以叠加上一个时间段进行对比。

Citation Share 不是竞品分析工具。必应明确说明它只用于观测,不暴露竞争对手数据,也不代表流量。

指标统计什么怎么用
Total Citations期间内在 AI 答案中作为来源展示的引用总数与发文节奏叠看,分辨哪类文章更容易被引用
Average Cited Pages每天被引用的不同页面数看是一篇独撑还是多篇均衡命中
Grounding QueriesAI 检索依据时生成的重写查询按这套词汇重写标题与小标题
Citation Share同一查询全部引用中你的占比区分是自己涨了还是整个查询变大了

看不到的部分——这份报告测不了 ChatGPT

打开报告之前,先把限制写下来。数字读错,就会汇报出并不存在的成绩。

第一,ChatGPT 不在覆盖范围内。必应的公告里没有出现过这个名字,只写了部分合作方集成,且没有点名。可以认为 ChatGPT 的引用在这个界面上看不见。

第二,grounding query 是样本而不是全集。必应自己写明这是引用活动的抽样。没出现在列表里,不等于没有被引用。

第三,引用数不是排名。必应明确指出这些指标反映页面被引用的频率,而不是重要性、排名或展示位置。

第四,引用不是流量。作为来源出现在 AI 答案里,和用户点击是两回事。引用数上升而访问量不变,是正常状态。

第五,这是预览版。必应自己说明 6 月新增的功能建立在仍在演进的系统之上,精度会继续提升,专业领域尤其粗糙。

所以 ChatGPT 那一侧要用别的手段来看。一是直接查询测试:定期把自己主题的代表性问题输入 ChatGPT,确认自己的页面是否作为来源出现。二是服务器日志:按用户代理统计 OAI-SearchBot 和 ChatGPT-User 的命中,就能知道 OpenAI 是否真的在读你的站点。把必应报告当作 Copilot 仪表盘来读,ChatGPT 用这两种方式单独测量,这是目前能做到的最好办法。

GEO 心得——在 robots.txt 里区分训练爬虫与搜索爬虫

左右对比图:在 robots.txt 中屏蔽训练类爬虫,同时放行搜索与引用类机器人。

想被引用,首先得被抓取。必应注册也好,IndexNow 也好,前提都是上游的 robots.txt 是开放的。而最常见的事故恰恰出在这里。

AI 爬虫分三类:训练收集(GPTBot、ClaudeBot、Google-Extended)、搜索与引用(OAI-SearchBot、Claude-SearchBot、PerplexityBot、bingbot),以及用户打开链接时触发的抓取(ChatGPT-User)。最后一类因为是用户主动要求的,OpenAI 明确说明可能不适用 robots.txt。

事故是这样发生的:不希望自己的文章被用于模型训练,于是屏蔽 GPTBot,而同一条规则把搜索爬虫也一起屏蔽了。结果不只是训练被挡,引用也一起消失——等于亲手关上了自己出现在 AI 答案来源里的通道。

确实有平台把两者分开了。Brunch 在 robots.txt 中全面屏蔽 GPTBot、ClaudeBot、Google-Extended 等训练爬虫,同时允许 OAI-SearchBot、Claude-SearchBot、PerplexityBot 等搜索爬虫。放弃训练资产,只保留引用资产。理解这个区别之后,在哪个平台发什么内容的判断也会随之改变。

个人站点或公司站点,通常全面允许才是默认值。本站的 robots.txt 也只有一条对所有用户代理的全站允许,外加一行站点地图地址。如果目标是被引用,就没有必要收窄。

顺序整理如下:在 robots.txt 中放行搜索爬虫,注册必应打通收录路径,用 IndexNow 即时通报更新,然后再用 AI Performance 观测自己命中了哪些查询。内容打磨建立在这层观测之上。顺序颠倒,就会出现写得很好却长期无人读到的局面。

robots.txt——挡住训练,放行引用
# 只屏蔽训练收集
User-agent: GPTBot
Disallow: /

User-agent: ClaudeBot
Disallow: /

User-agent: Google-Extended
Disallow: /

# 允许搜索与引用爬虫
User-agent: OAI-SearchBot
Allow: /

User-agent: PerplexityBot
Allow: /

User-agent: bingbot
Allow: /

User-agent: *
Allow: /

Sitemap: https://example.com/sitemap.xml