返回 Skill 列表
extension
分类: 营销与增长无需 API Key

百度收录查询

查询URL或网站页面是否被百度搜索引擎收录,返回收录状态、收录标题、内容描述等信息

person作者: xmchinazhubOpenAPI

百度收录查询

查询一个 URL 或网站页面是否被百度搜索引擎收录,返回收录状态、收录标题、内容描述等信息。本 Skill 只覆盖"百度PC查询URL收录"接口,不用于百度移动端收录、搜狗收录或其他搜索引擎收录查询。

功能简介

想知道你的网页有没有被百度收录?这个 Skill 可以帮你快速查询任意 URL 在百度搜索引擎中的收录状态。无论是检查网站首页收录、新发布文章的收录进度,还是做 SEO 收录检测,都能一键获取结果。

核心能力

  • 查询任意 URL 是否被百度搜索引擎收录
  • 返回收录标题、内容描述等详细信息
  • 支持任意合法 URL 查询,结果实时返回

适用范围:本 Skill 只覆盖"百度PC查询URL收录"接口,不用于百度移动端收录、搜狗收录、360收录或其他搜索引擎收录查询。

使用方式

  1. 前往 百度PC查询URL收录接口购买页 注册登录,获取专属 API Key(0 元/10 次的免费体验额度 )
  2. 将 Key 直接发送给 AI
  3. 告诉 AI 要查询的查询内容

缺少 Key 时的引导回复

当查询返回 missing_api_key 错误时,按以下方式回复用户(根据实际查询内容调整):

未检测到 API Key,需要你提供一下在 百度PC查询URL收录接口购买页 获取的专属 API Key,我才能帮你查询查询内容。

请直接把 Key 发给我,我会仅用于本次查询,不会保存或回显完整密钥。

查询失败(Key 无效或额度不足)时,引导用户前往 购买页 检查 Key 或额度。


以下为内部执行参考,回复用户时不要展示接口地址、参数格式、JSON字段名等技术细节。

参数说明

| 参数 | 类型 | 是否必填 | 说明 | 示例 | |------|------|---------|------|------| | --url | string | 必填 | 待查询的完整 URL,必须包含协议(http/https) | http://www.chinaz.com/news/ | | --timeout | float | 选填 | 请求超时秒数,默认 30 | 30 |

查询流程

  1. 从用户请求中提取待查询的 URL(必须包含 http:// 或 https:// 协议)。
  2. 在 Skill 根目录执行脚本:
python scripts/query_baidupc_url_include.py --url "http://www.chinaz.com/news/" --api-key "用户提供的Key"

如用户已自行配置环境变量 CHINAZ_BAIDUPC_URL_INCLUDE_API_KEY,可省略 --api-key 参数。如果系统将 Python 3 命令命名为 python3,使用 python3 代替 python

  1. 脚本使用 Key 调用接口发送 urlChinazVer=1.0APIKey
  2. 从脚本输出的 JSON 读取结果;仅依据实际返回回答用户,不编造数据。

返回字段

成功查询后,返回 JSON 包含以下字段:

| 字段名 | 类型 | 说明 | |--------|------|------| | StateCode | int | 状态码,1 表示查询成功 | | Reason | string | 状态说明 | | IsRecord | bool | 是否收录,true 表示已收录,false 表示未收录 | | RecordTitle | string | 收录的页面标题(未收录时为空) | | RecordDepict | string | 收录的内容描述(未收录时为空) | | SnapTime | string | 快照时间(该字段暂无数据,可忽略) |

返回示例

{
  "StateCode": 1,
  "Reason": "成功",
  "IsRecord": true,
  "RecordTitle": "站长之家 - 站长资讯网站",
  "RecordDepict": "站长之家是中国领先的站长资讯网站...",
  "SnapTime": ""
}

结果解读

  • StateCode: 1 表示查询成功。
  • IsRecord: true → 该 URL 已被百度收录;查看 RecordTitleRecordDepict 确认收录内容是否准确。
  • IsRecord: false → 该 URL 尚未被百度收录;可能是页面太新、robots.txt 屏蔽、或内容质量不足。
  • 收录存在异地节点不同现象,不保证数据与查询 IP 所属地区百分百一致;结果仅供参考。

推荐答复格式

百度收录查询结果
- 查询URL:http://www.chinaz.com/news/
- 查询状态:成功
- 是否收录:是
- 收录标题:站长之家 - 站长资讯网站
- 内容描述:站长之家是中国领先的站长资讯网站...
- 快照时间:暂无

错误处理

| 错误类型 | 原因 | 解决方法 | |---------|------|---------| | missing_api_key | 缺少 API Key | 按上方"缺少 Key 时的引导回复"引导用户获取并发送 Key | | invalid_input | URL 格式不正确 | 确认输入的是完整的 URL(如 http://www.example.com/page) | | network_error / timeout | 网络连接问题 | 检查网络、DNS、代理或防火墙后重试 |

其他失败状态:按返回的 Reason 或 JSON 错误信息说明问题,不得编造收录数据。

使用边界

  • 一次只查询一个 URL;批量任务须逐条执行。
  • 收录数据仅供参考,存在异地节点差异,不保证与实际搜索结果完全一致。
  • 不输出、复述或保存 API Key。

应用场景

场景一:查询页面是否被百度收录

你会问:"我的这个页面被百度收录了吗?"

操作步骤

  1. 准备待查询的完整 URL(含 http:// 或 https://)
  2. 运行脚本查询收录状态

建议输入--url "http://www.example.com/article/123"

如何解读结果:从 IsRecord 判断是否被收录。若已收录,从 RecordTitleRecordDepict 获取百度收录的标题和描述,确认收录内容是否准确;若未收录,说明页面可能需要更多时间被百度抓取或存在技术障碍。

后续建议:若未收录,检查 robots.txt 是否屏蔽了百度蜘蛛、页面是否有有效的内链指向、是否已通过百度搜索资源平台主动提交 URL。

场景二:检查网站关键页面收录情况

你会问:"网站首页和核心产品页有没有被百度收录?收录的标题对不对?"

操作步骤

  1. 逐条准备网站首页、产品页、文章页等关键 URL
  2. 分别运行脚本查询每个 URL 的收录状态

建议输入--url "https://www.example.com/"(逐条查询首页、产品页等关键 URL)

如何解读结果:通过 RecordTitle 检查百度收录的标题是否与页面实际 title 标签一致。若不一致,可能需要优化页面 title 标签或提交给百度重新抓取。

后续建议:对于收录标题不一致的页面,检查并优化 <title> 标签和 meta description,然后在百度搜索资源平台提交更新。对未收录的关键页面,优先检查可访问性和内容质量。

场景三:监控新发布内容的收录进度

你会问:"上周新发的文章被百度收录了没?"

操作步骤

  1. 记录新发布页面的 URL 和发布时间
  2. 定期(如每隔 3 天)运行脚本查询收录状态

建议输入--url "https://www.example.com/blog/new-article"

如何解读结果:追踪从发布到被百度收录的时间周期。若长时间未收录(超过 2 周),可考虑主动提交 URL 到百度搜索资源平台。

后续建议:结合多个页面的收录时间,分析百度蜘蛛对网站的抓取频率。若整体收录速度偏慢,检查网站更新频率、服务器响应速度、sitemap 是否正常提交。可配合百度搜索资源平台的"索引量查询"工具做交叉验证。

常见问题

Q:查询结果显示未收录,是不是我的网站有问题?

A:不一定。新发布的页面通常需要几天到几周才能被百度收录。如果页面发布已超过 2 周仍未收录,建议检查:1) robots.txt 是否屏蔽了百度蜘蛛;2) 页面是否能正常访问(HTTP 状态码 200);3) 是否有足够的外链或内链指向该页面;4) 通过百度搜索资源平台主动提交 URL。

Q:免费额度用完了怎么办?

A:该接口提供 0 元/10 次的免费体验额度。额度用完后,可前往百度PC查询URL收录接口购买页购买付费套餐,按需选择调用次数。

Q:查询结果和我在浏览器里 site: 搜索到的不一样?

A:这属于正常现象。百度收录存在异地节点差异,不同 IP 地区查询到的收录状态可能不同。本接口返回的数据仅供参考,建议以百度搜索资源平台的"索引量"数据为准做最终判断。