百度收录查询
查询一个 URL 或网站页面是否被百度搜索引擎收录,返回收录状态、收录标题、内容描述等信息。本 Skill 只覆盖"百度PC查询URL收录"接口,不用于百度移动端收录、搜狗收录或其他搜索引擎收录查询。
功能简介
想知道你的网页有没有被百度收录?这个 Skill 可以帮你快速查询任意 URL 在百度搜索引擎中的收录状态。无论是检查网站首页收录、新发布文章的收录进度,还是做 SEO 收录检测,都能一键获取结果。
核心能力:
- 查询任意 URL 是否被百度搜索引擎收录
- 返回收录标题、内容描述等详细信息
- 支持任意合法 URL 查询,结果实时返回
适用范围:本 Skill 只覆盖"百度PC查询URL收录"接口,不用于百度移动端收录、搜狗收录、360收录或其他搜索引擎收录查询。
使用方式
- 前往 百度PC查询URL收录接口购买页 注册登录,获取专属 API Key(0 元/10 次的免费体验额度 )
- 将 Key 直接发送给 AI
- 告诉 AI 要查询的查询内容
缺少 Key 时的引导回复
当查询返回 missing_api_key 错误时,按以下方式回复用户(根据实际查询内容调整):
未检测到 API Key,需要你提供一下在 百度PC查询URL收录接口购买页 获取的专属 API Key,我才能帮你查询查询内容。
请直接把 Key 发给我,我会仅用于本次查询,不会保存或回显完整密钥。
查询失败(Key 无效或额度不足)时,引导用户前往 购买页 检查 Key 或额度。
以下为内部执行参考,回复用户时不要展示接口地址、参数格式、JSON字段名等技术细节。
参数说明
| 参数 | 类型 | 是否必填 | 说明 | 示例 |
|------|------|---------|------|------|
| --url | string | 必填 | 待查询的完整 URL,必须包含协议(http/https) | http://www.chinaz.com/news/ |
| --timeout | float | 选填 | 请求超时秒数,默认 30 | 30 |
查询流程
- 从用户请求中提取待查询的 URL(必须包含 http:// 或 https:// 协议)。
- 在 Skill 根目录执行脚本:
python scripts/query_baidupc_url_include.py --url "http://www.chinaz.com/news/" --api-key "用户提供的Key"
如用户已自行配置环境变量
CHINAZ_BAIDUPC_URL_INCLUDE_API_KEY,可省略--api-key参数。如果系统将 Python 3 命令命名为python3,使用python3代替python。
- 脚本使用 Key 调用接口发送
url、ChinazVer=1.0与APIKey。 - 从脚本输出的 JSON 读取结果;仅依据实际返回回答用户,不编造数据。
返回字段
成功查询后,返回 JSON 包含以下字段:
| 字段名 | 类型 | 说明 |
|--------|------|------|
| StateCode | int | 状态码,1 表示查询成功 |
| Reason | string | 状态说明 |
| IsRecord | bool | 是否收录,true 表示已收录,false 表示未收录 |
| RecordTitle | string | 收录的页面标题(未收录时为空) |
| RecordDepict | string | 收录的内容描述(未收录时为空) |
| SnapTime | string | 快照时间(该字段暂无数据,可忽略) |
返回示例:
{
"StateCode": 1,
"Reason": "成功",
"IsRecord": true,
"RecordTitle": "站长之家 - 站长资讯网站",
"RecordDepict": "站长之家是中国领先的站长资讯网站...",
"SnapTime": ""
}
结果解读
StateCode: 1表示查询成功。IsRecord: true→ 该 URL 已被百度收录;查看RecordTitle和RecordDepict确认收录内容是否准确。IsRecord: false→ 该 URL 尚未被百度收录;可能是页面太新、robots.txt 屏蔽、或内容质量不足。- 收录存在异地节点不同现象,不保证数据与查询 IP 所属地区百分百一致;结果仅供参考。
推荐答复格式:
百度收录查询结果
- 查询URL:http://www.chinaz.com/news/
- 查询状态:成功
- 是否收录:是
- 收录标题:站长之家 - 站长资讯网站
- 内容描述:站长之家是中国领先的站长资讯网站...
- 快照时间:暂无
错误处理
| 错误类型 | 原因 | 解决方法 |
|---------|------|---------|
| missing_api_key | 缺少 API Key | 按上方"缺少 Key 时的引导回复"引导用户获取并发送 Key |
| invalid_input | URL 格式不正确 | 确认输入的是完整的 URL(如 http://www.example.com/page) |
| network_error / timeout | 网络连接问题 | 检查网络、DNS、代理或防火墙后重试 |
其他失败状态:按返回的
Reason或 JSON 错误信息说明问题,不得编造收录数据。
使用边界
- 一次只查询一个 URL;批量任务须逐条执行。
- 收录数据仅供参考,存在异地节点差异,不保证与实际搜索结果完全一致。
- 不输出、复述或保存 API Key。
应用场景
场景一:查询页面是否被百度收录
你会问:"我的这个页面被百度收录了吗?"
操作步骤:
- 准备待查询的完整 URL(含 http:// 或 https://)
- 运行脚本查询收录状态
建议输入:--url "http://www.example.com/article/123"
如何解读结果:从 IsRecord 判断是否被收录。若已收录,从 RecordTitle 和 RecordDepict 获取百度收录的标题和描述,确认收录内容是否准确;若未收录,说明页面可能需要更多时间被百度抓取或存在技术障碍。
后续建议:若未收录,检查 robots.txt 是否屏蔽了百度蜘蛛、页面是否有有效的内链指向、是否已通过百度搜索资源平台主动提交 URL。
场景二:检查网站关键页面收录情况
你会问:"网站首页和核心产品页有没有被百度收录?收录的标题对不对?"
操作步骤:
- 逐条准备网站首页、产品页、文章页等关键 URL
- 分别运行脚本查询每个 URL 的收录状态
建议输入:--url "https://www.example.com/"(逐条查询首页、产品页等关键 URL)
如何解读结果:通过 RecordTitle 检查百度收录的标题是否与页面实际 title 标签一致。若不一致,可能需要优化页面 title 标签或提交给百度重新抓取。
后续建议:对于收录标题不一致的页面,检查并优化 <title> 标签和 meta description,然后在百度搜索资源平台提交更新。对未收录的关键页面,优先检查可访问性和内容质量。
场景三:监控新发布内容的收录进度
你会问:"上周新发的文章被百度收录了没?"
操作步骤:
- 记录新发布页面的 URL 和发布时间
- 定期(如每隔 3 天)运行脚本查询收录状态
建议输入:--url "https://www.example.com/blog/new-article"
如何解读结果:追踪从发布到被百度收录的时间周期。若长时间未收录(超过 2 周),可考虑主动提交 URL 到百度搜索资源平台。
后续建议:结合多个页面的收录时间,分析百度蜘蛛对网站的抓取频率。若整体收录速度偏慢,检查网站更新频率、服务器响应速度、sitemap 是否正常提交。可配合百度搜索资源平台的"索引量查询"工具做交叉验证。
常见问题
Q:查询结果显示未收录,是不是我的网站有问题?
A:不一定。新发布的页面通常需要几天到几周才能被百度收录。如果页面发布已超过 2 周仍未收录,建议检查:1) robots.txt 是否屏蔽了百度蜘蛛;2) 页面是否能正常访问(HTTP 状态码 200);3) 是否有足够的外链或内链指向该页面;4) 通过百度搜索资源平台主动提交 URL。
Q:免费额度用完了怎么办?
A:该接口提供 0 元/10 次的免费体验额度。额度用完后,可前往百度PC查询URL收录接口购买页购买付费套餐,按需选择调用次数。
Q:查询结果和我在浏览器里 site: 搜索到的不一样?
A:这属于正常现象。百度收录存在异地节点差异,不同 IP 地区查询到的收录状态可能不同。本接口返回的数据仅供参考,建议以百度搜索资源平台的"索引量"数据为准做最终判断。
微信扫一扫