网站 robots 查看
输入域名,查看其 robots.txt 原文。
核心结论
- 用途:「网站 robots 查看」属于「站长工具」分类,用于查看其 robots.txt 原文。
- 输入:需要填写 1 项——域名。
- 运行方式:需要联网获取实时数据,需要抓取目标站 robots.txt,因此必须联网;不会跳转第三方网站,也不会上传你输入的内容。
- 结果口径:结果是发起查询那一刻的快照;DNS、证书等存在缓存,实际生效情况请以服务商为准。
温馨提示:本工具结果基于公开数据与算法,仅供参考,不构成专业意见。涉及隐私的查询均在本地完成,不会上传。
什么是网站 robots 查看
robots.txt 是网站告知爬虫哪些路径可抓取的文件。本工具获取目标站 robots.txt 原文并显示(目标站禁止跨域时经公共代理获取),便于站长做 SEO 排查。
如何使用网站 robots 查看
- 在「域名」中填写对应数值
- 点击「查询」按钮
- 在下方的「结果」区域查看网站 robots 查看的结果
网站 robots 查看与同类工具对比
| 工具 | 用途说明 | 适用关键词 |
|---|---|---|
| 网站 robots 查看(本工具) | 输入域名,查看其robots.txt原文。 | robots,robots.txt,爬虫,站长 |
| robots.txt 生成 | 根据禁爬路径生成robots.txt内容。 | robots生成,爬虫,禁止 |
| robots 路径 | 给出robots.txt标准路径。 | robots |
| ROT-N 移位加密 | 把英文字母按给定位数循环移位。 | rot,移位密码,凯撒 |
| ROT13 | 对字母做ROT13替换。 | rot13,加密 |
| ROT13 密码 | 字母旋转13位。 | rot13,加密 |
常见问题
为什么有时取不到?
目标站未部署 robots.txt 或禁止抓取时可能失败。
robots 有约束力吗?
为自愿协议,规范爬虫会遵守。