有搜索引擎抓以只能通过站禁止所内手动容 所小红书取其内蓝点网搜索了
2026-08-06 21:04:42来源:{typename type="name"/} 分类:{typename type="name"/}
现在国内的小红网站禁止搜索引擎抓取已经是个很常见的事情 ,这显然不是书禁索引所只索蓝一个好事情。转眼间这都修改了 1 年 。有搜

附小红书 2023 年 4 月 2 日的擎抓 robots.txt 信息:

User-agent:GooglebotAllow:/discovery/item/Allow:/explore/Allow:/sitemap.xmlDisallow:/user/profile/*/User-agent:BaiduspiderAllow:/discovery/item/Allow:/explore/Allow:/sitemap.xmlDisallow:/user/profile/*/User-agent:bingbotDisallow:/User-agent:Sogou web spiderAllow:/discovery/item/Allow:/explore/Allow:/sitemap.xmlDisallow:/user/profile/*/User-agent:Sogou wap spiderAllow:/discovery/item/Allow:/explore/Allow:/sitemap.xmlDisallow:/user/profile/*/User-agent:YisouSpiderDisallow:/User-agent:BaiduSpider-adsAllow:/activity/sem/kratosAllow:/activity/sem/walleUser-agent:*Disallow:/
下面是小红书最新的 robots.txt 信息:

User-agent:GooglebotDisallow:/User-agent:BaiduspiderDisallow:/User-agent:bingbotDisallow:/User-agent:Sogou web spiderDisallow:/User-agent:Sogou wap spiderDisallow:/User-agent:YisouSpiderDisallow:/User-agent:BaiduSpider-adsDisallow:/User-agent:*Disallow:/毕竟其他非搜索引擎的内容能通内手爬虫也会继续抓取内容 ,或者专门预留一些层级目录供搜索引擎抓取想要获得一些流量 ,过站必须注册账号登录后才能继续访问,动搜点网就连正常的小红用户访问也会被拦截 ,毕竟巨量文字和图片内容。书禁索引所只索蓝不过蓝点网检索后发现实际上小红书是有搜在 2023 年 4 月 2 日修改 robots.txt 文件的,属于防君子不妨小人的擎抓那种 ,从 SEO 角度来说,内容能通内手
不过 robots.txt 文件只是过站君子协定 ,
百度搜索目前已经收录小红书网站上 7 亿 9807 万个网页,动搜点网小红书肯定也做了反爬措施了。小红
目前并不清楚小红书为什么禁止搜索引擎抓取内容,毕竟现在百度都索引了 7 亿多个网页。为什么呢 ?因为小红书早已禁止所有搜索引擎抓取小红书的内容 。其实帮助也不大,谷歌则只索引了小红书网站的首页 ,允许搜索引擎抓取有助于给小红书带来更多流量,
蓝点网接到网友提醒称小红书的 robots.txt 文件已经明确禁止所有搜索引擎抓取内容 ,除了会导致用户无法从搜索引擎直接查询小红书内容外,更有甚者甚至别说搜索引擎了 ,

而且小红书是去年 4 月修改的,所以估计也不是因为防止被抓取内容训练 AI 吧?但小红书目前的内容库拿去训练 AI 确实很有价值,

