如何禁止爬取网页中的链接

 时间:2024-10-14 04:12:44

1、首先我们创建一个robots.txt

如何禁止爬取网页中的链接

2、根据Robots协议用来告知搜索引擎哪些页面能被抓取,哪些页面不能被抓取;可以屏蔽一些网站中比较大的文件,如:图片,音乐,视频等,节省服务器带宽;可以屏蔽站点的一些死链接。方便搜索引擎抓取网站内容;设置网站地图连接,方便引导蜘蛛爬取页面。

如何禁止爬取网页中的链接

3、在robots.txt文档中加入Disallow: *.htm,保存文件。

如何禁止爬取网页中的链接

4、将保存的文件上传到网站的根目录。

  • 大航海时代4 拉斐尔攻略
  • 太阁立志传5-建筑功能攻略
  • 大航海时代4全宝物攻略
  • 大航海时代4怎么威压
  • 大航海时代4卡斯特路攻略
  • 热门搜索
    纽贝滋奶粉怎么样 假音技巧和发声方法 accident怎么读 茄子煲的家常做法 宝宝便秘怎么调理 删除账单要人脸识别怎么解除 长高的锻炼方法 太原富士康怎么样 慢性荨麻疹怎么治 腰上的赘肉怎么减