九州下载 - 系统安卓苹果手机游戏推荐下载网站!

当前位置:九州下载 > SEO优化 >

怎么查看网站的robots爬虫协议

时间:2022-10-25 10:26编辑:九州下载来源:www.wzjsgs.com

  Robots协议也叫robots.txt(统一小写)是一种存放于网站根目录下的ASCII编码的文本文件,它通常告诉网络搜索引擎的漫游器(又称网络蜘蛛),此网站中的哪些内容是不应被搜索引擎的漫游器获取的,哪些是可以被漫游器获取的。因为一些系统中的URL是大小写敏感的,所以robots.txt的文件名应统一为小写。

Robots协议文件查看方法

  robots协议查看方法:网址+robots.txt

  网站域名/robots.txt

  以下是某网站上robots.txt的示例:

  User-agent: * 【允许所有搜索引擎访问网站所有内容】

  Disallow: /plus/ad_js.php【禁止访问 /plus/ad_js.php这个文件夹的所有内容】

  Disallow: /plus/advancedsearch.php

  Disallow: /include

  Disallow: /templets

  Sitemap:

  robots协议放在网站根目录里面,robots.txt可以通过FTP工具下载到本地进行查看。一般要是网站没多大问题的,有可能没有robots协议。如果想单独定义搜索引擎的漫游器访问子目录时的行为,那么可以将自定的设置合并到根目录下的robots.txt,或者使用robots元数据(Metadata,又称元数据)。

相关文章