主页 > 平台资质 > 正文
网站的robots.txt文件设置是不是合理,哪些文件或许目录需求屏蔽、哪些设置办法对网站运营有优点?有人复制出相同的内容以应付不同搜索引擎的排名规则。然而,一旦搜索引擎发现站内有大量“克隆”的页面,就会给以惩罚,不收录这些重复的页面。
另一方面,我们网站的内容属于个人私密文件,不想暴露在搜索引擎中。这时,robot.txt就是为了解决这两个问题。
一、什么是robots.txt?
robots.txt 是网站和搜索引擎的协议的纯文本文件。当一个搜索引擎蜘蛛来访问站点时,它首先爬行来检查该站点根目录下是否存在robots.txt,
如果存在,根据文件内容来确定访问范围,如果没有,蜘蛛就沿着链接抓取。robots.txt 放在项目的根目录下。
二、 robots.txt基本语法:
1) 、允许所有搜索引擎访问网站的所有部分
robots.txt写法如下:
User-agent: *
Disallow:
或者
User-agent: *
Allow: /
注意: 1. ****个英文要大写,冒号是英文状态下,冒号后面有一个空格,这几点一定不能写错。
2) 、禁止所有搜索引擎访问网站的所有部分
robots.txt写法如下:
User-agent: *
Disallow: /
3) 、只需要禁止蜘蛛访问某个目录,比如禁止admin、css、images等目录被索引
robots.txt写法如下:
User-agent: *
Disallow: /css/
Disallow: /admin/
Disallow: /images/
注意:路径后面有斜杠和没有斜杠的区别:比如Disallow: /images/ 有斜杠是禁止抓取images整个文件夹,Disallow: /images 没有斜杠意思是凡是路径里面有/images关键词的都会被屏蔽
4)、屏蔽一个文件夹/templets,但是又能抓取其中一个文件的写法:/templets/main
robots.txt写法如下:
User-agent: *
Disallow: /templets
Allow: /main
5)、 禁止访问/html/目录下的所有以”.php”为后缀的URL(包含子目录)
robots.txt写法如下:
User-agent: *
Disallow: /html/*.php
6)、 仅允许访问某目录下某个后缀的文件,则使用“$”
robots.txt写法如下:
User-agent: *
Allow: .html$
Disallow: /
7)、禁止索引网站中所有的动态页面
比如这里限制的是有“?”的域名,例如index.php?id=1
robots.txt写法如下:
User-agent: *
Disallow: /*?*
8)、 禁止搜索引擎抓取我们网站上的所有图片(如果你的网站使用其他后缀的图片名称,在这里也可以直接添加)
有些时候,我们为了节省服务器资源,需要禁止各类搜索引擎来索引我们网站上的图片,这里的办法除了使用“Disallow: /images/”这样的直接屏蔽文件夹的方式之外,还 可以采取直接屏蔽图片后缀名的方式。
robots.txt写法如下:
User-agent: *
Disallow: .jpg$
Disallow: .jpeg$
Disallow: .gif$
Disallow: .png$
Disallow: .bmp$
三、写robots.txt要注意的地方:
1)、 英文要大写,冒号是英文状态下,冒号后面有一个空格,这几点一定不能写错。
2.)、斜杠:/ 代表整个网站
3)、如果“/”后面多了一个空格,则屏蔽整个网站
4)、不要禁止正常的内容
5)、生效时间是几天到两个月
四、robots.txt文件对网站优化有什么作用?
1、疾速增加网站权重和拜访量;
2、制止某些文件被查找引擎索引,能够节约服务器带宽和网站拜访速度;
3、为查找引擎供给一个简洁明了的索引环境
五、哪些网站的目录需求运用robots.txt文件制止抓取?
1)、图像目录
图像是构成网站的首要组成元素。跟着现在建站越来越便利,许多cms的呈现,真实做到了会打字就会建网站,而正是由于如此便利,网上呈现了许多的同质化模板网站,被重复运用,这样的网站查找引擎是必定不喜爱的,就算是你的网站被录入了,那你的作用也是很差的。若是你非要用这种网站的话,主张你大概在robots.txt文件中进行屏蔽,一般的网站图像目录是:imags 或许 img;
2)、网站模板目录
cms的强大和灵敏,也致使了许多同质化的网站模板的呈现和乱用,高度的重复性模板在查找引擎中形成了一种冗余,且模板文件常常与生成文件高度类似,相同易形成相同内容的呈现。对查找引擎很不友爱,严峻的直接被查找引擎打入冷宫,不得翻身,许多cms有具有独立的模板寄存目录,因而,大概进行模板目录的屏蔽。一般模板目录的文件目录是:templets
3)、css、js目录的屏蔽
- 上一篇:天富电脑版登录_SEO优化:面对Flash网站,你的优
- 下一篇:没有了
猜你喜欢
- 2021-02-27 03:58:34 凤凰二号站官网_学习SEO优化新手应该准备哪些东
- 2020-08-28 10:12:29 二号站平台主管_网站栏目的优化方案
- 2020-07-22 05:02:44 二号站平台主管_十大引爆网站流量的文章标题写
- 2020-07-06 05:02:59 二号站登录网址_外链对SEO没效果其实只是你的方
- 2020-06-05 05:06:18 天富苹果手机版_seo运营是什么意思?
- 2号站主管Q:2347-660
-
- 05-29天富官网登录_Robots.txt协议的写法及屏蔽文件的写
- 05-29欧亿代理招商_企业可以通过网络推广带来利润吗
- 05-28二号站苹果手机版下载_SEO优化中哪些原因会造成
- 05-28二号站app客户端_通过搜索引擎效益准则为企业创
- 05-28天富电脑版登录_SEO优化:面对Flash网站,你的优
- 05-28二号站帐号注册_网站优化问题:链接位置和目录
- 05-26二号站域名验证测速_网站首页被k主要是哪些原因
- 05-26二号站平台注册_SEO在工作过程中遇到的效果问题
- 05-26天富怎么注册_SEOer是如何在搜索引擎中来获取自
- 05-26天富官网注册_SEO优化中选择关键词需要注意什么
- 05-29天富官网登录_Robots.txt协议的写法及屏蔽文件的写
- 05-29欧亿代理招商_企业可以通过网络推广带来利润吗
- 05-28二号站苹果手机版下载_SEO优化中哪些原因会造成
- 05-28二号站app客户端_通过搜索引擎效益准则为企业创
- 05-28天富电脑版登录_SEO优化:面对Flash网站,你的优
- 05-28二号站帐号注册_网站优化问题:链接位置和目录
- 05-26二号站域名验证测速_网站首页被k主要是哪些原因
- 05-26二号站平台注册_SEO在工作过程中遇到的效果问题
- 05-26天富怎么注册_SEOer是如何在搜索引擎中来获取自
- 05-26天富官网注册_SEO优化中选择关键词需要注意什么