当前位置:首页robots.txt文件中应该屏蔽哪些目录 举报文章

robots.txt文件中应该屏蔽哪些目录

作者:admin    来源:用户投稿    时间:2015.6.11   

  一个合格的网站,必须在根目录下包含一下robots.txt文件,这个文件的作用对所有运营网站的朋友来说并不陌生,网上也提供了很多制作robots.txt文件的方法和软件,可谓相当方便。但是,你真的知道网站的robots.txt文件设置是否合理,哪些文件或者目录需要屏蔽、哪些设置方法对网站运营有好处?

  那下面带着这些疑问,笔者会进行详细的解答,希望对新手站长朋友们有所帮助,老鸟勿喷。

  一、什么是robots.txt

  笔者引用百度站长工具中后段话来解释。搜索引擎使用spider程序自动访问互联网上的网页并获取网页信息。spider在访问一个网站时,会首先会检查该网站的根域下是否有一个叫做 robots.txt的纯文本文件,这个文件用于指定spider在您网站上的抓取范围。您可以在您的网站中创建一个robots.txt,在文件中声明 该网站中不想被搜索引擎收录的部分或者指定搜索引擎只收录特定的部分。

  二、robots.txt文件对网站有什么好处

  1、快速增加网站权重和访问量;

  2、禁止某些文件被搜索引擎索引,可以节省服务器带宽和网站访问速度;

  3、为搜索引擎提供一个简洁明了的索引环境

  三、哪些网站的目录需要使用robots.txt文件禁止抓取

  1)、图片目录

  图片是构成网站的主要组成元素。随着现在建站越来越方便,大量CMS的出现,真正做到了会打字就会建网站,而正是因为如此方便,网上出现了大量的同质化模板网站,被反复使用,这样的网站搜索引擎是肯定不喜欢的,就算是你的网站被收录了,那你的效果也是很差的。如果你非要用这种网站的话,建议你应该在robots.txt文件中进行屏蔽,通常的网站图片目录是:imags 或者 img;

  2)、网站模板目录

  如上面 图片目录 中所说,CMS的强大和灵活,也导致了很多同质化的网站模板的出现和滥用,高度的重复性模板在搜索引擎中形成了一种冗余,且模板文件常常与生成文件高度相似,同样易造成雷同内容的出现。对搜索引擎很不友好,严重的直接被搜索引擎打入冷宫,不得翻身,很多CMS有拥有独立的模板存放目录,因此,应该进行模板目录的屏蔽。通常模板目录的文件目录是:templets

  3)、CSS、JS目录的屏蔽

  CSS目录文件在搜索引擎的抓取中没有用处,也无法提供有价值的信息。所以强烈建议站长朋友们在Robots.txt文件中将其进行屏蔽,以提高搜索引擎的索引质量。为搜索引擎提供一个简洁明了的索引环境更易提升网站友好性。CSS样式的目录通常情况下是:CSS 或者 style

  JS文件在搜索引擎中无法进行识别,这里只是建议,可以对其进行屏蔽,这样做也有一个好处:为搜索引擎提供一个简洁明了的索引环境;

  4)、屏蔽双页面的内容

  这里拿DEDECMS来举例吧。大家都知道DEDECMS可以使用静态和动态URL进行同一篇内容的访问,如果你生成全站静态了,那你必须屏蔽动态地址的URL链接。这里有两个好处:1、搜索引擎对静态的URL比动态的URL更友好、更容易收录;2、防止静态、动态URL能访问同一篇文章而被搜索引擎判为重复内容。这样做对搜索引擎友好性来说是有益无害的。

  5)、模板缓存目录

  很多CMS程序都有缓存目录,这种缓存目录的好处我想不用说大家也清楚了吧,可以非常有效的提升网站的访问速度,减少网站带宽,对用户体验也是很好的。不过,这样的缓存目录也有一定的缺点,那就是会让搜索引擎进行重复的抓取,一个网站中内容重复也是大祭,对网站百害而无一利。很多使用CMS建站的朋友都没有注意到,必须要引起重视。

  6)被删除的目录

  死链过多,对搜索引擎优化来说,是致命的。不能不引起站长的高度重视,。在网站的发展过程中,目录的删除和调整是不可避免的,如果你的网站当前目录不存在了,那必须对此目录进行robots屏蔽,并返回正确的404错误页面(注意:在IIS中,有的朋友在设置404错误的时候,设置存在问题,在自定义错误页面一项中,404错误的正确设置应该是选择:默认值 或者 文件,而不应该是:URL,以防止搜索引擎返回200的状态码。至于怎么设置,网上教程很多,大家要吧搜索一下)

  这里有一个争议性的问题,关于网站后台管理目录是否需要进行屏蔽,其实这个可有可无。在能保证网站安全的情况下,如果你的网站运营规模较小,就算网站管理目录出现在robots.txt文件中,也没有多大问题,这个我也见过很多网站这样设置的;但如果你的网站运营规模较大,竞争夺手过多,强烈建议千别出现任何你网站后台管理目录的信息,以防被别有用心的人利用,损害你的利益;其实搜索引擎越来越智能,对于网站的管理目录还是能很好的识别,并放弃索引的。另外,大家在做网站后台的时候,也可以在页面元标签中添加:进行搜索引擎的屏蔽抓取。

  最后,需要说明一点,很多站长朋友喜欢把站点地图地址放在robots.txt文件中,当然这里并不是去屏蔽搜索引擎,而是让搜索引擎在第一次索引网站的时候便能通过站点地图快速的抓取网站内容。这里需要注意一下:1、站点地图的制作一定要规范;2、网站一定要有高质量的内容;

  转载时注明:绿壳鸡蛋 http://www.zangji.com 原创发布。

好文打赏,给Ta鼓励
扫一扫用手机阅读本文
Tags:文件  应该  屏蔽  哪些  目录  
  • 相关搜索
图片推荐
    胡润品牌榜200强:淘宝超工行排第二 搜狐落榜

    胡润品牌榜200强:淘宝超工行排第二 搜狐落榜

    2015最具价值中国品牌10强  【TechWeb报道】9月18日消息,胡润研究院发布了《2015胡润品牌榜》报告,公布了200个最具价值中国品牌,其中非国有品牌101个,国有品牌99个,榜单显示腾讯
    开淘宝店教程,谈谈我大学三年的淘宝开店生涯

    开淘宝店教程,谈谈我大学三年的淘宝开店生涯

    我是一名即将要毕业的大四学生,如今的我,开着自己的一家淘宝店,出售各种头花、发夹一类的小饰品,同学们都在忙着找工作,我却独自享受着惬意的生活,根本就不想找工作,开个小店,自己当老板,感觉很好!当然,说
    还原当年创业:创业的数学分析

    还原当年创业:创业的数学分析

    创业者成功是小概率事件,想赚大钱很难;而对风投和媒体来说,成功是大概率事件,只是不知发生在谁身上而已,所以立场不一样。很多情况混沌而不可预测。那为什么要创业?如何将小概率事件变成大概率事件?这是每个想
    淘宝搜索优化之淘宝上下架是什么意思

    淘宝搜索优化之淘宝上下架是什么意思

    淘宝SEO搜索引擎优化相对于百度SEO来说是简单一点,但也是要付出一定的时间和精力才能完成。当然啦,如果有了优化方法和技巧,可以使优化效率大大提高。宝贝上下架的优化就是淘宝SEO优化的重要组成部分之一
    揭露一种新的借淘宝帐号购物骗术

    揭露一种新的借淘宝帐号购物骗术

    在网络上骗子真的多的让人痛恨,骗子的手法也是各式各样让人防不胜防呀。本来这个骗人的方法我只是在QQ空间发布了一下,也没打算写一篇文章。不过,我发现好多人也遇到这种骗术,我打算把详细的过程写下来,希望大
    网信办监管VPN翻墙工具,传授翻墙方法也系违法

    网信办监管VPN翻墙工具,传授翻墙方法也系违法

    翻墙行为是不被允许的,事实上也跟工信部监管是对立的,但调查结果却是国内拥有一批私下接触VPN的庞大用户群体,让游走于灰色地带的翻墙软件有利可图。翻墙(VPN)软件一直也是备受打击,枪打出头鸟还是能见到
    10个数据力证:移动营销值得投入

    10个数据力证:移动营销值得投入

    导语:移动广告投入的持续增长、消费者对移动应用的使用习惯、移动端优惠券使用量增长等等都在说明:你值得在移动营销上投入更多预算。  很多的市场营销人员都有过类似的经历,他们必须要向高层的管理层们做报告,
    石材行业站推广经验 了解行业背景做好实质内容

    石材行业站推广经验 了解行业背景做好实质内容

    首先了解行业背景是必须的。我们的网站中国石材网络商城对应的行业是石材。中国是世界石材工业大国。中国石材的生产主要分布在南部的福建省、广东省,东部的山东省三个石材生产大省,其中福建与山东为原料与加工生产
你是怎么知道非凡网赚网的?
  •   
  • 联系QQ 邮箱:976382653@qq.com 微信:976382653
    在线留言
    发布软文
    广告自助购
    文章调用
    常见问题
    保存到桌面