当前位置:首页关于如何设置robots.txt文件浅谈 举报文章

关于如何设置robots.txt文件浅谈

作者:admin    来源:用户投稿    时间:2015.11.20   

  一个合格的网站,有必要在根目录下包括一下robots.txt文件,这个文件的效果对悉数运营网站的朋友来说并不陌生,网上也供应了很多制作 robots.txt文件的方法和软件,可谓恰当便当。可是,你真的知道网站的robots.txt文件设置是不是合理,哪些文件或许目录需要屏蔽、哪些设 置方法对网站运营有利益?

  那下面带着这些疑问,笔者会进行具体的答复,希望对菜鸟站长朋友们有所帮忙,老鸟勿喷。

  一、啥是robots.txt

  笔者引证baidu站长东西中后段话来阐明。查找引擎运用spider程序自动访问互联网上的页面并获取页面信息。spider在访问一个网站时,会首先会 查看该网站的根域下是不是有一个叫做 robots.txt的纯文本文件,这个文件用于指定spider在您网站上的抓取计划。您可以在您的网站中创立一个robots.txt,在文件中声明 该网站中不想被查找引擎录入的有些或许指定查找引擎只录入特定的有些。

  二、robots.txt文件对网站有啥利益

  1、快速添加网站权重和访问量;

  2、阻遏某些文件被查找引擎索引,可以节省服务器带宽和网站访问速度;

  3、为查找引擎供应一个简洁明了的索引环境

  三、哪些网站的目录需要运用robots.txt文件阻遏抓取

  1)、图画目录

  图画是构成网站的首要构成元素。跟着现在搭站越来越便当,很多CMS的出现,真实做到了会打字就会建网站,而恰是因为如此便当,网上出现了很多的同质 化模板网站,被重复运用,这么的网站查找引擎是一定不喜爱的,就算是你的网站被录入了,那你的效果也是很差的。假定你非要用这种网站的话,建议你应当在 robots.txt文件中进行屏蔽,通常的网站图画目录是:imags 或许 img;

  2)、网站模板目录

  如上面 图画目录 中所说,CMS的强大和活络,也致使了很多同质化的网站模板的出现和乱用,高度的重复性模板在查找引擎中构成了一种冗余,且模板文件常常与生成文件高度相 似,一样易构成一样内容的出现。对查找引擎很不友善,严峻的直接被查找引擎打入冷宫,不得翻身,很多CMS有具有独立的模板存放目录,因而,应当进行模板 目录的屏蔽。通常模板目录的文件目录是:templets

  3)、CSS、JS目录的屏蔽

  CSS目录文件在查找引擎的抓取中没有用处,也无法供应有价值的信息。所以剧烈建议站长朋友们在Robots.txt文件中将其进行屏蔽,以跋涉查找 引擎的索引质量。为查找引擎供应一个简洁明了的索引环境更易行进网站友善性。CSS样式的目录通常情况下是:CSS 或许 style

  JS文件在查找引擎中无法进行辨认,这儿只是建议,可以对其进行屏蔽,这么做也有一个利益:为查找引擎供应一个简洁明了的索引环境;

  4)、屏蔽双页面的内容

  这儿拿DEDECMS来举例吧。咱们都知道DEDECMS可以运用静态和动态URL进行同一篇内容的访问,假定你生成全站静态了,那你有必要屏蔽动态地 址的URL衔接。这儿有两个利益:1、查找引擎对静态的URL比动态的URL更友善、更简略录入;2、避免静态、动态URL能访问同一篇文章而被查找引擎 判为重复内容。这么做对查找引擎友善性来说是有益无害的。

  5)、模板缓存目录

  很多CMS程序都有缓存目录,这种缓存目录的利益我想不用说咱们也了解了吧,可以十分有用的行进网站的访问速度,减少网站带宽,对用户体会也是极好 的。不过,这么的缓存目录也有一定的缺点,那就是会让查找引擎进行重复的抓取,一个网站中内容重复也是大祭,对网站百害而无一利。很多运用CMS搭站的朋 友都没有留心到,有必要要致使注重。

  6)被删去的目录

  死链过多,对查找引擎优化来说,是丧身的。不能不致使站长的高度注重,。在网站的打开过程中,目录的删去和调整是不行避免的,假定你的网站其时目录不 存在了,那有必要对此目录进行robots屏蔽,并回来精确的404过错页面(留心:在IIS中,有的朋友在设置404过错的时分,设置存在疑问,在自定义 过错页面一项中,404过错的精确设置应当是挑选:默认值 或许 文件,而不应该是:URL,以避免查找引擎回来200的状况码。至于怎么设置,网上教程很多,咱们要吧查找一下)

  这儿有一个争议性的疑问,关于网站后台处理目录是不是需要进行屏蔽,正本这个可有可无。在能确保网站安全的情况下,假定你的网站运营计划较小,就算网站 处理目录出现在robots.txt文件中,也没有多大疑问,这个我也见过很多网站这么设置的;但假定你的网站运营计划较大,竞争夺手过多,剧烈建议千 别出现任何你网站后台处理目录的信息,以防被存心不良的人运用,损害你的利益;正本查找引擎越来越智能,关于网站的处理目录仍是能极好的辨认,并扔掉索引 的。其他,咱们在做网站后台的时分,也可以在页面元标签中添加:进行查找引擎的屏蔽抓取。

  究竟,需要阐明一点,很多站长朋友喜爱把站点地图地址放在robots.txt文件中,当然这儿并不是去屏蔽查找引擎,而是让查找引擎在初度索引网 站的时分便能通过站点地图快速的抓取网站内容。这儿需要留心一下:1、站点地图的制作一定要规范;2、网站一定要有高质量的内容。

  本文来自-资产之家www.zichanzhijia.com

好文打赏,给Ta鼓励
扫一扫用手机阅读本文
Tags:关于  如何  设置  文件  浅谈  
  • 相关搜索
图片推荐
    赚钱很难又辛苦,那是因为你不了解网络兼职

    赚钱很难又辛苦,那是因为你不了解网络兼职

    很多人都会觉得赚钱很难,工作不仅辛苦,而且到手的工资还不多。每天早晚挤公交车,在办公室里又是每天做着同样的工作,单调而又枯燥,工作很难提起激情。如果你也觉得赚钱很难又辛苦,那是因为你不了解网络兼职。网
    中小企业建站需求旺盛,微企点打造完美建站体验

    中小企业建站需求旺盛,微企点打造完美建站体验

    创业团队经常遇到的三个场景:1、你说你有一款令人尖叫的产品,却给用户看了一个粗糙丑陋的网站,然后,就没有然后了。2、你说你有一个令人拍案的创业计划,却给投资人看一个粗糙丑陋的网站,然后,就没有然后了。
    网站优化细节之标题和正文的匹配度

    网站优化细节之标题和正文的匹配度

    之前我们分析了新的SEO时代在网站标题上的优化思路,主要从满足搜索该关键词用户的需求和增加吸引用户的创新点这两方面强调的,下面我们应该做的就是标题和内容的一个匹配度的环节,这一环节是在我们网站标题优化
    不用SEO一样有流量

    不用SEO一样有流量

    本文最主要不是方法。是思维和变通!  为什么要写这个呢!其实现在觉得大家把SEO看太重了,却忽视SEO之所以存在的意义!就是为流量! 我做站时候,那时候SEO还不是很流行,可是那时候的我一天自己引流,
    京东7年融资20多亿美元,刘强东是怎样做到的?

    京东7年融资20多亿美元,刘强东是怎样做到的?

    从零售做起的刘强东,深信规模效益。在很长一段时间里,他宁愿用亏本来换取更多的品类、更快的物流以及更大的规模。从成立以来,京东均以远超于行业平均增速的水平高速发展。尤其是在2007年到2010年,京东每
    百度站长平台:大型网站到了需要做改变的时候

    百度站长平台:大型网站到了需要做改变的时候

    外出参会交流、与站长朋友沟通,到最后总是成为接受吐槽的垃圾桶,无非就是大搜索的流量越来越没的搞、seo干不下去了,我该回家种地了......难道SEO除了优化网站结构、梳理TDK、研究百度算法就没有其
    56小时破千万 网易味央养猪众筹为何如此轰动?

    56小时破千万 网易味央养猪众筹为何如此轰动?

    网易众筹养猪之所以能够获得如此高的关注度,并且获得火爆认筹,这一方面是网易品牌良好口碑的反应,另一方面是网易黑猪肉迎合了当下消费者对高品质农产品的刚性需求。  文|李东楼  最近,有关网易养猪的消息再
    对号入座,SEO最容易陷入的6大误区

    对号入座,SEO最容易陷入的6大误区

    很多对SEO不了解或者刚入行的一些新人,对SEO的认知或多或少都存在一些误区。如果不能正确的认识SEO,就很难做好SEO工作,容易让人陷于一种迷茫无助的状态。今天我总结了SEO最容易陷入的6大误区,只
你是怎么知道非凡网赚网的?
  •   
  • 联系QQ 邮箱:976382653@qq.com 微信:976382653
    在线留言
    发布软文
    广告自助购
    文章调用
    常见问题
    保存到桌面