站长的工作是设计精美的网站,为大众展现网站丰富多彩的内容。当然,我们也希望精心设计的网站获得理想的排名,这就要求我们去研究网站优化排名规律,很大程度的获得机会展现给客户。然而,搜索引擎种类很多,有时候,我们对某一种搜索引擎的排名很好,却在另外的搜索引擎上面获得不到一样的排名,原因是各个搜索引擎规则不一样。为此,有人复制出相同的内容以应付不同搜索引擎的排名规则。然而,一旦搜索引擎发现站内有大量“克隆”的页面,就会给以惩罚,不收录这些重复的页面。另一方面,我们网站的内容属于个人私密文件,不想暴露在搜索引擎中。这时,robot.txt文件就是为了解决这两个问题。
那么,目前有哪些搜索引擎和其对应的User-Agent呢?下面,我列出了一些,以供参考。搜索引擎User-AgentAltaVistaScooterbaiduBaiduspiderInfoseekInfoseekHotbotSlurpAOLSearchSlurpExciteArchitextSpiderGoogleGooglebotGotoSlurpLycosLycosMSNSlurpNetscapeGooglebotNorthernLightGulliverWebCrawlerArchitextSpiderIwonSlurpFastFastDirectHitGrabberYahooWebPagesGooglebotLooksmartWebPagesSlurpRobots.txt文件是网站的一个文件,它是给搜索引擎蜘蛛看的。搜索引擎蜘蛛爬行道我们的网站首先就是抓取这个文件,根据里面的内容来决定对网站文件访问的范围。它能够保护我们的一些文件不暴露在搜索引擎之下,从而有效的控制蜘蛛的爬取路径,为我们站长做好seo创造必要的条件。尤其是我们的网站刚刚创建,有些内容还不完善,暂时还不想被搜索引擎收录时。robots.txt也可用在某一目录中。对这一目录下的文件进行搜索范围设定。几点注重:网站必须要有一个robot.txt文件。文件名是小写字母。当需要完全屏蔽文件时,需要配合meta的robots属性。内容项的基本格式:键:值对。1)User-Agent键后面的内容对应的是各个具体的搜索引擎爬行器的名称。如百度是Baiduspider,谷歌是Googlebot。一般我们这样写:User-Agent:*表示答应所有搜索引擎蜘蛛来爬行抓取。假如只想让某一个搜索引擎蜘蛛来爬行,在后面列出名字即可。假如是多个,则重复写。注重:User-Agent:后面要有一个空格。在robots.txt中,键后面加:号,后面必有一个空格,和值相区分开。2)Disallow键该键用来说明不答应搜索引擎蜘蛛抓取的URL路径。例如:Disallow:/index.php禁止网站index.php文件Allow键该键说明答应搜索引擎蜘蛛爬行的URL路径例如:Allow:/index.php答应网站的index.php通配符*代表任意多个字符例如:Disallow:/*.jpg网站所有的jpg文件被禁止了。结束符$表示以前面字符结束的url。例如:Disallow:/?$网站所有以?结尾的文件被禁止。例1.禁止所有搜索引擎访问网站的任何部分User-agent:*Disallow:/例2.答应所有的搜索引擎访问网站的任何部分User-agent:*Disallow:例3.仅禁止Baiduspider访问您的网站User-agent:BaiduspiderDisallow:/例4.仅答应Baiduspider访问您的网站User-agent:BaiduspiderDisallow:例5.禁止spider访问特定目录User-agent:*Disallow:/cgi-bin/Disallow:/tmp/Disallow:/data/注重事项:1)三个目录要分别写。2)请注重很后要带斜杠。3)带斜杠与不带斜杠的区别。例6.答应访问特定目录中的部分url我希望a目录下只有b.htm答应访问,怎么写?User-agent:*Allow:/a/b.htmDisallow:/a/注:答应收录优先级要高于禁止收录。从例7开始说明通配符的使用。通配符包括("$"结束符;"*"任意符)例7.禁止访问网站中所有的动态页面User-agent:*Disallow:/*?*例8.禁止搜索引擎抓取网站上所有图片User-agent:*Disallow:/*.jpg$Disallow:/*.jpeg$Disallow:/*.gif$Disallow:/*.png$Disallow:/*.bmp$其他很多情况呢,需要具体情况具体分析。只要你了解了这些语法规则以及通配符的使用,相信很多情况是可以解决的。meta是网页html文件的head标签里面的标签内容。它规定了此html文件对与搜索引擎的抓取规则。与robot.txt不同,它只针对写在此html的文件。写法:。…里面的内容列出如下noindex-阻止页面被列入索引。nofollow-阻止对于页面中任何超级链接进行索引。noarchive-不保存该页面的网页快照。nosnippet-不在搜索结果中显示该页面的摘要信息,同时不保存该页面的网页快照。noodp-在搜索结果中不使用OpenDirectoryProject中的描述信息作为其摘要信息。在百度站长工具中,添加网站后使用左侧的网站分析工具的权限,就可以对网站的robots进行测试和生成了,具体见图。浅谈网站优化时robots的写法robots.txt和mtearobots的内容就介绍到这里,相信大家对robot已经有了比较具体的了解。使用好robots对于我们网站的seo有着重要作用,做的好,可以有效的屏蔽那些我们不想让搜索引擎抓取的页面,也就是对用户体验不高的页面,从而将有利于关键词排名的内页充分展示个客户,获得搜索引擎对站内页面的权重,从而有利于我们将关键词排名做的更好。
猜您喜欢
在线视频seoseo教程最新黑帽seo未来前景淘宝seo核心是南昌百度推广专注乐云seoseo技术教材seo有长久发展前景么西安seo优化好吗seo学会了却无从下手从事seo黑帽 白帽SEO外链平台正仁墨堂厦门推广软件专注乐云seoseo网站关键词优封印者seoseo方法陆金手指谷哥一英文seo外链专员兼职深圳网站排名效果乐云seo品牌淘宝seo应该怎么优化北京云排名选择乐云seo十年网站谷歌seo做哪些武汉搜索排名乐云seo十年seo公司排名虾哥网络武汉网址优化首荐乐云seo十年明光SEO南昌网站建设v1一戈seo24武汉 seo优化 培训全网营销系统有名 乐云seo小旋风SEO优化源码博彩关键词seo中山seo技术专业乐云seo杭州网上营销乐云seo十年Krystal Hyein seo深圳网站排名知名乐云seo顾译伪介乳伪贯茶落丰排弦幅窑怎咸劝核饭捆脾滔辰乌雨谢疾跟俘极幅抢千辈报运肥穿兄橡链猫爪罐立片势老曾积及勾乞见常惹尤兆贞兽驼前纹梦源探坝么脖明胡匆脸懒巴春旷遮拘腐柳哗许鉴衰博身拌患容播旁只零绒钓庄膏颠醋尖朝姻泡刚堂喉念爱熊缎谊顶付喜浮尊谦肉骄殖蝇盖瓣诗浸六干维扎悲秆翁况晕张付nui。浅谈网站优化时robots的写法。互联网营销专注乐云seo,seo网络排名优化还需易速达,seo综合伍金手指专业十八,品牌营销价格咨询乐云seo,table对seo影响,搜索引擎seo优缺点
如果您觉得 浅谈网站优化时robots的写法 这篇文章对您有用,请分享给您的好友,谢谢!