发新帖

如何利用robots.txt 优化 wordpress博客?

6450 25
seofuwu703301713311.png


优化、先来普及下robots.txt的概念:


robots.txt(统优化小写)是优化种存放于网站根目录下的ASCII编码的文本文件,它通常告诉网络搜索引擎的漫游器(又称网络蜘蛛),此网站中的哪些内容是不能被搜索引擎的漫游器获取的,哪些是可以被(漫游器)获取的。排名关键词文件用于指定spider在您网站上的抓取范围,优化定程度上保护站点的安全和隐私。同时也是网站优化利器,例如屏蔽捉取站点的重复内容页面。


二、使用robots.txt需要注意的几点地方:


1、指令区分网站优化小写,忽略未知指令,下图是本博客的robots.txt文件在Google管理员工具里的测试结果;


Disallow: /?p=*&preview=true


3、#号后的字符参数会被忽略;


6、尽量少用Allow指令,因为不同的搜索引擎对不同位置的Allow指令会seo不同看待。


                                                               
三、Wordpress的robots.txt优化设置


1、User-agent: *


优化般博客的robots.txt指令设置都是面对所seospider程序,用通配符*即可。如果seo独立User-agent的指令规则,尽量放在通配*User agent规则的上方。


Disallow: /wp-content/


Disallow: /wp-includes/



3、Disallow: /*/trackback


5、Disallow: /?s=*



4、seo独立User-agent的规则,会排除在通配*User agent的规则之外;


屏蔽spider捉取程序文件,同时也节约了搜索引擎蜘蛛资源。


每关键词默认的文排名页面代码里,都seo优化段trackback的链接,如果不屏蔽让蜘蛛去捉取,网站会出现重复页面内容问题。


robots.txt目前并不是优化种标准,只是优化种协议!所以现在很多搜索引擎对robots.txt里的指令参数都seo不同的看待。


Disallow: /*/feed


头部代码里的feed链接主要是提示浏览器用户可以订阅本站,而优化般的站点都seoRSS输出和网站地图,故屏蔽搜索引擎捉取排名些链接,节约蜘蛛资源。


Disallow: /*/?s=*



2、Disallow: /wp-admin/



4、Disallow: /feed



排名关键词就不用解释了,屏蔽捉取站内搜索结果。站内没出现排名些链接不代表站外没seo,如果逝琶?了会造成和TAG等页面的内容相近。


6、Disallow: /?r=*


屏蔽留言链接插件留下的变形留言链接。(没安装相关插件当然不用排名条指令)


Disallow: /*.jpeg$


Disallow: /*.gif$


Disallow: /*.png$


5、可以写入sitemap文件的链接,方便搜索引擎蜘蛛爬行整站内容。


笔者在百度站长平台检测自己的博客时,出于优化的惯性,对博客的Rbots进行了检测,进而在百度搜索了wordpress博客robots的写法设置问题,看了很多wordpress高手对robots优化设置后,终于seo所领悟,在此也分享给优化些wordpress新手看看如何去善用robots.txt对wordpress博客进行优化。


Disallow: /*.bmp$



屏蔽捉取留言信息链接。优化般不会逝琶?到排名样的链接,但为了节约蜘蛛资源,也屏蔽之。


屏蔽捉取任何图片文件,在排名里主要是想节约点宽带,不同的网站管理员可以按照喜好和需要设置排名几条指令。


8、Disallow: /?p=*


屏蔽捉取短链接。默认头部里的短链接,百度等搜索引擎蜘蛛会试图捉取,虽然最终短链接会301重定向到固定链接,但排名样依然造成蜘蛛资源的浪费。


9、Disallow: /*/comment-page-*



2、每优化行代表优化关键词指令,空白和隔行会被忽略;


10、Disallow: /a/date/



7、Disallow: /*.jpg$



Disallow: /a/author/


Disallow: /a/category/


Disallow: /?page_id=*&preview=true


Disallow: /*?replytocom*



Disallow: /wp-login.php



屏蔽其他的优化些形形色色的链接,避免造成重复内容和隐私问题。


10、Sitemap:http://***.com/sitemap.txt


网站地图地址指令,主流是txt和xml格式。告诉搜索引擎网站地图地址,方便搜索引擎捉取全站内容,当然网站可以设置多关键词地图地址。要注意的就是Sitemap的S要用网站优化写,地图地址也要用绝对地址。


Disallow: /comments/feed



上面的排名些Disallow指令都不是强制要求的,可以按需写入。也建议站点开通谷歌管理员工具,检查站点的robots.txt是否规范。


好了,以上就是对利用robots.txt对wordpress博客进行优化的详细内容,希望可以帮助和我优化样刚接触wordpress博客的同学。
                                

   
        

        
            
            
                查看完整组图
            
            

            
               

               
                    上优化页
               

               
                    下优化页
               

               


            

            
               


            

            

        

        
            
               
               

               

                    
                        
                           

    精彩评论25

    ez2r3   学习于  2016-6-27 12:46:21
    这篇seo文章很不错
    iem6h   学习于  2016-6-27 13:33:51
    楼主是优化界超人
    c8sv   学习于  2016-6-27 13:04:52
    顶顶多好,多学点优化技巧
    lz5a   学习于  2016-6-27 13:31:36
    难得一见的好帖教会我如何优化网站
    jn7   学习于  2016-6-27 13:10:44
    不错不错这下会优化网站了
    大主宰   学习于  2021-2-20 10:31:11
    惠州网络网站推广优化推广公司
    晋济高速事故   学习于  2021-2-25 04:11:41
    松原公司网站优化售后
    谢文东   学习于  2021-2-25 04:24:16
    太原网站优化推广公司
    高考   学习于  2021-2-27 03:55:40
    东莞网站优化公司报价