[织梦吧]唯一域名：www.dedecms8.com，织梦DedeCMS学习平台.

当前位置: > 站长学院 > 站长百科 >

如何利用robots.txt 优化 wordpress博客？

来源: www.dedecms8.com 编辑:织梦吧时间:2016-02-19点击: 次

Wordpress优化 Wordpress主题 Wordpress教程 Wordpress博客优化

笔者在百度站长平台检测自己的博客时，出于优化的惯性，对博客的Rbots进行了检测，进而在百度搜索了wordpress博客robots的写法设置问题，看了很多wordpress高手对robots优化设置后，终于有所领悟，在此也分享给一些wordpress新手看看如何去善用robots.txt对wordpress博客进行优化。

一、先来普及下robots.txt的概念：

robots.txt(统一小写)是一种存放于网站根目录下的ASCII编码的文本文件，它通常告诉网络搜索引擎的漫游器(又称网络蜘蛛)，此网站中的哪些内容是不能被搜索引擎的漫游器获取的，哪些是可以被(漫游器)获取的。这个文件用于指定spider在您网站上的抓取范围，一定程度上保护站点的安全和隐私。同时也是网站优化利器，例如屏蔽捉取站点的重复内容页面。

robots.txt目前并不是一种标准，只是一种协议!所以现在很多搜索引擎对robots.txt里的指令参数都有不同的看待。

二、使用robots.txt需要注意的几点地方：

1、指令区分大小写，忽略未知指令，下图是本博客的robots.txt文件在Google管理员工具里的测试结果;

2、每一行代表一个指令，空白和隔行会被忽略;

3、“#”号后的字符参数会被忽略;

4、有独立User-agent的规则，会排除在通配“*”User agent的规则之外;

5、可以写入sitemap文件的链接，方便搜索引擎蜘蛛爬行整站内容。

6、尽量少用Allow指令，因为不同的搜索引擎对不同位置的Allow指令会有不同看待。

三、Wordpress的robots.txt优化设置

1、User-agent： *

一般博客的robots.txt指令设置都是面对所有spider程序，用通配符“*”即可。如果有独立User-agent的指令规则，尽量放在通配“*”User agent规则的上方。

2、Disallow： /wp-admin/

Disallow： /wp-content/

Disallow： /wp-includes/

屏蔽spider捉取程序文件，同时也节约了搜索引擎蜘蛛资源。

3、Disallow： /*/trackback

每个默认的文章页面代码里，都有一段trackback的链接，如果不屏蔽让蜘蛛去捉取，网站会出现重复页面内容问题。

4、Disallow： /feed

Disallow： /*/feed

Disallow： /comments/feed

头部代码里的feed链接主要是提示浏览器用户可以订阅本站，而一般的站点都有RSS输出和网站地图，故屏蔽搜索引擎捉取这些链接，节约蜘蛛资源。

5、Disallow： /?s=*

Disallow： /*/?s=*

这个就不用解释了，屏蔽捉取站内搜索结果。站内没出现这些链接不代表站外没有，如果收录了会造成和TAG等页面的内容相近。

6、Disallow： /?r=*

屏蔽留言链接插件留下的变形留言链接。(没安装相关插件当然不用这条指令)

7、Disallow： /*.jpg$

Disallow： /*.jpeg$

Disallow： /*.gif$

Disallow： /*.png$

Disallow： /*.bmp$

屏蔽捉取任何图片文件，在这里主要是想节约点宽带，不同的网站管理员可以按照喜好和需要设置这几条指令。

8、Disallow： /?p=*

9、Disallow： /*/comment-page-*屏蔽捉取短链接。默认头部里的短链接，百度等搜索引擎蜘蛛会试图捉取，虽然最终短链接会301重定向到固定链接，但这样依然造成蜘蛛资源的浪费。

Disallow： /*?replytocom*

屏蔽捉取留言信息链接。一般不会收录到这样的链接，但为了节约蜘蛛资源，也屏蔽之。

10、Disallow： /a/date/

Disallow： /a/author/

Disallow： /a/category/

Disallow： /?p=*&preview=true

Disallow： /?page_id=*&preview=true

Disallow： /wp-login.php

屏蔽其他的一些形形色色的链接，避免造成重复内容和隐私问题。

10、Sitemap:http://***.com/sitemap.txt

网站地图地址指令，主流是txt和xml格式。告诉搜索引擎网站地图地址，方便搜索引擎捉取全站内容，当然你可以设置多个地图地址。要注意的就是Sitemap的S要用大写，地图地址也要用绝对地址。

上面的这些Disallow指令都不是强制要求的，可以按需写入。也建议站点开通谷歌管理员工具，检查站点的robots.txt是否规范。

好了，以上就是对利用robots.txt对wordpress博客进行优化的详细内容，希望可以帮助和我一样刚接触wordpress博客的同学。

标签:

猜您也喜欢...

· 网站建设不再难 - 2018年最好用的网站设计工具集锦由于代码技术的限制，普通大众往往在网站建设方面总是一站难求。....
· 子域名和子目录哪个更有利于SEO？前几天看到Barry Schwartz的一篇帖子，记录了SEO人员和Google内....
· 网易云的乐评列车又来啦！没有巨额广告投入，它的内容营销是怎么网易云的地铁广告又来了，赶在新年前，他们在北京的团结湖地铁....
· 告别2017：丧文化毒鸡汤之后暖心营销更能触动我们的心弦 2017 年，最后几天，尚在寒冬。编辑生活在北京，并不像外界以为....
· 新鲜出炉！2018年的用户体验设计趋势（上） Z Yuhan：这是由一位美国作者站在美国的视角写的文章，即便抛开....

栏目导航 更多>>: 互联网; 推广营销; 站长教程; 免费域名; 免费主机; 站长百科; 网赚技巧; 音视频开发

猜你也喜欢看这些...

热门TagS

织梦CMS

织梦下载织梦模板织梦教程织梦标签织梦手册织梦安全织梦视频织梦论坛

CMS

下载

站长下载手机ROM 网页模板好站推荐

教程资源

About D8

©2014 织梦吧(d8) DedeCMS学习交流平台
唯一网址 www.DedeCMS8.com 网站地图
联系我们 1978130638@qq.com ,