网站主要状态页细解以及与搜索引擎的关系（3）

作者：张栋伟来源：中国站长站时间：2008-12-02 09:55:00　

二、404号状态码

220.181.32.30 - - [02/Sep/2008:00:01:51 +0800] "GET /writing HTTP/1.1" 404 4459 "-" "Baiduspider+(+http://www.baidu.com/search/spider.htm)"

出现404状态码就证明有URL地址的网页浏览不到。很多时候由于网站的改版，使很多旧版网站url地址失效。这是你需要建立404状态页来保证你网站通畅，能够达到一种回路的效果。切记404状态页需要单独设计，不能直接在服务器端直接跳转回首页。否则，搜索引擎会大量抓取网站首页失误当成404页处理。

对HTTP404状态码的深度理解

HTTP 404 错误意味着链接指向的网页不存在，即原始网页的URL失效，这种情况经常会发生，很难避免，比如说：网页URL生成规则改变、网页文件更名或移动位置、导入链接拼写错误等，导致原来的URL地址无法访问;当Web 服务器接到类似请求时，会返回一个404 状态码，告诉浏览器要请求的资源并不存在。但是，Web服务器默认的404错误页面，无论Apache还是IIS，均十分简陋、呆板且对用户不友好，无法给用户提供必要的信息以获取更多线索，无疑这会造成用户的流失。

因此，很多网站均使用自定义404错误的方式以提供用户体验避免用户流失。一般而言，自定义404页面通用的做法是在页面中放置网站快速导航链接、搜索框以及网站提供的特色服务，这样可以有效的帮助用户访问站点并获取需要的信息。

HTTP404对SEO的影响

自定义404错误页面是提供用户体验的很好的做法，但在应用过程中往往并未注意到对搜索引擎的影响，譬如：错误的服务器端配置导致返回“200”状态码或自定义404错误页面使用Meta Refresh导致返回“302”状态码。正确设置的自定义404错误页面，不仅应当能够正确地显示，同时，应该返回“404”错误代码，而不是“200”或“302”。虽然对访问的用户而言，HTTP状态码究竟是“404”还是“200”来说并没有什么区别，但对搜索引擎而言，这则是相当重要的。

1.自定义404错误页返回“200”状态码

当搜索引擎蜘蛛在请求某个URL地址得到“404”状态回应时，即知道该URL地址已经失效，便不再索引该网页，并向数据中心反馈将该URL地址表示的网页从索引数据库中删除，当然，删除过程有可能需要很长时间;而当搜索引擎得到“200”状态回应时，则会认为该url地址是有效的，便会去索引，并会将其收录到索引数据库，这样的结果便是这两个不同的url地址具有完全相同的内容：自定义404错误页面的内容，这会导致出现复制网页问题。对搜索引擎而言，特别是Google，不但很难获得信任指数TrustRank，也会大大降低Google对网站质量的评定。

在使用Google Sitemap，当提交XML格式网站地图文件时，谷歌管理员工具会验证网站的身份以确保是网站合法的管理者。验证方式有两种：上传指定名称的html页到网站根目录或者在网页meta区域添加一个标识身份的meta标签。通常是使用上传html网页的方式，但谷歌管理员工具却提示网站根目录下找不到这个网页，这是一个很可怕的问题。

2.自定义404错误页使用Meta Refresh返回“302”状态码

常常看到许多网站的自定义404错误页面采取类似这样的形式：首先显示一段错误信息，然后，通过Meta Refresh将页面跳转到网站首页、网页地图或其他类似页。根据具体实现方式不同，这类404页面可能返回“200”状态码，也可能返回“302”，但不论哪种，从SEO技术角度看，均不是一种合适的选择。

对“200”状态的情况我们上面已经谈过，那么，当404页面返回“302”时，搜索引擎会怎么对待呢?从理论上说，对“302”错误，搜索引擎认为该网页是存在的，只不过临时改变了地址，仍然会索引收录该页，这样，同样会出现类似于“200”状态码时的重复文本问题;其次，以谷歌为代表的主流搜索引擎对302重定向的适用范围要求越来越严格，这类不当使用302重定向的情况存在很大的风险。

确保自定义404错误页面能够返回“404”状态码

在自定义404错误页面设置完毕后，一定要检查一下其是不是能够正确地返回“404”状态码。可以使用Server Header检查工具，输入一个不存在网页的url，查看一下HTTP Header的返回情况，确信其返回的是“404 Not found”。

第一页上一页 1 2

4 下一页

标签：

投稿

网站主要状态页细解以及与搜索引擎的关系（3）

猜你喜欢

Google Adsense 搜索联盟问答

Vmware Station安装Arch Linux的详细流程

提交新站到各大搜索引擎的页面地址

在Win 2003环境中设置一个Web服务器

轻松架设Windows 2003中Web服务器

转移国内域名到Godaddy时需要注意的

Google PR 更新、查询及做弊

在XP上管理Exchange 2007

做GGAD的请尝试把GB2312换成UTF-8试试

服务器数据意外丢失的正确处理方法

Google推出广告联盟新平台整合DoubleClick

《黄金国度》今日正式封测抢占网页游戏制高点

Discuz!财付通支付接口使用说明

没有技术，你也可以很优秀！—我的站长生涯

CentOS下命令行实现普通用户和root用户切换的实例

积极面对网站被搜索引擎降权

新功能加入腾讯QQ2009 SP5正式版下载

Linux系统上架设VSFTP服务器实例解析

知名游戏论坛网站遭DDoS攻击勒赎

我的建站奋斗史（吐血原创）

网站主要状态页细解以及与搜索引擎的关系（3）

猜你喜欢

Google Adsense 搜索联盟问答

Vmware Station安装Arch Linux的详细流程

提交新站到各大搜索引擎的页面地址

在Win 2003环境中设置一个Web服务器

轻松架设Windows 2003中Web服务器

转移国内域名到Godaddy时需要注意的

Google PR 更新、查询及做弊

在XP上管理Exchange 2007

做GGAD的请尝试把GB2312换成UTF-8试试

服务器数据意外丢失的正确处理方法

Google推出广告联盟新平台 整合DoubleClick

《黄金国度》今日正式封测 抢占网页游戏制高点

Discuz!财付通支付接口使用说明

没有技术，你也可以很优秀！—我的站长生涯

CentOS下命令行实现普通用户和root用户切换的实例

积极面对网站被搜索引擎降权

新功能加入 腾讯QQ2009 SP5正式版下载

Linux系统上架设VSFTP服务器实例解析

知名游戏论坛网站遭DDoS攻击勒赎

我的建站奋斗史（吐血原创）

Google推出广告联盟新平台整合DoubleClick

《黄金国度》今日正式封测抢占网页游戏制高点

新功能加入腾讯QQ2009 SP5正式版下载