发布时间 :2010/3/31
国人喜爱把百度(www.baidu.com)作为自己的首先搜索引擎,所以大量的SEO文章,或者国人的网站优化,推广方式更多的都是针对百度的优化设计。在上面一篇文章中曾经提到过1个内容,在google的搜索结果量比百度要大非常多。比如在百度中使用 site:www.guton.com 命令查看搜索结果,百度收入了guton网站的603篇文章。同样在google中搜索,使用site:www.guton.com 命令,搜索结果为3560篇文章。这里有个帖子,具体解释了为啥百度收入的会少。
http://zhidao.baidu.com/question/68735310.html
无论如何,国人确实是喜欢百度的,而大量网站主,并不知道如何做推广,而片面听从SEO推广者的正确或不正确的方式。那么我们来看看百度自己官方的说法。
百度有个帮助页面(http://www.baidu.com/search/jiqiao.html)解释了自己提供的各种产品,一般常见的问题等等。但是好像大部分人都没有看过这个页面,我下面把百度官方的针对推广、网页收入的解释转载过来,供大家浏览,当然这是百度自家之言,具体是否为真实做法,就看个人的理解了。
【以下为转载内容】
如何让我的网站(独立网站或者blog)被百度收录?如何查看我的网站是否被百度收录?
百度会收录符合用户搜索体验的网站和网页。
为促使百度Spider更快的发现您的站点,您也可以向百度提交一下您的网站的入口网址。提交地址是:http://www.baidu.com/search/url_submit.html。您只需提交首页即可,无需提交详细的内容页面。
百度的网页收录机制,只和网页价值有关,与竞价排名等商业因素没有任何关联。
百度是否已经收录您的网站可以通过执行site语法查看,直接在百度搜索中输入site:您的域名,如site:www.baidu.com,如果site语法查询可以查询到结果,那您的网站就已经被百度收录。
site语法得到的搜索结果数,只是一个估算的数值,仅供参考。
如何让我的网页不被百度收录?
百度严格遵循搜索引擎Robots协议(参见http://www.robotstxt.org/)。
您可以设置一个Robots文件以限制您的网站全部网页或者部分目录下网页不被百度收录。具体写法,参见:如何撰写Robots文件。
如果您的网站在被百度收录之后才设置Robots文件禁止抓取,那么新的Robots文件通常会在48小时内生效,生效以后的新网页,将不再建入索引。需要注意的是,robots.txt禁止收录以前百度已收录的内容,从搜索结果中去除可能需要数月的时间。
如果您的拒绝被收录需求非常急迫,也可以发邮件给webmaster@baidu.com请求处理。
为什么我的网站内一些不设链接的私密性网页,甚至是需要访问权限的网页,也会被百度收录?
百度Spider对网页的抓取,是通过网页与网页之间的链接实现的。
网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过您的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。
百度Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去某些访问权限限制内容被百度收录,原因有两点:
如果您不希望这些私密性内容被百度收录,一方面可以通过Robots协议加以限制;另一方面,也可以联系webmaster@baidu.com进行解决。
为什么我的网站收录数量越来越少?
您的网站不符合用户的搜索体验。
您的网站所在的服务器不稳定,Spider在检查更新时抓取不到网页而被暂时去除。
我的网页为什么会从百度搜索结果中消失?
百度并不允诺所有网页都可从百度搜索到。
如果您的网页长时间无法从百度搜索到,或者突然从百度的搜索结果中消失,可能的原因有:
以下的说法是错误的和毫无根据的:
什么样的网页会被百度认为是没有价值而不被百度收录或者从现有搜索结果中消失?
百度只收录对用户有价值的网页。任何网页在搜索结果中的去留变化,都是机器算法计算和调整的结果。下述类型的网页,百度明确不会欢迎:
如果我的网站因为作弊行为而从百度搜索结果中消失,是否还有被重新收录可能?
凡是作出完全修正的网站,都有机会被百度重新收录。百度会定期对被处理站点进行自动评估,并对符合条件者重新收录。
我的网站更新了,可是百度收录的内容还没更新怎么办?
百度会定期自动更新所有网页(包括去除死链接,更新域名变化,更新内容变化)。因此请耐心等一段时间,您的网站上的变化就会被百度察觉并修正。
为什么我的网站在百度收录的数量和其他搜索引擎相比相差很多?
通常情况下,这是正常的现象,不同的搜索引擎判断网页价值的算法不同。