百度搜索采用什么技术,怎么随便打个字,搜索的网站列表这么快这么多,快的好象是在自己电脑上完成搜索一样

如题所述

在搜索引擎分类部分我们提到过全文搜索引擎从网站提取信息建立网页数据库的概念。搜索引擎的自动信息搜集功能分两种。一种是定期搜索,即每隔一段时间(比如Google一般是28天),搜索引擎主动派出“蜘蛛”程序,对一定IP地址范围内的互联网站进行检索,一旦发现新的网站,它会自动提取网站的信息和网址加入自己的数据库。

另一种是提交网站搜索,即网站拥有者主动向搜索引擎提交网址,它在一定时间内(2天到数月不等)定向向你的网站派出“蜘蛛”程序,扫描你的网站并将有关信息存入数据库,以备用户查询。由于近年来搜索引擎索引规则发生了很大变化,主动提交网址并不保证你的网站能进入搜索引擎数据库,因此目前最好的办法是多获得一些外部链接,让搜索引擎有更多机会找到你并自动将你的网站收录。

当用户以关键词查找信息时,搜索引擎会在数据库中进行搜寻,如果找到与用户要求内容相符的网站,便采用特殊的算法——通常根据网页中关键词的匹配程度,出现的位置/频次,链接质量等——计算出各网页的相关度及排名等级,然后根据关联度高低,按顺序将这些网页链接返回给用户。

........................................................................................

■ 目录索引
与全文搜索引擎相比,目录索引有许多不同之处。

首先,搜索引擎属于自动网站检索,而目录索引则完全依赖手工操作。用户提交网站后,目录编辑人员会亲自浏览你的网站,然后根据一套自定的评判标准甚至编辑人员的主观印象,决定是否接纳你的网站。

其次,搜索引擎收录网站时,只要网站本身没有违反有关的规则,一般都能登录成功。而目录索引对网站的要求则高得多,有时即使登录多次也不一定成功。尤其象Yahoo!这样的超级索引,登录更是困难。(由于登录Yahoo!的难度最大,而它又是商家网络营销必争之地,所以我们会在后面用专门的篇幅介绍登录Yahoo雅虎的技巧)

此外,在登录搜索引擎时,我们一般不用考虑网站的分类问题,而登录目录索引时则必须将网站放在一个最合适的目录(Directory)。

最后,搜索引擎中各网站的有关信息都是从用户网页中自动提取的,所以用户的角度看,我们拥有更多的自主权;而目录索引则要求必须手工另外填写网站信息,而且还有各种各样的限制。更有甚者,如果工作人员认为你提交网站的目录、网站信息不合适,他可以随时对其进行调整,当然事先是不会和你商量的。

目录索引,顾名思义就是将网站分门别类地存放在相应的目录中,因此用户在查询信息时,可选择关键词搜索,也可按分类目录逐层查找。如以关键词搜索,返回的结果跟搜索引擎一样,也是根据信息关联程度排列网站,只不过其中人为因素要多一些。如果按分层目录查找,某一目录中网站的排名则是由标题字母的先后顺序决定(也有例外)。
百度如今是最大的中文搜索引擎,所有的专业搜索引擎的原理大致相同:
目前,搜索引擎与目录索引有相互融合渗透的趋势。原来一些纯粹的全文搜索引擎现在也提供目录搜索,如Google就借用Open Directory目录提供分类查询。而象 Yahoo! 这些老牌目录索引则通过与Google等搜索引擎合作扩大搜索范围(注)。在默认搜索模式下,一些目录类搜索引擎首先返回的是自己目录中匹配的网站,如国内搜狐、新浪、网易等;而另外一些则默认的是网页搜索,如Yahoo。
1.百度是国内最大的商业化全文搜索引擎,占国内80%的市场份额。其功能完备,搜索精度高,除数据库的规模及部分特殊搜索功能外,其他方面可与当前的搜索引擎业界领军人物Google相媲美,在中文搜索支持方面有些地方甚至超过了Google,是目前国内技术水平最高的搜索引擎。为包括Lycos中国、Tom.com、21CN、广州视窗等搜索引擎,以及中央电视台、外经贸部等机构提供后台数据搜索及技术支持。

参考资料:http://www.se-express.com/about/about2.htm

温馨提示:答案为网友推荐,仅供参考
第1个回答  2006-05-24
现在的搜索引擎技术已经不同于过去的了,过去由于互联网刚刚起步,网上的信息并不是像现在这样丰富浩瀚,所以当时都是由工作人员把搜集到的网页数据编入索引查询数据库。而随着互联网在全球的迅速发展,真的让我们感觉到了信息膨胀的情形。介于这种时代背景下,传统的搜索引擎技术已经不能满足我们的使用需求,而软件产业也在飞速发展,新概念的计算学层出不穷,主动式信息抓取技术也就应运而生了。现在的搜索引擎已经引入了AI人工智能技术理念,当你键入一个带有错别字的词或句子时,搜索引擎会主动问你是否要找的是某某某什么,而这往往都是正确的。再说说信息的抓取。当你键入一个关键字后,搜索引擎会首先在自己编制的数据库中搜索,若搜索不到结果,就主动到互联网采取漫游的方式去抓取信息。你也许会问了,世界这么大,为什么搜索速度这么快?其实这是因为搜索引擎服务商在不同国家不同地区都设有他的服务器,这些个服务器都是以高性能阵列的模式链接在一起的,针对不同地区的用户,各负其责,分布式协作。
第2个回答  2006-05-20
这个相对复杂,要不你去问李彦宏吧,呵呵~~~ 简单来说,是这样的,百度首先把网上的网页抓取到他的数据库里,然后建立数据库索引,咱们搜索出来的顺利,是按照你搜索的关键词的意思远近来排名的。理解这个啊,也就我们有事候找不到我们想要的信息了原因了,因为百度数据库里没有。如果有,想找到好的答案,那必须懂得一些搜索技巧了,这个百度里有。

至于这儿快----服务器好,技术好呗 :)本回答被网友采纳
第3个回答  2006-05-24
百度之所以搜索这么快,是因为百度的工程师们使用的算法太好了,听说百度的软件工程师写的算法可以在数秒之内搜索数千乃至上万条的信息,呵呵 我啥时候能掌握这种技术,我就不用在这个破学校混了
第4个回答  2006-05-20
简单的说,你搜索的时候,百度只是从它的数据库里给你查找,而不是真的到网上去找。相反,在你不用百度的时候,它却是时时刻刻在网上遨游,把网页编到自己的数据库里去备查的。