很想稍稍深入了解一下搜索(search)的原理

来源:百度知道 编辑:UC知道 时间:2024/09/22 10:07:29
希望大家能给我推荐一些这方面的资料,书籍.有的下载最好,或提供一些相关技术网站(当然是指搜索方面),之前只是略微了解搜索技术是用网络蜘蛛来做的,但其技术内幕还不是很清楚.(我不是要大家找关于网络蜘蛛的相关文章给我,这个我自己也会找 :) ) 还有,学”搜索”技术还需要什么预备知识啊? 你们给的资料深点也没关系的,反正我会慢慢琢磨. 希望大虾们认真回答以上几点,谢谢~

像这些技术,都是比较深奥的,网上很少有人精通,知道的人不多...

你应去买几本相关的技术研发的书

《高效中文搜索引擎的关键技术研发》
《搜索引擎 — 原理、技术与系统》

http://www.sc365.cn/soft/20/124/2007/03147756476.html

http://www.itspring.com/spider/Index.html

上面这个有你要的....

■ 全文搜索引擎
在搜索引擎分类部分我们提到过全文搜索引擎从网站提取信息建立网页数据库的概念。搜索引擎的自动信息搜集功能分两种。一种是定期搜索,即每隔一段时间(比如Google一般是28天),搜索引擎主动派出“蜘蛛”程序,对一定IP地址范围内的互联网站进行检索,一旦发现新的网站,它会自动提取网站的信息和网址加入自己的数据库。

另一种是提交网站搜索,即网站拥有者主动向搜索引擎提交网址,它在一定时间内(2天到数月不等)定向向你的网站派出“蜘蛛”程序,扫描你的网站并将有关信息存入数据库,以备用户查询。由于近年来搜索引擎索引规则发生了很大变化,主动提交网址并不保证你的网站能进入搜索引擎数据库,因此目前最好的办法是多获得一些外部链接,让搜索引擎有更多机会找到你并自动将你的网站收录。

当用户以关键词查找信息时,搜索引擎会在数据库中进行搜寻,如果找到与用户要求内容相符的网站,便采用特殊的算法——通常根据网页中关键词的匹配程度,出现的位置/频次,链接质量等——计算出各网页的相关度及排名等级,然后根据关联度高低,按顺序将这些网页链接返回给用户。

.................