`
hpjianhua
  • 浏览: 236004 次
  • 性别: Icon_minigender_1
  • 来自: 广州
社区版块
存档分类

搜索引擎基本工作原理

阅读更多
今天刚好要了解搜索引擎的项目的技术,所以就上网找了下关于搜索引擎的资料,整理了下,作为学习笔记之用.


搜索引擎基本工作原理
了解搜索引擎的工作原理对我们日常搜索应用和网站提交推广都会有很大帮助。


........................................................................................
 ■ 全文搜索引擎
  在搜索引擎分类部分我们提到过全文搜索引擎从网站提取信息建立网页数据库的概念。搜索引擎的自动信息搜集功能分两种。一种是定期搜索,即每隔一段时间(比如Google一般是28天),搜索引擎主动派出“蜘蛛”程序,对一定IP地址范围内的互联网站进行检索,一旦发现新的网站,它会自动提取网站的信息和网址加入自己的数据库。

  另一种是提交网站搜索,即网站拥有者主动向搜索引擎提交网址,它在一定时间内(2天到数月不等)定向向你的网站派出“蜘蛛”程序,扫描你的网站并将有关信息存入数据库,以备用户查询。由于近年来搜索引擎索引规则发生了很大变化,主动提交网址并不保证你的网站能进入搜索引擎数据库,因此目前最好的办法是多获得一些外部链接,让搜索引擎有更多机会找到你并自动将你的网站收录。

  当用户以关键词查找信息时,搜索引擎会在数据库中进行搜寻,如果找到与用户要求内容相符的网站,便采用特殊的算法——通常根据网页中关键词的匹配程度,出现的位置/频次,链接质量等——计算出各网页的相关度及排名等级,然后根据关联度高低,按顺序将这些网页链接返回给用户。

........................................................................................

 ■ 目录索引
  与全文搜索引擎相比,目录索引有许多不同之处。

  首先,搜索引擎属于自动网站检索,而目录索引则完全依赖手工操作。用户提交网站后,目录编辑人员会亲自浏览你的网站,然后根据一套自定的评判标准甚至编辑人员的主观印象,决定是否接纳你的网站。

  其次,搜索引擎收录网站时,只要网站本身没有违反有关的规则,一般都能登录成功。而目录索引对网站的要求则高得多,有时即使登录多次也不一定成功。尤其象Yahoo!这样的超级索引,登录更是困难。(由于登录Yahoo!的难度最大,而它又是商家网络营销必争之地,所以我们会在后面用专门的篇幅介绍登录Yahoo雅虎的技巧)

  此外,在登录搜索引擎时,我们一般不用考虑网站的分类问题,而登录目录索引时则必须将网站放在一个最合适的目录(Directory)。

  最后,搜索引擎中各网站的有关信息都是从用户网页中自动提取的,所以用户的角度看,我们拥有更多的自主权;而目录索引则要求必须手工另外填写网站信息,而且还有各种各样的限制。更有甚者,如果工作人员认为你提交网站的目录、网站信息不合适,他可以随时对其进行调整,当然事先是不会和你商量的。

  目录索引,顾名思义就是将网站分门别类地存放在相应的目录中,因此用户在查询信息时,可选择关键词搜索,也可按分类目录逐层查找。如以关键词搜索,返回的结果跟搜索引擎一样,也是根据信息关联程度排列网站,只不过其中人为因素要多一些。如果按分层目录查找,某一目录中网站的排名则是由标题字母的先后顺序决定(也有例外)。

  目前,搜索引擎与目录索引有相互融合渗透的趋势。原来一些纯粹的全文搜索引擎现在也提供目录搜索,如Google就借用Open Directory目录提供分类查询。而象 Yahoo! 这些老牌目录索引则通过与Google等搜索引擎合作扩大搜索范围(注)。在默认搜索模式下,一些目录类搜索引擎首先返回的是自己目录中匹配的网站,如国内搜狐、新浪、网易等;而另外一些则默认的是网页搜索,如Yahoo。

  (注):Yahoo已于2004年2月正式推出自己的全文搜索引擎,并结束了与Google的合作。
分享到:
评论

相关推荐

    搜索引擎基本工作原理.pdf

    搜索引擎基本工作原理.pdf搜索引擎基本工作原理.pdf搜索引擎基本工作原理.pdf搜索引擎基本工作原理.pdf搜索引擎基本工作原理.pdf搜索引擎基本工作原理.pdf搜索引擎基本工作原理.pdf搜索引擎基本工作原理.pdf

    LUCENE搜索引擎基本工作原理

    LUCENE搜索引擎基本工作原理 详细介绍了搜索引擎的工作原理

    搜索引擎基本工作原理.docx

    搜索引擎基本工作原理.docx搜索引擎基本工作原理.docx搜索引擎基本工作原理.docx搜索引擎基本工作原理.docx搜索引擎基本工作原理.docx搜索引擎基本工作原理.docx搜索引擎基本工作原理.docx搜索引擎基本工作原理.docx

    (整理)搜索引擎基本工作原理.pdf

    (整理)搜索引擎基本工作原理.pdf(整理)搜索引擎基本工作原理.pdf(整理)搜索引擎基本工作原理.pdf(整理)搜索引擎基本工作原理.pdf(整理)搜索引擎基本工作原理.pdf(整理)搜索引擎基本工作原理.pdf(整理)搜索引擎基本...

    搜索引擎 工作原理

    搜索引擎的工作原理 搜索引擎的工作原理搜索引擎的工作原理搜索引擎的工作原理搜索引擎的工作原理搜索引擎的工作原理搜索引擎的工作原理

    搜索引擎的工作原理

    详细的介绍了 搜索引擎的工作原理 第一章 引论 信息的生产、传播、搜集与查询是人类最基本的活动之一。考虑 以文字为载 体的信息,传统上有图书馆、相应的编目体系和专业人员帮助我 们很快找到所需 的信息,其粒度...

    搜索引擎基本原理和算法介绍

    搜索引擎基本原理和算法介绍 搜索引擎基本原理和算法介绍

    WEB搜索引擎工作原理、结构体系及开发技术

    全面介绍WEB搜索引擎,搜索引擎工作原理,搜索开发技术

    搜索引擎-原理、技术与系统

    全书分三篇共13章内容,从基本 工作原理概述开始,到一个小型简单搜索引擎实现的具体细节,进而详细讨论了大规模分布式搜索引擎系统的设计要点及其关键技术;最后面向主题和个性化的 Web信息服务,阐述了中文网页...

    搜索引擎--原理、技术与系统

    全书分三篇共13章内容,从基本工作原理概述开始,到一个小型简单搜索引擎实现的具体细节,进而详细讨论了大规模分布式搜索引擎系统的设计要点及其关键技术;最后面向主题和个性化的Web信息服务,阐述了中文网页自动...

    搜索引擎—_原理、技术与系统.pdf

    全书分三篇共13章内容,从基本工作原理概述开始,到一个小型简单搜索引擎实现的具体细节,进而详细讨论了大规模分布式搜索引擎系统的设计要点及其关键技术;最后面向主题和个性化的Web信息服务,阐述了中文网页自动...

    搜索引擎技术介绍 介绍搜索引擎各方面技术的基本原理

    介绍搜索引擎各方面技术的基本原理 如爬虫 网页排名 搜索算法

    搜索引擎—原理 技术 与实现

    全书分三篇共13章内容,从基本工作原理概述开始,到一个小型简单搜索引擎实现的具体细节,进而详细讨论了大规模分布式搜索引擎系统的设计要点及其关键技术;最后面向主题和个性化的Web信息服务,阐述了中文网页自动...

    搜索引擎的技术与原理

    本书比较系统地介绍了互联网搜索引擎的工作原理、实现技术及其系统构建 方案。全书分三篇共13 章内容,从基本工作原理概述开始,到一个小型简单搜索 引擎实现的具体细节,进而详细讨论了大规模分布式搜索引擎系统的...

    搜索引擎-原理、技术与系统(带目录版)

    全书分三篇共13章内容,从基本工作原理概述开始,到一个小型简单搜索引擎实现的具体细节,进而详细讨论了大规模分布式搜索引擎系统的设计要点及其关键技术;最后面向主题和个性化的Web信息服务,阐述了中文网页自动...

    搜索引擎营销基本原理.pptx

    搜索引擎营销基本原理.pptx

    搜索引擎的基本原理及发展趋势

    搜索引擎的基本原理及发展趋势 互联网; 信息; 搜索引擎; 类型; 发展趋势

Global site tag (gtag.js) - Google Analytics