鍏嶈垂閫佸僵閲戝ū涔愬満-xn--pg-uv2cvsu52cd5ar98i4rt573av35a.52bczfz.com

google seo -> telegram: @ehseo6

">Newsnet 2022-10-06 03:13
  • home  >   /neural network  >   鍏嶈垂閫佸僵閲戝ū涔愬満
  • 閫佸僵閲戝浗闄呭ū涔愬钩鍙啊和?ff00.co』涓嬭浇閫佸僵閲戠殑鐢靛瓙娓告垙-F2F4Y5L8-2022-10-06 03:13   F   W   L

    搜索引擎工作原理

      搜索引擎的基本工作原理包括如下三个过程:

      首先在互联网中发现、搜集网页信息;

      同时对信息进行提取和组织建立索引库;

      再由检索器根据用户输入的查询关键字,在索引库中快速检出文档,进行文档与查询的相关度评价,对将要输出的结果进行排序,并将查询结果返回给用户。

      


      1、抓取网页。每个独立的搜索引擎都有自己的网页抓取程序爬虫( spider)。爬虫Spider顺着网页中的超链接,从这个网站爬到另一个网站,通过超链接分析连续访问抓取更多网页。被抓取的网页被称之为网页快照。由于互联网中超链接的应用很普遍,理论上,从一定范围的网页出发,就能搜集到绝大多数的网页。

      2、处理网页。搜索引擎抓到网页后,还要做大量的预处理工作,才能提供检索服务。其中,最重要的就是提取关键词,建立索引库和索引。其他还包括去除重复网页、分词(中文)、判断网页类型、分析超链接、计算网页的重要度/丰富度等。

      3、提供检索服务。用户输入关键词进行检索,搜索引擎从索引数据库中找到匹配该关键词的网页;为了用户便于判断,除了网页标题和URL外,还会提供一段来自网页的摘要以及其他信息。

      目录索引

      与全文搜索引擎相比,目录索引有许多不同之处。

      首先,搜索引擎属于自动网站检索,而目录索引则完全依赖手工操作。用户提交网站后,目录编辑人员会亲自浏览你的网站,然后根据一套自定的评判标准甚至编辑人员的主观印象,决定是否接纳你的网站。

      其次,搜索引擎收录网站时,只要网站本身没有违反有关的规则,一般都能登录成功。而目录索引对网站的要求则高得多,有时即使登录多次也不一定成功。尤其象Yahoo!这样的超级索引,登录更是困难。

      


      此外,在登录搜索引擎时,我们一般不用考虑网站的分类问题,而登录目录索引时则必须将网站放在一个最合适的目录(Directory)。

      最后,搜索引擎中各网站的有关信息都是从用户网页中自动提取的,所以用户的角度看,我们拥有更多的自主权;而目录索引则要求必须手工另外填写网站信息,而且还有各种各样的限制。更有甚者,如果工作人员认为你提交网站的目录、网站信息不合适,他可以随时对其进行调整,当然事先是不会和你商量的。

      目录索引,顾名思义就是将网站分门别类地存放在相应的目录中,因此用户在查询信息时,可选择关键词搜索,也可按分类目录逐层查找。如以关键词搜索,返回的结果跟搜索引擎一样,也是根据信息关联程度排列网站,只不过其中人为因素要多一些。如果按分层目录查找,某一目录中网站的排名则是由标题字母的先后顺序决定(也有例外)。

      目前,搜索引擎与目录索引有相互融合渗透的趋势。原来一些纯粹的全文搜索引擎现在也提供目录搜索,如Google就借用Open Directory目录提供分类查询。而象 Yahoo! 这些老牌目录索引则通过与Google等搜索引擎合作扩大搜索范围(注),在默认搜索模式下,一些目录类搜索引擎首先返回的是自己目录中匹配的网站,如国内搜狐、新浪、网易等;而另外一些则默认的是网页搜索,如Yahoo。


    版权声明

    本文由网络资料整理,如有侵权联系站长删除。

    相关推荐

    评论

    买lol比赛网站安全吗 线上买球app 欧宝体育登录 lolS12外围投注网址 外围买球软件有哪些
    下注英雄联盟S12全球比赛外围链接 九游会游戏官网 线上买球app 飞艇彩票平台注册网址 正规线上买球平台
    LOLS12官网下注 英雄联盟买球官方网站 世界杯投注用什么软件 爱游戏体育入口 lol官方买比赛APP
    电竞比赛下注网站 意甲线上买球 意甲外围买球网站是多少 365买球软件下载网址 亚博的官方网址