Categories


Tags


HITS算法

HITS算法是一种采用迭代计算的网络算法,用于计算网络中节点的权重。该算法主要用于网络信息检索等计算技术。HITS算法与传统的关键词检索不同,关键词检索是以词语为基础,以文档为主要检索对象,结果通过匹配检索关键词的文档及其相关性程序来返回结果。而HITS算法则是以链接为基础,以网页为主要检索对象,通过计算每个页面的被链接的频度和链接其它页面的重要程度来决定查询结果的排序。该算法基于“authrity”和“hub” 有权重概念,这两个概念可以描述网页在网络中的影响力,分别表示该网页在某个领域的权威程度和其链接的重要性。简而言之,权威页面是指拥有很多高质量链接的页面,而活跃页面则指拥有很多高质量链接的页面,它们可以在网络吸引到更多浏览者。 HITS算法依基于两个基本元素:基于输入计算出的权重和输出给出的权重,用来计算每一网页的重要性,也可以用来衡量网络上不同页面链接的重要性。HITS算法通过对网络进行逐步迭代,来计算每个页面的权威程度及其Mining后的重要程度。在每一次迭代中,权威页面的权重由其上一轮的权重和指向它的链接的权重共同决定,活跃页面的权重也是由其上一轮的权重和指由它发出的链接的权重共同决定的。采用此算法,可以在网络上寻找拥有最高重要性的节点来代表该网络,这样就可以有效地改善搜索结果的质量。

Public @ 2023-02-25 06:01:28

搜索引擎基于链接的排序算法

向大家推荐这篇较早以前的文章,其实很多经典的文章,SEO的价值含量才更多。基于链接的排序算法似乎已广泛应用到各种商业搜索引擎中。为了让设计出来的网站能够在各种搜索引擎中获得较高排名,设计者们应该知道这些算法的原理。 Google排名的成功意味着PageRank算法值得特别的关注。PageRank算法是少数几个公开的排序算法之一。PageRank算法对数学要求很高,但可以做些简单的解释,以分析它对网

Public @ 2016-10-03 16:21:58

浅谈网页搜索排序中的投票模型

前些天读了一本《选举的困境》,其中有一章,从美国的选举制度说起,介绍美国选举制度的不足,然后针对其不足,提出种种改善,然而每种改善都有其各自的问题,其中的变化很有趣。先说美国选举制度,美国的总统选举是一种“赢者通吃”的方式,每个州根据其人口多少,有几十或几百的“州票”,州里的人对总统候选人进行选举,在某个州获得票最多的那个候选人,获得这个州所有的“州票”,然后统计所有候选人的“州票”多少,获得最多

Public @ 2010-03-16 16:21:58

HITS链接分析算法

HITS(Hyperlink - Induced Topic Search)链接分析算法诞生在1997年,该算法是由康奈尔大学中的一位博士提出,并且该算法沿用于全球多个搜索引擎当中。当然,不同的搜索引擎针对于该算法的侧重点和内部公式都有不一的算法结构调整,并且HITS算法也是链接分析中最为重要的基础算法之一。对于目前国内的整体搜索引擎而言,百度作为国内的搜索引擎领头羊,我会带着HITS的公开文档针

Public @ 2009-11-28 15:39:11

HITS链接分析算法

HITS(Hyperlink-Induced Topic Search)是一种基于链接的搜索引擎排名算法,与其他排名算法如PageRank一样,它的主要目的是将用户查询与集合的文档匹配,使得最相关的文档被检索出来,排在前面。事实上,网页根据网页内部和外部因素来排序。HITS算法包括两个重要指标:Authority和Hub,体现网页的相关性,指导搜索引擎排序,即把相关性高的网页排在前面。 HI

Public @ 2023-03-02 20:01:00

更多您感兴趣的搜索

0.392965s