Categories


Tags


HITS算法

HITS算法是一种采用迭代计算的网络算法,用于计算网络中节点的权重。该算法主要用于网络信息检索等计算技术。HITS算法与传统的关键词检索不同,关键词检索是以词语为基础,以文档为主要检索对象,结果通过匹配检索关键词的文档及其相关性程序来返回结果。而HITS算法则是以链接为基础,以网页为主要检索对象,通过计算每个页面的被链接的频度和链接其它页面的重要程度来决定查询结果的排序。该算法基于“authrity”和“hub” 有权重概念,这两个概念可以描述网页在网络中的影响力,分别表示该网页在某个领域的权威程度和其链接的重要性。简而言之,权威页面是指拥有很多高质量链接的页面,而活跃页面则指拥有很多高质量链接的页面,它们可以在网络吸引到更多浏览者。 HITS算法依基于两个基本元素:基于输入计算出的权重和输出给出的权重,用来计算每一网页的重要性,也可以用来衡量网络上不同页面链接的重要性。HITS算法通过对网络进行逐步迭代,来计算每个页面的权威程度及其Mining后的重要程度。在每一次迭代中,权威页面的权重由其上一轮的权重和指向它的链接的权重共同决定,活跃页面的权重也是由其上一轮的权重和指由它发出的链接的权重共同决定的。采用此算法,可以在网络上寻找拥有最高重要性的节点来代表该网络,这样就可以有效地改善搜索结果的质量。

Public @ 2023-02-25 06:01:28

Google的BERT算法更新

这篇帖子是去年(2019年)10月28号打的草稿,今天补充完成发出来。过去一年,关于搜索算法和SEO思维最大的新闻依然是这件事。2019年10月,Google公布上线BERT算法。什么是BERTBERT是Bidirectional Encoder Representations from Transformers的缩写,中文意思大概是“双向transformer编码器表达”,“transforme

Public @ 2018-08-23 15:54:59

TrustRank算法

TrustRank算法是一个用于检测Web图谱(Web graphs)的可靠性和安全性的算法。它是由斯坦福大学的一组研究人员开发和发布的。TrustRank的思想是基于之前的 PageRank算法,但是与PageRank不同的是,TrustRank使用了人工干预的方式,将一些网站标记为可信、不可信或者中等可信度。然后,利用这些标记,计算每个网站的信任值,表示对这个网站的访问与使用是否安全和可靠。这

Public @ 2023-04-05 05:50:11

HITS链接分析算法

HITS(Hyperlink - Induced Topic Search)链接分析算法诞生在1997年,该算法是由康奈尔大学中的一位博士提出,并且该算法沿用于全球多个搜索引擎当中。当然,不同的搜索引擎针对于该算法的侧重点和内部公式都有不一的算法结构调整,并且HITS算法也是链接分析中最为重要的基础算法之一。对于目前国内的整体搜索引擎而言,百度作为国内的搜索引擎领头羊,我会带着HITS的公开文档针

Public @ 2009-11-28 15:39:11

更多您感兴趣的搜索

0.536575s