Categories


Tags


HITS算法

HITS算法是一种采用迭代计算的网络算法,用于计算网络中节点的权重。该算法主要用于网络信息检索等计算技术。HITS算法与传统的关键词检索不同,关键词检索是以词语为基础,以文档为主要检索对象,结果通过匹配检索关键词的文档及其相关性程序来返回结果。而HITS算法则是以链接为基础,以网页为主要检索对象,通过计算每个页面的被链接的频度和链接其它页面的重要程度来决定查询结果的排序。该算法基于“authrity”和“hub” 有权重概念,这两个概念可以描述网页在网络中的影响力,分别表示该网页在某个领域的权威程度和其链接的重要性。简而言之,权威页面是指拥有很多高质量链接的页面,而活跃页面则指拥有很多高质量链接的页面,它们可以在网络吸引到更多浏览者。 HITS算法依基于两个基本元素:基于输入计算出的权重和输出给出的权重,用来计算每一网页的重要性,也可以用来衡量网络上不同页面链接的重要性。HITS算法通过对网络进行逐步迭代,来计算每个页面的权威程度及其Mining后的重要程度。在每一次迭代中,权威页面的权重由其上一轮的权重和指向它的链接的权重共同决定,活跃页面的权重也是由其上一轮的权重和指由它发出的链接的权重共同决定的。采用此算法,可以在网络上寻找拥有最高重要性的节点来代表该网络,这样就可以有效地改善搜索结果的质量。

Public @ 2023-02-25 06:01:28

世上本没有百度pagerank和权重

百度站长平台的同学在与站长交流中,经常被问“去哪里查百度pagerank”“百度权重是怎么算的”诸如此类的问题。针对此,百度站长平台正式发出公告:百度pagerank、百度权值是不存在的!那么,百度通过什么来判断网站价值呢?百度搜索引擎认为同一网站在不同场景、不同需求时所体现的价值是不同的,用一个固定的数值去体现网站价值既不科技也不严谨。百度搜索引擎的确有一套衡量网站价值的打分体系,由近百种策略组

Public @ 2017-12-26 15:35:10

谷歌论文:大规模的超文本网页搜索引擎的分析

本文是谷歌创始人Sergey和Larry在斯坦福大学计算机系读博士时的一篇论文。发表于1997年。在网络中并没有完整的中文译本,现将原文和本人翻译的寥寥几句和网络收集的片段(网友xfygx和雷声大雨点大的无私贡献)整理和综合到一起,翻译时借助了translate.Google.com,因为是技术性的论文,文中有大量的合成的术语和较长的句子,有些进行了意译而非直译。作为Google辉煌的起始,这篇文

Public @ 2019-08-03 15:55:02

HITS算法

HITS算法是一种采用迭代计算的网络算法,用于计算网络中节点的权重。该算法主要用于网络信息检索等计算技术。HITS算法与传统的关键词检索不同,关键词检索是以词语为基础,以文档为主要检索对象,结果通过匹配检索关键词的文档及其相关性程序来返回结果。而HITS算法则是以链接为基础,以网页为主要检索对象,通过计算每个页面的被链接的频度和链接其它页面的重要程度来决定查询结果的排序。该算法基于“authr

Public @ 2023-02-25 06:01:28

HITS链接分析算法

HITS(Hyperlink-Induced Topic Search)是一种基于链接的搜索引擎排名算法,与其他排名算法如PageRank一样,它的主要目的是将用户查询与集合的文档匹配,使得最相关的文档被检索出来,排在前面。事实上,网页根据网页内部和外部因素来排序。HITS算法包括两个重要指标:Authority和Hub,体现网页的相关性,指导搜索引擎排序,即把相关性高的网页排在前面。 HI

Public @ 2023-03-02 20:01:00

更多您感兴趣的搜索

0.423900s