基于关键词的复制网页算法 想前面的提到的算法都是基于这个文档的,对于大型的搜索引擎来说,在性能上有些差距,所以有些优化,针对是网页的关键词,或者网页的meta描述部分。所以,必须有以下的技术做支撑: 1、网页中出现的关键词(中文分词技术)以及每个关键词的权重(关键词密度); 2、提取meta descrīption或者每个网页的若干(比如:512)个字节的有效文字。 在以下算法描述中,我们约定几个信息指纹变量: Pi表示第i个网页; 该网页权重最高的N个关键词构成集合Ti={t...
如对本文有疑问, 点击进行留言回复!!
数字与信号处理实验6 有限冲激响应(FIR)数字滤波器的设计
【计算机体系结构 / 并行与分布计算 / 存储系统】 2019年-中国计算机学会推荐国际学术会议和期刊目录(一)
荐 《操作系统导论》学习笔记(七):内存虚拟化 (机制及策略)
网友评论