-
单位的工资处理程序,可进行任意栏目定制工资条,和任意栏目公式计算...
单位的工资处理程序,可进行任意栏目定制工资条,和任意栏目公式计算-Units, payroll processing procedures, can be customized any part of wages, and any part formula
- 2022-02-03 00:38:17下载
- 积分:1
-
MFC的IOCP的例子,详细介绍了如何使用和使用技巧~~~~~~~~~~~~
MFC IOCP的例子,详细介绍如何使用及使用技巧等-MFC IOCP example, details on how to use and the use of techniques ~~~~~~~~~~~~
- 2022-04-12 12:22:29下载
- 积分:1
-
uda旧的实验控制台版本.仅作实验测试用途.仅有英文命令行版.含源代码....
uda旧的实验控制台版本.仅作实验测试用途.仅有英文命令行版.含源代码.
-uda old console version of the experiment. experimental testing purposes only. the only English version of the command line. containing the source code.
- 2022-05-25 06:21:08下载
- 积分:1
-
我们学校信息管理西的论文,大家欣赏一下,好好交流,一起提高...
我们学校信息管理西的论文,大家欣赏一下,好好交流,一起提高-It is a paper of our college of information management.Let us enjoy it and study together.We will improve ourselves too!
- 2022-06-01 08:14:50下载
- 积分:1
-
一个完整的工程应用系统,很全面的,值得学习
一个完整的工程应用系统,很全面的,值得学习-A complete system engineering applications, it is comprehensive, it is worth learning
- 2022-03-18 11:21:50下载
- 积分:1
-
ttttttttttttttttttttt
c++实现一个基于对栈,队列,树的操作,可加深对其的理解-ttttttttttttttttttttt
- 2023-09-03 11:30:03下载
- 积分:1
-
搜索引擎
爬虫模块、预处理模块和搜索模块。
搜索引擎的三个部分是相互独立的,三个部分分别工作,主要的关系体现在前一部分得到的数据结果为后一部分提供原始数据。
用户通过浏览器提交查询的词或者短语 P,搜索引擎根据用户的查询返回匹配的网页信息列表 L;
上述过程涉及到两个问题,如何匹配用户的查询以及网页信息列表从何而来,根据什么而排序?用户的查询 P 经过分词器被切割成小词组 并被剔除停用词 ( 的、了、啊等字 ),根据系统维护的一个倒排索引可以查询某个词 pi 在哪些网页中出现过,匹配那些 都出现的网页集即可作为初始结果,更进一步,返回的初始网页集通过计算与查询词的相关度从而得到网页排名,即 Page Rank,按照网页的排名顺序即可得到最终的网页列表;
假设分词器和网页排名的计算公式都是既定的,那么倒排索引以及原始网页集从何而来?原始网页集在之前的数据流程的介绍中,可以得知是由爬虫 spider 爬取网页并且保存在本地的,而倒排索引,即词组到网页的映射表是建立在正排索引的基础上的,后者是分析了网页的内容并对其内容进行分词后,得到的网页到词组的映射表,将正排索引倒置即可得到倒排索引;
网页的分析具体做什么呢?由于爬虫收集来的原始网页中包含很多信息,比如 html 表单以及一些垃圾信息比如广告,网页分析去除这些信息,并抽取其中的正文信息作为后续的基础数据。
- 2022-05-07 14:54:09下载
- 积分:1
-
中国人民建设银行中国人民对外友好协会全人民代表大会
中国人民建设银行中国人民对外友好协会全人民代表大会-People
- 2022-11-14 07:00:02下载
- 积分:1
-
Opencv examples in C / C
Opencv examples in C / C-Opencv examples in C/C++
- 2022-03-26 06:06:35下载
- 积分:1
-
源代码资源管理
资源管理器的源代码-resources management of source code
- 2022-04-14 20:20:28下载
- 积分:1