-
xmldtree_1 xml操作
xmldtree_1 xml操作-xmldtree_1 xml operation
- 2022-02-14 07:59:37下载
- 积分:1
-
多线程同步程序
该文件包含了三个完整的多线程同步工程,基于visual studio 2012,用C语言编写,可直接使用。“多核”、“并行”、“多线程”等概念和技术在这些年越来越常见,这已经是一个趋势,因为大多数情况下并行效率高。在学习多线程编程初期,总会遇到同步问题
- 2023-08-07 04:55:06下载
- 积分:1
-
双向列表的实现
双向列表的实现-Realize two-way list
- 2022-02-14 16:08:56下载
- 积分:1
-
WinFinder控件测试例子
WinFinder控件测试例子-The example of testing WinFinder control
- 2022-01-25 16:18:38下载
- 积分:1
-
dnsquery_src
一个不使用gethostbyname函数实现的dns查询小程序-A gethostbyname function does not use the dns query applet
- 2022-03-16 14:45:44下载
- 积分:1
-
Dinic求最大流, Dinic求最大流, Dinic求最大流,Dinic求最大流
Dinic求最大流, Dinic求最大流, Dinic求最大流,Dinic求最大流-Dinic for maximum flow, Dinic for maximum flow, Dinic for maximum flow, Dinic for maximum flow, Dinic for maximum flow, Dinic for maximum flow
- 2022-05-31 11:06:23下载
- 积分:1
-
COLORREC 算法的实现,包括实验源程序以及实验报告,大家多多支持啊...
3-COLORREC 算法的实现,包括实验源程序以及实验报告,大家多多支持啊-3-COLORREC algorithm, including the experimental source, as well as experimental reports, everyone can support ah
- 2022-07-24 19:12:19下载
- 积分:1
-
搜索引擎
爬虫模块、预处理模块和搜索模块。
搜索引擎的三个部分是相互独立的,三个部分分别工作,主要的关系体现在前一部分得到的数据结果为后一部分提供原始数据。
用户通过浏览器提交查询的词或者短语 P,搜索引擎根据用户的查询返回匹配的网页信息列表 L;
上述过程涉及到两个问题,如何匹配用户的查询以及网页信息列表从何而来,根据什么而排序?用户的查询 P 经过分词器被切割成小词组 并被剔除停用词 ( 的、了、啊等字 ),根据系统维护的一个倒排索引可以查询某个词 pi 在哪些网页中出现过,匹配那些 都出现的网页集即可作为初始结果,更进一步,返回的初始网页集通过计算与查询词的相关度从而得到网页排名,即 Page Rank,按照网页的排名顺序即可得到最终的网页列表;
假设分词器和网页排名的计算公式都是既定的,那么倒排索引以及原始网页集从何而来?原始网页集在之前的数据流程的介绍中,可以得知是由爬虫 spider 爬取网页并且保存在本地的,而倒排索引,即词组到网页的映射表是建立在正排索引的基础上的,后者是分析了网页的内容并对其内容进行分词后,得到的网页到词组的映射表,将正排索引倒置即可得到倒排索引;
网页的分析具体做什么呢?由于爬虫收集来的原始网页中包含很多信息,比如 html 表单以及一些垃圾信息比如广告,网页分析去除这些信息,并抽取其中的正文信息作为后续的基础数据。
- 2022-05-07 14:54:09下载
- 积分:1
-
该程序是一个模拟算法程序,是对一个简单的数学公式的求解实现过程。...
该程序是一个模拟算法程序,是对一个简单的数学公式的求解实现过程。-the program is a simulation algorithm is a simple mathematical formula for the solution to achieve process.
- 2022-02-14 15:15:28下载
- 积分:1
-
C++ FTP 工具
C++ FTP 工具 ----比较实用,稳定,安全-C++ FTP Tool
- 2022-03-11 17:26:41下载
- 积分:1