网络爬虫程序源码这是一款用C#编写的网络爬虫主要特性有:可配置:线程数、线程等待时间,连接超时时间,可爬取文件类型和优先级、下载目录等。状态栏显示统计信息:排入队列URL数,已下载文件数,已下载总字节数,CPU使用率和可用内存等。有偏好的爬虫:可针对爬取的资源类型设置不同的优先级。健壮性:十几项URL正规化策略以排除冗余下载、爬虫陷阱避免策略的使用等、多种策略以解析相对路径等。较好的性能:基于正则表达式的页面解析、适度加锁、维持HTTP连接等。今后有空可能加入的特性:新特性介绍爬取文件用BerkeleyDB存储提高性能:常用操作系统不善于处理大量小文件基于URLRanking的优先级队列主题爬虫:机器学习算法对链接与主题相关度进行评估,并按照得出的优先级顺序进行爬取爬虫礼仪遵循爬虫禁止协议、以及避免对服务器资源的过度使用等性能优化用UDP取代封装好的HttpWebRequest/ResponseDNS缓存异步的DNS地址解析硬盘缓存或内存数据库以避免频繁的磁盘寻道分布式爬虫以扩展单机能力(CPU、内存和硬盘访问)
评分:
更新时间:2010-01-05
浏览次数:25669次
免费
评分:
更新时间:2010-01-27
浏览次数:25686次
免费
设计模式示例源码关乎20种设计模式简单代码,主要是实现方式,讲解比较详细。每一种设计模式都有具体的描述以及详细的实现代码。学习设计模式的朋友可以参考。
评分:
更新时间:2011-05-17
浏览次数:4928次
免费
XH代码生成工具源码源码介绍:自己制作的一款代码生成工具,主要用来生成数据库操作类的。可以自动生成model,bll,Helper类有不足的地方请大家见谅,源码有手动工具开源仅供有兴趣的爱好者参考学习。
标签: 代码生成工具
评分:
更新时间:2023-01-18
浏览次数:2428次
免费
LZJexcel导入导出类源码源码描述:源码可以实现excel导入数据库,数据库导出到excel使用了第三方插件NPOI,该插件开源,源码包中附带了插件源码欢迎感兴趣的用户下载研究
评分:
更新时间:2013-05-22
浏览次数:6310次
免费
SourceGrid网格控件v4.4源码源码描述:SourceGrid是一个完全以C#托管代码编写的.NETWindows窗体网格控件.可用于显示或改变表格形式的数据。可用于绑定到一个数据源(以DataView为代表),或者直接建立每个单元格。SourceGrid仅使用托管代码(无API或Interop),可以用于任何与.NET2兼容的环境中SourceGrid就是一个用于数据显示的表格控件,这个控件比c#自带的DataGridView要强大很多,先不说他的原理,只说他的功能,可以实现各种自定义样式、嵌入各种控件,如checkbox、Combobox、Button、超级链接、其他自定义控件等等,另外他不依赖于数据源显示,可以随意控制其显示的单元格
标签: SourceGrid 网格控件
评分:
更新时间:2014-06-24
浏览次数:3763次
免费
实现了XML文件的读写,与传统的读写方式不一样,采用的是XML序列化的读写方式,先将xml转化成List,再进行增删改,非常方便。实现了基本的分页。有问题的是没有解决datagridview的默认选中。
评分:
更新时间:2016-05-23
浏览次数:4000次
免费
评分:
更新时间:2023-04-27
浏览次数:157次
100.00 积分