搜索资源 - 队列 - 搜珍网

CDN加速镜像 | 设为首页 | 加入收藏夹

热门搜索： 源码 Android 整站插件识别 p2p OpenCV 网络编程游戏源码算法更多...

登陆 | 会员注册

当前位置：

Internet/网络编程

搜索资源 - 队列

下载资源主分类

源码下载

Web源码

开发工具

文档下载

其它资源

搜索资源列表

3126

0下载：
PKU 3126 典型的广度优先搜索用队列实现
所属分类：搜索引擎
- 发布日期：2008-10-13
- 文件大小：1.19kb
- 提供者：冰龙

heritrix2.rar

1下载：
Heritrix是一个爬虫框架，可加如入一些可互换的组件。它的执行是递归进行的，主要有以下几步： 1。在预定的URI中选择一个。 2。获取URI 3。分析，归档结果 4。选择已经发现的感兴趣的URI。加入预定队列。 5。标记已经处理过的URI ,Heritrix is a framework for reptiles, such as income may be a number of interchangeable components. It is a recursive implem
所属分类：Search Engine
- 发布日期：2017-06-12
- 文件大小：18.82mb
- 提供者：王某

spider2006

1下载：
可配置：线程数、线程等待时间，连接超时时间，可爬取文件类型和优先级、下载目录等。状态栏显示统计信息：排入队列URL数，已下载文件数，已下载总字节数，CPU使用率和可用内存等。有偏好的爬虫：可针对爬取的资源类型设置不同的优先级。健壮性：十几项URL正规化策略以排除冗余下载、爬虫陷阱避免策略的使用等、多种策略以解析相对路径等。较好的性能：基于正则表达式的页面解析、适度加锁、维持HTTP连接等。 -C# spider.
所属分类：Search Engine
- 发布日期：2017-08-30
- 文件大小：31kb
- 提供者：rossuel

NwebCrawler

0下载：
NwebCrawler是用C#写的一款多线程网络爬虫程序，它的实现原理是先输入一个或多个种子URL到队列中，然后从队列中提取URL（先进先出原则），分析此网页寻找相应标签并获得其href属性值，爬取有用的链接网页并存入网页库中，其中用爬取历史来记录爬过的网页，这样避免了重复爬取。提取URL存入队列中，进行下一轮爬取。所以NwebCrawler的搜索策略为广度优先搜索。采用广度优先策略有利于多个线程并行爬取而且抓取的封闭性很强。-NwebCrawler is a multi-threaded w
所属分类：Search Engine
- 发布日期：2017-11-06
- 文件大小：13.98kb
- 提供者：sunshine

NWebCrawler

1下载：
网络爬虫, * 可配置：线程数、线程等待时间，连接超时时间，可爬取文件类型和优先级、下载目录等。 * 状态栏显示统计信息：排入队列URL数，已下载文件数，已下载总字节数，CPU使用率和可用内存等。 * 有偏好的爬虫：可针对爬取的资源类型设置不同的优先级。 * 健壮性：十几项URL正规化策略以排除冗余下载、爬虫陷阱避免策略的使用等、多种策略以解析相对路径等。 * 较好的性能：基于正则表达式的页面解析、适度加锁、维持HTTP连接等。-Web crawler
所属分类：Search Engine
- 发布日期：2017-03-27
- 文件大小：377.63kb
- 提供者：wu

IndexMaxPQ

0下载：
通过Java实现索引优先最小队列并附带algs4包，他是一个很有用的例子(Through the Java implementation of the index priority minimum queue with algs4 package, he is a very useful example)
所属分类：搜索引擎
- 发布日期：2017-12-17
- 文件大小：533kb
- 提供者：方式方法

搜珍网 www.dssz.com

粤ICP备11031372号

1999-2046 搜珍网 All Rights Reserved.

本站作为网络服务提供者，仅为网络服务对象提供信息存储空间，仅对用户上载内容的表现方式做保护处理，对上载内容本身不做任何修改或编辑。