资源列表
bz
- 在线阅读免费报纸代码 支持本地 支持web 应用嵌入网站-code of chinese free online newspapers
zhizhu_v1.0
- 扎鸟搜索引擎蜘蛛爬行统计系统。搜索引擎蜘蛛的跟踪记录,主要有 百度,谷歌,搜搜,搜狗,360,雅虎,Bing,有道,Alexa,搜索引擎蜘蛛,能准确抓取并记录。-Tie bird search engine spiders crawl the statistical system. The track record of the search engine spiders Baidu, Google, Soso, Sogou, 360, Yahoo, Bing, the proper way,
doctrine-doctrine-website-sphinx
- doctrine与sphinx可以完美结合,达到重量级搜索效果。-doctrine and sphinx
ansj
- ictclass的java版本开源实现,用于实现中文分词功能。-the java version that the open source implementation of ictclass
sharhoo_php
- 此网页首页设计大气,并且搜索结果十分丰富精确 源码完整 完全开源 可以调节搜索结果 上传可用 无需任何改动 如果想把此源码的底部链接改动 也可以 共分两个版 asp版和php版 此版为PHP版 -Complete this page Home design atmosphere, and the search results are very rich and accurate source fully open source can be adjusted search results upl
spider1
- 本程序是网络爬虫的简单版本,实现了获取网页的链接功能,-The program access to web connectivity
Rknn-classification
- R语言实现文本分类,文本表示,向量空间表示-R language text classification, text, vector space representation
Practice1
- 网络爬虫抓取页面的链接,利用递归可以从该链接到达的页面继续获取链接-Web crawler recursively crawls pages link
domainSpider
- 自己用java写的一个域名扫描程序,扫描网络上未被注册的域名。可以在配置文件里配置字符组成、长度范围、域名机构名。扫描结果存放mysql数据库里同时输出log文件,建库语句压缩包里有。-Own a domain name written in java scanner scans the network is not registered on the domain name. Configuration characters in the configuration file, the len
Examples-for-Self-Study_book
- more than 25 examples to learn Verilog and VHDL with model simulation results
assignment
- FPGA assignment for M. Tech Students to solve
NwebCrawler
- NwebCrawler是用C#写的一款多线程网络爬虫程序,它的实现原理是先输入一个或多个种子URL到队列中,然后从队列中提取URL(先进先出原则),分析此网页寻找相应标签并获得其href属性值,爬取有用的链接网页并存入网页库中,其中用爬取历史来记录爬过的网页,这样避免了重复爬取。提取URL存入队列中,进行下一轮爬取。所以NwebCrawler的搜索策略为广度优先搜索。采用广度优先策略有利于多个线程并行爬取而且抓取的封闭性很强。-NwebCrawler is a multi-threaded w