资源列表
spider1
- 本程序是网络爬虫的简单版本,实现了获取网页的链接功能,-The program access to web connectivity
sharhoo_php
- 此网页首页设计大气,并且搜索结果十分丰富精确 源码完整 完全开源 可以调节搜索结果 上传可用 无需任何改动 如果想把此源码的底部链接改动 也可以 共分两个版 asp版和php版 此版为PHP版 -Complete this page Home design atmosphere, and the search results are very rich and accurate source fully open source can be adjusted search results upl
ansj
- ictclass的java版本开源实现,用于实现中文分词功能。-the java version that the open source implementation of ictclass
doctrine-doctrine-website-sphinx
- doctrine与sphinx可以完美结合,达到重量级搜索效果。-doctrine and sphinx
zhizhu_v1.0
- 扎鸟搜索引擎蜘蛛爬行统计系统。搜索引擎蜘蛛的跟踪记录,主要有 百度,谷歌,搜搜,搜狗,360,雅虎,Bing,有道,Alexa,搜索引擎蜘蛛,能准确抓取并记录。-Tie bird search engine spiders crawl the statistical system. The track record of the search engine spiders Baidu, Google, Soso, Sogou, 360, Yahoo, Bing, the proper way,
bz
- 在线阅读免费报纸代码 支持本地 支持web 应用嵌入网站-code of chinese free online newspapers
SearchEngin_NewSOO
- 一个垂直搜索引擎例子希望对大家有所帮助。包含了主体核心代码。-A vertical search engine example, we want to help. Contains the main core code.
LoalaSam
- 功能强大地搜索引擎,实现简单,源程序风,封装好的-The powerful search engine, to achieve a simple, good the source wind, package
GetWeb
- 以下是一个Java爬虫程序,它能从指定主页开始,按照指定的深度抓取该站点域名下的网页并维护简单索引。-The following is a Java reptiles, it can start from the specified Home to crawl pages under the domain name of the site in accordance with the specified depth and maintain a simple index.
wordbag
- 根据一个人物名单文件,查找wekipedia上相应网页,读取网页文本,并统计每个人物在每个网页上出现的次数,最终形成word bag,人物500人,运行时间6分钟左右。-from a namelist making a word bag
Spider-Java
- 网络爬虫的简要介绍及一点源代码,分享给想要学习爬虫的人-The web crawler brief introduction and point-source code
this-is-search-engine
- 一本关于搜索引擎的书籍,强调原理而不纠缠技术细节-Books of a search engine, stressed that the principle of not entangled technical details