搜索资源列表
gj
- 主要论述了高级文件搜索引擎核心功能的实现技术,对文件搜索的研究有大的帮助
vc
- 网络蜘蛛,描述搜索引擎的核心技术-Web Spider, describes the core technology of search engines ... ... ... ... ... ... ... ... ... ... ... ... ... ... ... ...
SearchEngine
- 网络中的资源非常丰富,但是如何有效的搜索信息却是一件困难的事情。建立搜索引擎就是解决这个问题的最好方法。本文首先详细介绍了基于英特网的搜索引擎的系统结构,然后从网络机器人、索引引擎、Web服务器三个方面进行详细的说明。为了更加深刻的理解这种技术,本人还亲自实现了一个自己的搜索引擎——新闻搜索引擎。 新闻搜索引擎是从指定的Web页面中按照超连接进行解析、搜索,并把搜索到的每条新闻进行索引后加入数据库。然后通过Web服务器接受客户端请求后从索引数据库中搜索出所匹配的新闻。 本人在介绍搜索引擎
building_search_applications
- 这本书通过比较几个著名的开源的搜索引擎,深入研究了开发搜索引擎过程中的一些核心技术-This book by comparing the number of well-known open-source search engine, in-depth study of the search engine in the process of developing some of the core technology
ProgrammingPCollectivePIntelligence
- 本书以机器学习与计算统计为主题背景,专门讲述如何挖掘和分析Web上的数据和资源,如何分析用户体验、市场营销、个人品味等诸多信息,并得出有用的结论,通过复杂的算法来从Web网站获取、收集并分析用户的数据和反馈信息,以便创造新的用户价值和商业价值。全书内容翔实,包括协作过滤技术(实现关联产品推荐功能)、集群数据分析(在大规模数据集中发掘相似的数据子集)、搜索引擎核心技术(爬虫、索引、查询引擎、PageRank算法等)、搜索海量信息并进行分析统计得出结论的优化算法、贝叶斯过滤技术(垃圾邮件过滤、文本过
Baiduwordsegmentation
- 查询处理与分词是一个中文搜索引擎必不可少的工作,而百度作为一个典型的中文搜索引擎一直强调其“中文处理”方面具有其它搜索引擎所不具有的关键技术和优势。那么我们就来看看百度到底采用了哪些所谓的核心技术。-Query processing and word is essential to a Chinese search engine work, but as a typical Chinese Baidu search engine has always stressed its " Chi