搜索资源列表
collectEmail
- 最近一直琢磨着写一个网络蜘蛛程序,专门负责收集一些自己感兴趣的东西。用.net写程序从网上取得网页源码比较容易实现,蜘蛛程序的难点在于两个方面,一是如何多线程的自动化处理(即从一个地址跳到另一个地址),另一个是从网页中提取指定的信息。自动化处理方面正在研究,从网页中提取信息,我觉得网上某些网友用String/StringBuilder来处理的方法不可取,用“正则表达式”无疑是最好的。尽管“正则表达式”不容易书写,但查一查资料,还是不难的。 以下是我写的一个从网页中抓取EMail的方法,可
caijixitong
- .net 爬虫程序,从网站采集相关信息,能自动提取网页-.net Crawler,Collect relevant information from the Web site can automatically extract the web page
HTMLParser
- 提取网页源代码,分析源代码,建立dom树-The extracted page source code analysis of the source code, build dom tree
newsooo
- 乙王垂直搜索引擎系统开源版能够自动提取目标网页分类栏目信息字段并自动归类,带服务端爬虫,无须自定义采集规则也能归类影片集数信息,如用于电影垂直搜索引擎等。 具体自动提取与归类的字段定制可以联系qq1426875943定制 本软件采用asp.net2.0,运行前请先安装好.net framework2.0,否则不能正常运行-B Wang vertical search engine system open source version can automatically extract
FindContent
- 从一个网页中提取正文,适合应用于新闻类网站的提取(Extracting text from a web page is suitable for the extraction of news websites)