网络爬虫毕业设计(含外文翻译)
《网络爬虫毕业设计(含外文翻译)》由会员分享,可在线阅读,更多相关《网络爬虫毕业设计(含外文翻译)(69页珍藏版)》请在毕设资料网上搜索。
1、 I 摘要 目前即使通讯软件在平时的生活中有着十分广泛的应用, 但是对绝大部分的软件 来说,都必须应用在互联网上,必须在一个 INTERNET 环境下才能使用。有时候单位 内部的员工,同学,在没有互联网环境下或因其他原因希望不用 INTERNET 就可以进 行信息交互,这样开发局域网通信就有了必要性。本文提出了局域网信息交互的需求, 并详细对网络协议 TCP/IP 协议族进行了介绍和研究, 如 TCP, UDP, 广播等相关技术。 并对网络信息交互原理惊醒了说明,在此基础上利用 SOCKET 网络编程实现了一种基 于 WINDOWS 平台的局域网信息交互功能。 网络爬虫是一种自动搜集互联网信息
2、的程序。 通过网络爬虫不仅能够为搜索引擎采集网 络信息, 而且可以作为定向信息采集器, 定向采集某些网站下的特定信息, 如招聘信息, 租房信息等。 本文通过 JAVA 实现了一个基于广度优先算法的多线程爬虫程序。为何要使用多线 程,以及如何实现多线程;系统实现过程中的数据存储;网页信息解析等。 通过实现这一爬虫程序,可以搜集某一站点的 URLs,并将搜集到的 URLs 存入数 据库。将解析的网页存入 XML 文档。 【关键词】 网络爬虫; SOCKET 编程;TCP/IP;网络编程 ;JAVA II Abstract Instant message software in our daily
3、lives has a very wide range of application , However ,most of the software must be used in the Internet , and it must be used in a Internet environment .Sometimes Internal staff, students ,may not have the Internet environment or other reasons do not wish to be able to communicate on the Internet .T
- 配套讲稿:
如PPT文件的首页显示word图标,表示该PPT已包含配套word讲稿。双击word图标可打开word文档。
- 特殊限制:
部分文档作品中设计图片,仅作为作品整体效果示例展示,禁止商用。设计者仅对作品中独创性部分享有著作权。
- 关 键 词:
- 网络 爬虫 毕业设计 外文 翻译
