在Python3.x中,咱们可使用urlib这个组件抓取网页,urllib是一个URL处理包,这个包中集合了一些处理URL的模块,以下:测试
1.urllib.request模块是用来打开和读取URLs的;fetch
2.urllib.error模块包含一些有urllib.request产生的错误,可使用try进行捕捉处理;url
3.urllib.parse模块包含了一些解析URLs的方法;blog
4.urllib.robotparser模块用来解析robots.txt文本文件.它提供了一个单独的RobotFileParser类,经过该类提供的can_fetch()方法测试爬虫是否能够下载一个页面。it