芝麻HTTP:pyspider的安装

pyspider是国人binux编写的强大的网络爬虫框架,它带有强大的WebUI、脚本编辑器、任务监控器、项目管理器以及结果处理器,同时支持多种数据库后端、多种消息队列,另外还支持JavaScript渲染页面的爬取,使用起来很是方便,本节介绍一下它的安装过程。html

1. 相关连接

2. 准备工做

pyspider是支持JavaScript渲染的,而这个过程是依赖于PhantomJS的,因此还须要安装PhantomJS(具体的安装过程详见1.2.5节)。python

3. pip安装

这里推荐使用pip安装,命令以下:git

pip3 install pyspider

命令执行完毕便可完成安装。github

4. 常见错误

Windows下可能会出现这样的错误提示:数据库

Command "python setup.py egg_info" failed with error code 1 in /tmp/pip-build-vXo1W3/pycurl

这是PyCurl安装错误,此时须要安装PyCurl库。从http://www.lfd.uci.edu/~gohlke/pythonlibs/#pycurl找到对应的Python版本,而后下载相应的wheel文件便可。好比Windows 64位、Python 3.6,则须要下载pycurl‑7.43.0‑cp36‑cp36m‑win_amd64.whl,随后用pip安装便可,命令以下:后端

pip3 install pycurl‑7.43.0‑cp36‑cp36m‑win_amd64.whl

若是在Linux下遇到PyCurl的错误,能够参考本文:https://imlonghao.com/19.html浏览器

5. 验证安装

安装完成以后,能够直接在命令行下启动pyspider:网络

pyspider all

此时控制台会有相似如图1所示的输出。框架

图1curl

这时pyspider的Web服务就会在本地5000端口运行。直接在浏览器中打开http://localhost:5000/,便可进入pyspider的WebUI管理页面,如图2所示,这证实pyspider已经安装成功了。

图2

后面,咱们会详细介绍pyspider的用法。

相关文章
相关标签/搜索