如何安装Python3爬虫中的pyspider

介绍

这篇文章主要讲解了如何安装Python3爬虫中的pyspider,内容清晰明了,对此有兴趣的小伙伴可以学习一下,相信大家阅读完之后会有帮助。

pyspider是国人binux编写的强大的网络爬虫框架,它带有强大的WebUI,脚本编辑器,任务监控器,项目管理器以及结果处理器,同时支持多种数据库后端,多种消息队列,另外还支持JavaScript渲染页面的爬取,使用起来非常方便,本节介绍一下它的安装过程。

<强> 1。相关链接

官方文档:http://docs.pyspider.org/

官方教程:http://docs.pyspider.org/en/latest/tutorial

<强> 2。准备工作

pyspider是支持JavaScript渲染的,而这个过程是依赖于PhantomJS的,所以还需要安装PhantomJS(具体的安装过程详见1.2.5节)。

<强> 3。pip安装

这里推荐使用脉冲安装,命令如下:

pip3  install  pyspider

命令执行完毕即可完成安装。

<强> 4。常见错误

Windows下可能会出现这样的错误提示:

Command “python  setup.py  egg_info", failed  with  error  code  1,拷贝/tmp/pip-build-vXo1W3 pycurl

这是pycurl安装错误,此时需要安装pycurl库。从http://www.lfd.uci.edu/gohlke pythonlibs/# pycurl找到对应的Python版本,然后下载相应的轮文件即可。比如Windows 64位,Python 3.6,则需要下载pycurl& # 8209; 7.43.0& # 8209; cp36& # 8209; cp36m& # 8209; win_amd64。whl,随后用脉冲安装即可,命令如下:

pip3  install  pycurl& # 8209; 7.43.0& # 8209; cp36& # 8209; cp36m& # 8209; win_amd64.whl

如果在Linux下遇到PyCurl的错误,可以参考本文:https://www.jb51.net/article/192094.htm。

<强> 5。验证安装

安装完成之后,可以直接在命令行下启动pyspider:

pyspider 所有

此时控制台会有类似如图1 - 74所示的输出。

如何安装Python3爬虫中的pyspider

这时pyspider的Web服务就会在本5000年地端口运行。直接在浏览器中打开http://localhost: 5000/,即可进入pyspider的WebUI管理页面,如图1 - 75所示,这证明pyspider已经安装成功了。

如何安装Python3爬虫中的pyspider

看完上述内容,是不是对如何安装Python3爬虫中的pyspider有进一步的了解,如果还想学习更多内容,欢迎关注行业资讯频道。

如何安装Python3爬虫中的pyspider