优秀的编程知识分享平台

网站首页 > 技术文章 正文

「从零开始Python爬虫」1.8.1 Pyspider的安装

nanyue 2025-03-14 19:31:28 技术文章 2 ℃

pyspider是国人binux编写的强大的网络爬虫框架,它带有强大的WebUI、脚本编辑器、任务监控器、项目管理器以及结果处理器,同时支持多种数据库后端、多种消息队列,另外还支持JavaScript渲染页面的爬取,使用起来非常方便,本节介绍一下它的安装过程。

相关链接

※官方文档:http://docs.pyspider.org/

※PyPI:https://pypi.python.org/pypi/pyspider

※GitHub:https://github.com/binux/pyspider

※官方教程:
http://docs.pyspider.org/en/latest/tutorial

※在线实例:http://demo.pyspider.org

准备工作

pyspider是支持JavaScript渲染的,而这个过程是依赖于PhantomJS的,所以还需要安装PhantomJS。

pip安装

这里推荐使用pip安装,命令如下:

pip  install pyspider

命令执行完毕即可完成安装。

常见错误

Windows下可能会出现这样的错误提示:

Command "python setup.py egg_info" failed with error code 1 in /tmp/pip-build-vXo1W3/pycurl

这是PyCurl安装错误,此时需要安装PyCurl库。从
http://www.lfd.uci.edu/~gohlke/pythonlibs/#pycurl找到对应的Python版本,然后下载相应的wheel文件即可。比如Windows 64位、Python 3.6,则需要下载pycurl-7.43.0-cp36-cp36m-win_amd64.whl,随后用pip安装即可,命令如下:

pip3 install pycurl-7.43.0-cp36-cp36m-win_amd64.whl

如果在Linux下遇到PyCurl的错误,可以参考本文:
https://imlonghao.com/19.html。

验证安装

安装完成之后,可以直接在命令行下启动pyspider:

pyspider all

此时控制台会有类似如下图所示的输出。

这时pyspider的Web服务就会在本地5000端口运行。直接在浏览器中打开http://localhost:5000/,即可进入pyspider的WebUI管理页面,如下图所示,这证明pyspider已经安装成功了。

后面,我们会详细介绍pyspider的用法。

【上节】「从零开始Python爬虫」1.7.3 APPium的安装

Tags:

最近发表
标签列表