如何详细安装Python3环境下的pyspider爬虫工具?
- 内容介绍
- 文章标签
- 相关推荐
本文共计543个文字,预计阅读时间需要3分钟。
PySpider是一款由国内开发者基于Python编写的强大网络爬虫框架,它具备强大的WebUI、脚本编辑器、任务监控器、项目管理器以及结果处理器等功能。同时,它支持多种数据库后端、多种消息队列,此外还支持JavaSc。
pyspider是国人binux编写的强大的网络爬虫框架,它带有强大的WebUI、脚本编辑器、任务监控器、项目管理器以及结果处理器,同时支持多种数据库后端、多种消息队列,另外还支持JavaScript渲染页面的爬取,使用起来非常方便,本节介绍一下它的安装过程。
1. 相关链接
官方文档:docs.pyspider.org/
PyPI:pypi.python.org/pypi/pyspider
GitHub:github.com/binux/pyspider
官方教程:docs.pyspider.org/en/latest/tutorial
在线实例:demo.pyspider.org
2. 准备工作
pyspider是支持JavaScript渲染的,而这个过程是依赖于PhantomJS的,所以还需要安装PhantomJS(具体的安装过程详见1.2.5节)。
3. pip安装
这里推荐使用pip安装,命令如下:
pip3installpyspider
命令执行完毕即可完成安装。
4. 常见错误
Windows下可能会出现这样的错误提示:
Command"pythonsetup.pyegg_info"failedwitherrorcode1in/tmp/pip-build-vXo1W3/pycurl
这是PyCurl安装错误,此时需要安装PyCurl库。从www.lfd.uci.edu/~gohlke/pythonlibs/#pycurl找到对应的Python版本,然后下载相应的wheel文件即可。比如Windows 64位、Python 3.6,则需要下载pycurl‑7.43.0‑cp36‑cp36m‑win_amd64.whl,随后用pip安装即可,命令如下:
pip3installpycurl‑7.43.0‑cp36‑cp36m‑win_amd64.whl
如果在Linux下遇到PyCurl的错误,可以参考本文:www.jb51.net/article/192094.htm。
5. 验证安装
安装完成之后,可以直接在命令行下启动pyspider:
pyspiderall
此时控制台会有类似如图1-74所示的输出。
这时pyspider的Web服务就会在本地5000端口运行。直接在浏览器中打开localhost:5000/,即可进入pyspider的WebUI管理页面,如图1-75所示,这证明pyspider已经安装成功了。
后面,我们会详细介绍pyspider的用法。
到此这篇关于Python3爬虫中pyspider的安装步骤的文章就介绍到这了,更多相关Python3爬虫pyspider的安装内容请搜索易盾网络以前的文章或继续浏览下面的相关文章希望大家以后多多支持易盾网络!
本文共计543个文字,预计阅读时间需要3分钟。
PySpider是一款由国内开发者基于Python编写的强大网络爬虫框架,它具备强大的WebUI、脚本编辑器、任务监控器、项目管理器以及结果处理器等功能。同时,它支持多种数据库后端、多种消息队列,此外还支持JavaSc。
pyspider是国人binux编写的强大的网络爬虫框架,它带有强大的WebUI、脚本编辑器、任务监控器、项目管理器以及结果处理器,同时支持多种数据库后端、多种消息队列,另外还支持JavaScript渲染页面的爬取,使用起来非常方便,本节介绍一下它的安装过程。
1. 相关链接
官方文档:docs.pyspider.org/
PyPI:pypi.python.org/pypi/pyspider
GitHub:github.com/binux/pyspider
官方教程:docs.pyspider.org/en/latest/tutorial
在线实例:demo.pyspider.org
2. 准备工作
pyspider是支持JavaScript渲染的,而这个过程是依赖于PhantomJS的,所以还需要安装PhantomJS(具体的安装过程详见1.2.5节)。
3. pip安装
这里推荐使用pip安装,命令如下:
pip3installpyspider
命令执行完毕即可完成安装。
4. 常见错误
Windows下可能会出现这样的错误提示:
Command"pythonsetup.pyegg_info"failedwitherrorcode1in/tmp/pip-build-vXo1W3/pycurl
这是PyCurl安装错误,此时需要安装PyCurl库。从www.lfd.uci.edu/~gohlke/pythonlibs/#pycurl找到对应的Python版本,然后下载相应的wheel文件即可。比如Windows 64位、Python 3.6,则需要下载pycurl‑7.43.0‑cp36‑cp36m‑win_amd64.whl,随后用pip安装即可,命令如下:
pip3installpycurl‑7.43.0‑cp36‑cp36m‑win_amd64.whl
如果在Linux下遇到PyCurl的错误,可以参考本文:www.jb51.net/article/192094.htm。
5. 验证安装
安装完成之后,可以直接在命令行下启动pyspider:
pyspiderall
此时控制台会有类似如图1-74所示的输出。
这时pyspider的Web服务就会在本地5000端口运行。直接在浏览器中打开localhost:5000/,即可进入pyspider的WebUI管理页面,如图1-75所示,这证明pyspider已经安装成功了。
后面,我们会详细介绍pyspider的用法。
到此这篇关于Python3爬虫中pyspider的安装步骤的文章就介绍到这了,更多相关Python3爬虫pyspider的安装内容请搜索易盾网络以前的文章或继续浏览下面的相关文章希望大家以后多多支持易盾网络!

