源码网商城,靠谱的源码在线交易网站 我的订单 购物车 帮助

源码网商城

零基础写python爬虫之爬虫框架Scrapy安装配置

  • 时间:2020-01-07 19:14 编辑: 来源: 阅读:
  • 扫一扫,手机访问
摘要:零基础写python爬虫之爬虫框架Scrapy安装配置
前面十章爬虫笔记陆陆续续记录了一些简单的Python爬虫知识, 用来解决简单的贴吧下载,绩点运算自然不在话下。 不过要想批量下载大量的内容,比如知乎的所有的问答,那便显得游刃不有余了点。 于是乎,爬虫框架Scrapy就这样出场了! Scrapy = Scrach+Python,Scrach这个单词是抓取的意思, Scrapy的官网地址:[url=http://doc.scrapy.org/en/latest/]点我点我[/url]。 那么下面来简单的演示一下Scrapy的安装流程。 具体流程参照:[url=http://www.1sucai.cn/article/48607.htm]http://www.1sucai.cn/article/48607.htm[/url] 友情提醒:一定要按照Python的版本下载,要不然安装的时候会提醒找不到Python。建议大家安装32位是因为有些版本的必备软件64位不好找。 [b]1.安装Python(建议32位)[/b] 建议安装Python2.7.x,3.x貌似还不支持。 安装完了记得配置环境,将python目录和python目录下的Scripts目录添加到系统环境变量的Path里。 在cmd中输入python如果出现版本信息说明配置完毕。 [b]2.安装lxml[/b] lxml是一种使用 Python 编写的库,可以迅速、灵活地处理 XML。点击[url=https://pypi.python.org/pypi/lxml/3.3.1]这里[/url]选择对应的Python版本安装。 [b]3.安装setuptools[/b] 用来安装egg文件,[url=https://pypi.python.org/packages/2.7/s/setuptools/]点击这里[/url]下载python2.7的对应版本的setuptools。 [b]4.安装zope.interface[/b] 可以使用第三步下载的setuptools来安装egg文件,现在也有exe版本,[url=https://pypi.python.org/pypi/zope.interface/4.1.0#downloads]点击这里[/url]下载。 [b]5.安装Twisted[/b] Twisted是用Python实现的基于事件驱动的网络引擎框架,[url=http://twistedmatrix.com/trac/wiki/Downloads]点击这里[/url]下载。 [b]6.安装pyOpenSSL[/b] pyOpenSSL是Python的OpenSSL接口,[url=https://launchpad.net/pyopenssl]点击这里[/url]下载。 [b]7.安装win32py [/b] 提供win32api,[url=http://sourceforge.net/projects/pywin32/files/]点击这里[/url]下载 [b]8.安装Scrapy [/b] 终于到了激动人心的时候了!安装了那么多小部件之后终于轮到主角登场。 直接在cmd中输入easy_install scrapy回车即可。 [b]9.检查安装[/b] 打开一个cmd窗口,在任意位置执行scrapy命令,得到下列页面,表示环境配置成功。 [img]http://files.jb51.net/file_images/article/201411/2014110611591028.jpg[/img]
  • 全部评论(0)
联系客服
客服电话:
400-000-3129
微信版

扫一扫进微信版
返回顶部