零基础写python爬虫之爬虫框架Scrapy安装配置

时间:2014-11-07 11:03来源:网络整理作者:网络点击: 次

分享到：

Scrapy是一个使用Python编写的，轻量级的，简单轻巧，并且使用起来非常的方便。使用Scrapy可以很方便的完成网上数据的采集工作，它为我们完成了大量的工作，而不需要自己费大力气去

前面十章爬虫笔记陆陆续续记录了一些简单的Python爬虫知识，
用来解决简单的贴吧下载，绩点运算自然不在话下。
不过要想批量下载大量的内容，比如知乎的所有的问答，那便显得游刃不有余了点。
于是乎，爬虫框架Scrapy就这样出场了！
Scrapy = Scrach+Python，Scrach这个单词是抓取的意思，

Scrapy的官网地址：点我点我。

那么下面来简单的演示一下Scrapy的安装流程。
具体流程参照：http://www.jb51.net/article/48607.htm
友情提醒：一定要按照Python的版本下载，要不然安装的时候会提醒找不到Python。建议大家安装32位是因为有些版本的必备软件64位不好找。

1.安装Python（建议32位）

建议安装Python2.7.x，3.x貌似还不支持。
安装完了记得配置环境，将python目录和python目录下的Scripts目录添加到系统环境变量的Path里。
在cmd中输入python如果出现版本信息说明配置完毕。

2.安装lxml

lxml是一种使用 Python 编写的库，可以迅速、灵活地处理 XML。点击这里选择对应的Python版本安装。

3.安装setuptools

用来安装egg文件，点击这里下载python2.7的对应版本的setuptools。

4.安装zope.interface

可以使用第三步下载的setuptools来安装egg文件，现在也有exe版本，点击这里下载。

5.安装Twisted

Twisted是用Python实现的基于事件驱动的网络引擎框架，点击这里下载。