零基础写python爬虫之爬虫框架Scrapy安装配置

程序员文章站 2023-11-04 13:41:28

前面十章爬虫笔记陆陆续续记录了一些简单的python爬虫知识，用来解决简单的贴吧下载，绩点运算自然不在话下。不过要想批量下载大量的内容，比如知乎的所有的问答，那便显...

前面十章爬虫笔记陆陆续续记录了一些简单的python爬虫知识，
用来解决简单的贴吧下载，绩点运算自然不在话下。
不过要想批量下载大量的内容，比如知乎的所有的问答，那便显得游刃不有余了点。
于是乎，爬虫框架scrapy就这样出场了！
scrapy = scrach+python，scrach这个单词是抓取的意思，

scrapy的官网地址：。

那么下面来简单的演示一下scrapy的安装流程。
具体流程参照：
友情提醒：一定要按照python的版本下载，要不然安装的时候会提醒找不到python。建议大家安装32位是因为有些版本的必备软件64位不好找。

1.安装python（建议32位）

建议安装python2.7.x，3.x貌似还不支持。
安装完了记得配置环境，将python目录和python目录下的scripts目录添加到系统环境变量的path里。
在cmd中输入python如果出现版本信息说明配置完毕。

2.安装lxml

lxml是一种使用 python 编写的库，可以迅速、灵活地处理 xml。点击选择对应的python版本安装。

3.安装setuptools

用来安装egg文件，下载python2.7的对应版本的setuptools。

4.安装zope.interface

可以使用第三步下载的setuptools来安装egg文件，现在也有exe版本，下载。

5.安装twisted

twisted是用python实现的基于事件驱动的网络引擎框架，点击这里下载。

6.安装pyopenssl

pyopenssl是python的openssl接口，下载。

7.安装win32py

提供win32api，下载

8.安装scrapy

终于到了激动人心的时候了！安装了那么多小部件之后终于轮到主角登场。
直接在cmd中输入easy_install scrapy回车即可。

9.检查安装

打开一个cmd窗口，在任意位置执行scrapy命令，得到下列页面，表示环境配置成功。

零基础写python爬虫之爬虫框架Scrapy安装配置

上一篇： IOS开发实现录音功能

下一篇：上海过年吃啥？四道硬菜做法详细介绍！

零基础写python爬虫之爬虫框架Scrapy安装配置

零基础写python爬虫之使用Scrapy框架编写爬虫

零基础写python爬虫之抓取糗事百科代码分享

零基础写python爬虫之爬虫框架Scrapy安装配置

零基础写python爬虫之urllib2使用指南

零基础写python爬虫之打包生成exe文件

零基础写python爬虫之爬虫编写全记录

零基础写python爬虫之使用urllib2组件抓取网页内容

零基础写python爬虫之urllib2中的两个重要概念：Openers和Handlers

零基础写python爬虫之抓取百度贴吧并存储到本地txt文件改进版

Python之Scrapy爬虫框架安装及简单使用详解