写在前面:

好久没有登录博客了,意外看到之前的几篇文章都有不错的阅读量,开心极了,不过没有什么点赞和评论,大概是没有给大家带来什么切实的帮助吧。o(*////▽////*)q。

最近在NTU负责一个国家研究基金委支持的智能城市交通的项目,第一步就是获取道路交通各种信息,收集分析数据。因为各种原因这次选择了Scrapy这个框架,也是我自己第一次接触python爬虫,圆满完成需求数据爬取之后,我在四台电脑上搭建了Scrapy环境,遇到了各种各样的问题,借此写一篇总结,也希望能够给大家提供一丝丝的帮助,更希望能帮助大家,流畅的搭建完成。

———————————————————————————————————————————————————————————

一、安装python

根据自己的需求,到官网下载适合自己电脑的版本,https://www.python.org/downloads/,这里我选择的是较为稳定的2.7版本

链接: http://pan.baidu.com/s/1i5hZPS5%20 密码: e6qi

安装过程十分简单,除了选择路径,一路next到底即可。完成之后,别忘将python添加到环境变量里。

点击“我的电脑”右键“属性”,进入到如下界面,左上角选择“高级系统设置”:

弹出一个对话框,在对话框里找到并选择“环境变量”选项,进入之后,下方找到“path”,之后编辑,用 ; 隔开,插入安装python的文件路径,这里为了之后安装方便,也将python下的script路径给添加进来。

                          

添加到环境变量之后,打开命令行,输入,python,如果出现如下界面则安装成功,如果显示不是内部外部命令,回去检查环境变量设置环节。很大可能是误输入中文输入法之下的;检查一遍,修改之后,重启命令行再输入一遍。

二、安装pywin32

在Windows下,必须安装pywin32,下载地址:https://sourceforge.net/projects/pywin32/,链接: http://pan.baidu.com/s/1hsmL92W 密码: 3qnf

安装过程也很简单,一路next到底,安装完毕之后在命令行先输入python,之后输入import win32com验证:

如图所示,如果没有提示错误,则证明安装成功,如果错误就再来一遍,这个步骤一般不会出现问题。

三、安装pip

pip是一个安装和管理python包的工具,可以替代easy_install。下载地址:https://bootstrap.pypa.io/get-pip.pyhttp://pan.baidu.com/s/1dFKbFP3%20 密码:m3ar

打开命令行进入到保存get-pip的路径进行操作,可以用cd的命令,也可以shift+右键选择用命令行打开。然后键入:

python get-pip.py

即可

安装完成后在命令行输入

pip --version 

显示即安装成功

四、安装pyOPENSSL

在Windows下,是没有预装pyOPENSSL的,而在Linux下是已经安装好的。

安装地址:https://launchpad.net/pyopenssl 或 http://pan.baidu.com/s/1hrXS4Fa 密码:25pd

下载后,双击,一路next就可以。

五、安装 lxml

lxml是一种使用 Python 编写的库,可以迅速、灵活地处理 XML

直接执行如下命令

pip install lxml

然后,我们迎来了一个大坑,这里可能会报各种错,比较常见的:

1.报错说电脑没有匹配的 Microsoft Visual C++库,点击官网下载安装,点击网盘下载安装,密码:37h2。安装完成后重启命令行再次执行上述命令

2.报其他乱七八糟的错,或者上述库安装完成以后依旧不成功。这个时候可以尝试

easy_install lxml

或者,下载集成的安装包,直接双击一路next安装。如果还是不行,一个屡试不爽的方法,下载lxml.wheel文件。然后在wheel目录下键入

pip install lxml-3.6.4-cp27-cp27m-win_amd64.whl

六、安装Scrapy框架

在命令行下

pip install Scrapy

安装完毕后,在命令行输入Scrapy,如果显示如下图所示,则安装成功:

七、编译程序的时候发现,经常报告缺失lib2,所以这里附上安装httplib2的方法

下载,然后解压,在httolib2目录下,pip install httplib2 即可。

————————————————————————————————————————————————————————————

如果还有其他问题,欢迎留言讨论交流。

Win7下python Scrapy一站式搭建全攻略(内附相关下载链接)的更多相关文章

  1. Win7下Python WEB环境搭建

    环境介绍: Win7 64位 SP1 Python:2.7.6 网关接口:flup Nginx安装:http://blog.csdn.net/jacson_bai/article/details/46 ...

  2. python——创建django项目全攻略(野生程序员到家养程序员的完美进化)

    新建工程 我用pycharm写代码,所以一般就用pycharm创建django工程.右上角File-New Project.选择路径,修改项目名称,确定.就可以创建一个新的django工程.     ...

  3. Ambari HDP集群搭建全攻略

    世界上最快的捷径,就是脚踏实地,本文已收录[架构技术专栏]关注这个喜欢分享的地方. 最近因为工作上需要重新用Ambari搭了一套Hadoop集群,就把搭建的过程记录了下来,也希望给有同样需求的小伙伴们 ...

  4. Linux下Makefile的automake生成全攻略--转

    http://www.yesky.com/120/1865620.shtml 作为Linux下的程序开发人员,大家一定都遇到过Makefile,用make命令来编译自己写的程序确实是很方便.一般情况下 ...

  5. Linux下Makefile的automake生成全攻略

    作为Linux下的程序开发人员,大家一定都遇到过Makefile,用make命令来编译自己写的程序确实是很方便.一般情况下,大家都是手工写一个简单Makefile,如果要想写出一个符合自由软件惯例的M ...

  6. 21天速成python电子书pdf|超级厉害的书内附百度云链接可直接下载|

    python的学习书籍小编看过很多,但是这本<21天学通python>真的是堪称极品!本书的作者团队成员为一线开发工程师.资深编程专家或专业培训师,在编程开发方面有着丰富的经验,并已出版过 ...

  7. win7下android开发环境搭建(win7 64位)

    win7下android开发环境搭建(win7 64位)   一.安装 JDK 下载JDK最新版本,下载地址如下: http://www.oracle.com/technetwork/java/jav ...

  8. Python 自动化测试全攻略:五种自动化测试模型实战详解

    随着移动互联网的发展,软件研发模型逐步完善,软件交付质量越来越受到软件公司的重视,软件测试技术特别是自动化测试技术开始在软件系统研发过程中发挥着越来越重要的作用. 与传统的手工测试技术相比,自动化测试 ...

  9. fiddler Android下https抓包全攻略

    fiddler Android下https抓包全攻略 fiddler的http.https的抓包功能非常强大,可非常便捷得对包进行断点跟踪和回放,但是普通的配置对于像招商银行.支付宝.陌陌这样的APP ...

随机推荐

  1. How to:installshield安装包怎样才能出现选择路径的界面?

    原文:How to:installshield安装包怎样才能出现选择路径的界面? 这个问题新手问的很多,installshield的安装包默认设置下选择路径的界面藏在Custom安装类型下.在做完安装 ...

  2. Linux C语言操作MySQL

    原文:Linux C语言操作MySQL 1.MySQL数据库简介 MySQL是一个开源码的小型关系数据库管理系统,体积小,速度快,总体成本低,开源.MySQL有以下特性: (1) 使用C和C++编写, ...

  3. SQL点滴21—几个有点偏的语句

    原文:SQL点滴21-几个有点偏的语句 SQL语句是一种集合操作,就是批量操作,它的速度要比其他的语言快,所以在设计的时候很多的逻辑都会放在sql语句或者存储过程中来实现,这个是一种设计思想.但是今天 ...

  4. 02.零成本实现WEB性能测试-基于APACHE JMETER

    书评: 1.这本是介绍性能测试工具Jmeter的书籍,维度还够,但是粒度太粗. 2.对于想快速了解JMeter的使用和工具的原件使用,还是有一定的参考价值. 3.实际上,这本书可用来快速入门,掌握和了 ...

  5. [代码收藏]设为首页和加入收藏的JavaScript代码(兼容多浏览器)

    其实不少非IE内核浏览器都仍不支持通过代码将网页设为主页和加入收藏的功能,因此说是兼容,其实只是一个try,catch后的提醒而已. 加入收藏: /* * author : 2010-12-27 11 ...

  6. .net中,控件(Name)属性或ID属性的常见命名规则

    控件名称 缩写 介绍 公共控件   Button btn 按钮 CheckBox chk 复选框 CheckedListBox ckl 显示一个项列表,其中每一项左侧都有一个复选框 ComboBox ...

  7. String的使用

    String的常用方法 方法 说明 Anchor() 创建html锚 Concat() 把字符串连接起来 indexOf() 查找字符出现的位置 lastIndexOf() 查找最后出现字符 char ...

  8. Http Pipeline详细分析(下)

    Http Pipeline详细分析(下) 文章内容 接上面的章节,我们这篇要讲解的是Pipeline是执行的各种事件,我们知道,在自定义的HttpModule的Init方法里,我们可以添加自己的事件, ...

  9. Markdown 代码测试

    Mou Overview Mou, the missing Markdown editor for web developers. Syntax Strong and Emphasize strong ...

  10. 网络地址到物理地址的映射(ARP)

    网络的互连首先要解决的问题就是网络地址到物理地址的映射,以太网接口分配的是一个48位的物理地址,而IP地址却只有32位,因此无法将它编码到IP地址中.有人建议可以构建一个中央数据库存储所有网络中的网络 ...