requests库和urllib包对比

python中有多种库可以用来处理http请求，比如python的原生库：urllib包、requests类库。urllib和urllib2是相互独立的模块，python3.0以上把urllib和urllib2合并成一个库了，requests库使用了urllib3。requests库的口号是“HTTP For Humans”，为人类使用HTTP而生，用起来不知道要比python原生库好用多少呢，比起urllib包的繁琐，requests库特别简洁和容易理解。话不多说，代码为证~~~

下面我们来分别使用urllib包和requests库写一个get请求，进行一下对比，如下图：

#-*- coding:utf8 -*-

import urllib2

import urllib

URL_GET = "https://api.douban.com/v2/event/list"

def use_params_urllib2():

    #构建请求参数

    params = urllib.urlencode({'loc':'','day_type':'weekend','type':'exhibition'})

    print 'Request Params:'

    print params

    #发送请求

    response = urllib2.urlopen('?'.join([URL_GET,'%s'])%params)

    #处理响应

    print '>>>>>>Response Headers:'

    print response.info()

    print 'Status Code:'

    print response.getcode()

    print'>>>>>>>Response Body:'

    print response.read()

if __name__ == '__main__':

    print 'Use params urllib2:'

    use_params_urllib2()

#-*- coding:utf8 -*-

import requests

URL_GET = "https://api.douban.com/v2/event/list"

def use_params_requests():

    #构建请求参数

    params = {'loc':'','day_type':'weekend','type':'exhibition'}

    #发送请求

    response = requests.get(URL_GET,params=params)

    #处理响应

    print '>>>>>>Response Headers:'

    print response.headers

    print '>>>>>>Status Code:'

    print response.status_code

    print'>>>>>>>Response Body:'

    print response.text

if __name__ == '__main__':

    print 'Use params requests:'

    use_params_requests()

第一种使用的是urllib包，第二种使用的是requests库，从以下几个方面进行对比：

1）构建参数：在构建请求参数时，第一种需要将请求参数使用urllib库的urlencode方法进行编码预处理，非常麻烦

2）请求方法：发送get请求时，第一种使用的urllib库的urlopen方法打开一个url地址，而第二种直接使用requests库的get方法，与http请求方式是对应的，更加直接、易懂

3）请求数据：第一种按照url格式去拼接一个url字符串，显然非常麻烦，第二种按顺序将get请求的url和参数写好就可以了

4）处理响应：第一种处理消息头部、响应状态码和响应正文时分别使用.info()、.getcode()、.read()方法，第二种使用.headers、.status_code、.text方法，方法名称与功能本身相对应，更方便理解、学习和使用

5）连接方式：看一下返回数据的头信息的“connection”，使用urllib库时，"connection":"close"，说明每次请求结束关掉socket通道，而使用requests库使用了urllib3，多次请求重复使用一个socket，"connection":"keep-alive"，说明多次请求使用一个连接，消耗更少的资源

6）编码方式：requests库的编码方式Accept-Encoding更全，在此不做举例

由此可见，requests库更容易理解和阅读，符合Python哲学“Readability counts”，可读性很重要~更利于开发人员学习和使用，那就让我们一起开启python-requests库的学习之旅吧~

PS：

1.requests库的官网是http://www.python-requests.org/en/master/，里面有操作文档

2.requests库的作者是一个来自欧洲的爱好摄影的小哥哥，名叫Kenneth Reitz，他的个人网站：https://www.kennethreitz.org/，里面有他的帅照哦哈哈哈

requests库和urllib包对比的更多相关文章

（爬虫）requests库
一.requests库简介 urllib库和request库的作用一样,都是服务器发起请求数据,但是requests库比urllib库用起来更方便,它的接口更简单,选用哪种库看自己. 如果没有安装过这 ...
requests库写接口测试框架初学习
学习网址: https://docs.microsoft.com/en-us/openspecs/windows_protocols/ms-dscpm/ff75b907-415d-4220-89 ...
网络爬虫入门：你的第一个爬虫项目（requests库）
0.采用requests库虽然urllib库应用也很广泛,而且作为Python自带的库无需安装,但是大部分的现在python爬虫都应用requests库来处理复杂的http请求.requests库语 ...
python爬虫（八） requests库之 get请求
requests库比urllib库更加方便,包含了很多功能. 1.在使用之前需要先安装pip,在pycharm中打开: 写入pip install requests命令,即可下载在github中有关 ...
urllib和requests库
目录 1. Python3 使用urllib库请求网络 1.1 基于urllib库的GET请求 1.2 使用User-Agent伪装后请求网站 1.3 基于urllib库的POST请求,并用Cooki ...
Python3 urllib库和requests库
1. Python3 使用urllib库请求网络 1.1 基于urllib库的GET请求请求百度首页www.baidu.com ,不添加请求头信息: import urllib.requests d ...
从0开始学爬虫10之urllib和requests库与github/api的交互
urllib库的使用 # coding=utf-8 import urllib2 import urllib # htpbin模拟的环境 URL_IP="http://10.11.0.215 ...
【Python爬虫】HTTP基础和urllib库、requests库的使用
引言: 一个网络爬虫的编写主要可以分为三个部分: 1.获取网页 2.提取信息 3.分析信息本文主要介绍第一部分,如何用Python内置的库urllib和第三方库requests库来完成网页的获取.阅 ...
Python使用urllib,urllib3,requests库+beautifulsoup爬取网页
Python使用urllib/urllib3/requests库+beautifulsoup爬取网页 urllib urllib3 requests 笔者在爬取时遇到的问题 1.结果不全 2.'抓取失 ...

随机推荐

JPA 注解详解
@Entity --声明为一个实体类bean @Table (name= "promotion_info" ) --为实体bean映射指定表(表名="promotion_ ...
java实现数组中两个元素相加等于指定数的所有组合
package com.algorithm.hash; public class alg1 { public static void main(String argv[]) { int[] arr ...
ORA-01940:无法删除当前已链接的用户
(1)查看用户的连接状况 select user name, sid, serial# from v$session; (2)找到要删除用户的sid,和serial,并删除例如要删除用户nc633t ...
js点击按钮获取验证码倒计时
//发送验证码倒计时 var clock = ''; var nums = 60; var btn; $("#btnGetVerCode").click(function () { ...
docker-compose之Nginx+Tomcat代理配置
Tomcat镜像制作与启动 Dockerfile如下 FROM docker.io/sssllc/centos7.-jdk1. #update RUN yum -y update; yum clean ...
c++ 流状态
这里是对cin中函数的作用的补充.
【NOI2002】荒岛野人
[题解] 可以枚举m 那么任意两个野人之间有 c[i]+x*p[i]=c[j]+x*p[j] (mod m) 无解,或 x 的最小值<=min(l[i] , l[j]) 化为丢番图方程:(p[ ...
PyV8在服务端运行自动崩溃问题
近来想在服务端架设WSGI + PyV8去自动解析JavaScript代码,然后返回解析后的数据给客户端.但是发现,在nginx配置后,客户端一请求,服务端的python脚本自动崩溃. 见代码: de ...
方向ajax(http long request实现实时通信)
现在我们就要通过这种方法来实现实时通信,先说一下原理: 客户端发起一个ajax长链接查询,然后服务端就开始执行代码,主要是检查某个文件是否被更新,如果没有,睡一会(sleep),醒来接着检查如果客户 ...
第一次C语言作业：博客随笔
1)你觉得大学和高中有什么差别?具体学习上哪? 大学自主学习较多,锻炼自己独立的品质.在学习上,增加了课程的深度和难度,由更多的活动. 2)我希望大学的师生关系是?阅读上述博客后对师生关系有何感想? ...

requests库和urllib包对比

requests库和urllib包对比的更多相关文章

随机推荐

热门专题