requests模块的高级用法

SSL Cert Verification

#证书验证(大部分网站都是https)

import requests

respone=requests.get('https://www.12306.cn') #如果是ssl请求,首先检查证书是否合法,不合法则程序终端报错

#改进1:去掉报错,但是会报警告

import requests

respone=requests.get('https://www.12306.cn',verify=False) #不验证证书,报警告,返回200

print(respone.status_code)

#改进2:去掉报错,并且去掉警报信息

import requests

from requests.packages import urllib3

urllib3.disable_warnings() #关闭警告

respone=requests.get('https://www.12306.cn',verify=False)

print(respone.status_code)

#改进3:加上证书

#很多网站都是https,但是不用证书也可以访问,大多数情况都是可以携带也可以不携带证书

#知乎\百度等都是可带可不带

#有硬性要求的,则必须带，比如对于定向的用户,拿到证书后才有权限访问某个特定网站

import requests

respone=requests.get('https://www.12306.cn',

                     cert=('/path/server.crt',

                           '/path/key'))

print(respone.status_code)

使用代理

#官网链接: http://docs.python-requests.org/en/master/user/advanced/#proxies

#代理设置:先发送请求给代理,然后由代理帮忙发送(封ip是常见的事情)

import requests

proxies={

    'http':'http://lary:123@localhost:9743',#带用户名密码的代理,@符号前是用户名与密码

    'http':'http://localhost:9743',

    'https':'https://localhost:9743',

}

respone=requests.get('https://www.12306.cn',

                     proxies=proxies)

print(respone.status_code)

#支持socks代理,安装:pip install requests[socks]

import requests

proxies = {

    'http': 'socks5://user:pass@host:port',

    'https': 'socks5://user:pass@host:port'

}

respone=requests.get('https://www.12306.cn',

                     proxies=proxies)

print(respone.status_code)

超时设置

timeout=0.1 #代表接收数据的超时时间

timeout=(0.1,0.2)  #0.1代表链接超时，0.2代表接收数据的超时时间

import requests

response = requests.get('https://www.baidu.com',

                        timeout=0.0001)

认证设置

　　登陆网站时，弹出一个框，要求输入用户名密码（与alert很类似），此时是无法获取html的，但本质原理是拼接成请求头发送

r.headers['Authorization']=_basic_auth_str(self.username,self.password)

　　一般的网站都不用默认的加密方式，都是自己写，那么我们就需要按照网站的加密方式，自己写一个类似于_basic_auth_str的方法，得到机密字符串后添加到请求头

r.headers['Authorization']=_func('.....')

　　默认的加密方式

import requests

from requests.auth import HTTPBasicAuth

r = requests.get('xxx',auth=HTTPBasicAuth('user','password'))

print(r.status_code)

　　HTTPBasicAuth可以简写为如下格式

import requests

r = requests.get('xxx',auth=('user','password'))

print(r.status_code)

异常处理

import requests

from requests.exceptions import *

try:

    r = requests.get('http://www.baidu.com',timeout=0.00001)

# except ReadTimeout:

#     print('1111111111111111111111111111111111111111111readtimeout')

# except Timeout:

#     print('11111timeout')

# except ConnectionError:

#     print('ConnectionError')

except RequestException:

    print('Error')

上传文件

import requests

files = {'file':open('a.jpg','rb')}

response = requests.post('http://httpbin.org/post',files=files)

print(response.status_code)

requests模块的高级用法的更多相关文章

爬虫 requests模块的其他用法抽屉网线程池回调爬取+保存实例,gihub登陆实例
requests模块的其他用法 #通常我们在发送请求时都需要带上请求头,请求头是将自身伪装成浏览器的关键,常见的有用的请求头如下 Host Referer #大型网站通常都会根据该参数判断请求的来源 ...
Python中第三方库Requests库的高级用法详解
Python中第三方库Requests库的高级用法详解虽然Python的标准库中urllib2模块已经包含了平常我们使用的大多数功能,但是它的API使用起来让人实在感觉不好.它已经不适合现在的时代, ...
requests模块的基本用法
requests 什么是requests模块 python中封装好的一个基于网络请求的模块作用用来模拟浏览器发送请求环境安装 pip install requests 编码流程指定 url 发 ...
5.爬虫 requests库讲解高级用法
0.文件上传 import requests files = {'file': open('favicon.ico', 'rb')} response = requests.post("ht ...
爬虫（1）：requests模块
requests介绍: reqeusts模块:python原生一个基于网络请求的模块,模拟浏览器发起请求. requests模块的优点: - 1.自动处理url编码 - 2.自动处理post请求的参数 ...
全程干货，requests模块与selenium框架详解
requests模块前言: 通常我们利用Python写一些WEB程序.webAPI部署在服务端,让客户端request,我们作为服务器端response数据: 但也可以反主为客利用Python的re ...
爬虫 requests模块高级用法
一介绍 #介绍:使用requests可以模拟浏览器的请求,比起之前用到的urllib,requests模块的api更加便捷(本质就是封装了urllib3) #注意:requests库发送请求将网页内 ...
Python之Requests的高级用法
# 高级用法本篇文档涵盖了Requests的一些更加高级的特性. ## 会话对象会话对象让你能够跨请求保持某些参数.它也会在同一个Session实例发出的所有请求之间保持cookies. 会话对象 ...
Requests库的文档高级用法
高级用法本篇文档涵盖了 Requests 的一些高级特性. 会话对象会话对象让你能够跨请求保持某些参数.它也会在同一个 Session 实例发出的所有请求之间保持 cookie, 期间使用 url ...

随机推荐

WebStorm 配置 svn
1.下载 SlikSVN. 2.安装.路径 D:\Program Files\slik\bin. 3.在WebStorm中配置 file->settings->Version Co ...
nyoj28-大数阶乘
大数阶乘时间限制:3000 ms | 内存限制:65535 KB 难度:3 描述我们都知道如何计算一个数的阶乘,可是,如果这个数很大呢,我们该如何去计算它并输出它? 输入输入一个整数m(0& ...
luogu 3768 简单的数学题 (莫比乌斯反演+杜教筛)
题目大意:略洛谷传送门杜教筛入门题? 以下都是常规套路的变形,不再过多解释 $\sum\limits_{i=1}^{N}\sum\limits_{j=1}^{N}ijgcd(i,j)$ $\sum ...
[poj 3318] Matrix Multiplication （随机化+矩阵）
Description You are given three n × n matrices A, B and C. Does the equation A × B = C hold true? In ...
Python - def 函数
1.def 函数如果我们用代码实现了一个小功能,但想要在程序代码中重复使用,不能在代码中到处粘贴这些代码,因为这样做违反了软件工程中 DRY原则. Python 提供了函数功能,可以将我们这部分功 ...
log4j输出多个自定义日志文件，动态配置路径
Log4J的配置文件(Configuration File)就是用来设置记录器的级别.存放器和布局的,它可接key=value格式的设置或xml格式的设置信息.通过配置,可以创建出Log4J的运行环境 ...
POJ 1284
想了很久,只想到枚举的方法,估计会超时吧. 原来有这样一条性质:p为素数,则p有phi(p-1)个原根 Orz... #include <iostream> #include <cs ...
[Tailwind] Create Custom Utility Classes in Tailwind
In this lesson, we learn how to generate custom utility classes in tailwind. We add new properties t ...
JSP页面标签
1.EL表达式中empty的用法 EL表达式中empty的用法 <c:if test="${! empty key}">${key}</c:if> < ...
MFC exe使用C++ dll中的std::string 崩溃
VC6中 MFC exe中 new 纯C++ dll dll 崩溃我把纯C++的 dll,用/MTd 换成/MDd.就能够了

requests模块的高级用法

SSL Cert Verification

使用代理

超时设置

认证设置

异常处理

上传文件

requests模块的高级用法的更多相关文章

随机推荐

热门专题