python3中的urllib.parse的常用方法

将URL按一定的格式进行拆分

使用 urllib.parse.urlparse将url分为6个部分，返回一个包含6个字符串项目的元组：协议、位置、路径、参数、查询、片段

参照官方地址：https://docs.python.org/3/library/urllib.parse.html

import urllib.parse

#urlparse将url分为6个部分

url ="https://i.cnblogs.com/EditPosts.aspx?opt=1"

url1 = "cheme://netloc/path;parameters?query#fragment"

url_change = urllib.parse.urlparse(url)

print(url_change)

输出结果为：

ParseResult(scheme='https', netloc='i.cnblogs.com', path='/EditPosts.aspx', params='', query='opt=1', fragment='')

其中 scheme 是协议 netloc 是域名服务器 path 相对路径 params是参数，query是查询的条件

使用 urllib.parse.urlsplit 将url分为5个部分，返回一个包含字符串项目的元组：协议、位置、路径、查询、片段

 import urllib.parse

 #urlsplit将url分为5个部分

 url ="https://i.cnblogs.com/EditPosts.aspx?opt=1"

 url_change = urllib.parse.urlsplit(url)

 print(url_change)

输出结果为：

ParseResult(scheme='https', netloc='i.cnblogs.com', path='/EditPosts.aspx',query='opt=1', fragment='')

其中 scheme 是协议 netloc 是域名服务器 path 相对路径，query是查询的条件

对URL按照一定的规格进行拼接

使用 urllib.parse.urljoin将相对的一个地址组合成一个url，对于输入没有限制，开头必须是http://或者https://，否则将不组合前面的部分。

 import urllib.parse

 host = "https://127.0.0.1"

 #host ="127.0.0.1"

 port = ""

 new_url = urllib.parse.urljoin(host,port)

 print(new_url)

输出结果为：

　　https://127.0.0.1/8888

如果 host ="127.0.0.1"，则输出的只是： 8888

parse_qs 有几种实现

urllib.parse.parse_qs 返回字典
urllib.parse.parse_qsl 返回列表

import urllib.parse

#urlparse将url分为6个部分

url ="https://i.cnblogs.com/EditPosts.aspx?opt=1"

url_change = urllib.parse.urlparse(url) # 将url拆分为6个部分

query = url_change.query #取出拆分后6个部分中的查询模块query

lst_query = urllib.parse.parse_qsl(query)  #使用parse_qsl返回列表

dict1 =dict(lst_query)  #将返回的列表转换为字典

dict_query =urllib.parse.parse_qs(query)  #使用parse_qs返回字典

print("使用parse_qsl返回列表  ：",lst_query)

print("将返回的列表转换为字典 ：",dict1)

print("使用parse_qs返回字典   : ",dict_query)

# data = "test=test&test2=test2&test2=test3"

# print(urllib.parse.parse_qsl(data)) #返回列表

# print(urllib.parse.parse_qs(data))  #返回字典

python3中的urllib.parse的常用方法的更多相关文章

Python2中的urllib、urllib2和 Python3中的urllib、requests
目录 Python2.x中 urllib和urllib2 常用方法和类 Python3.x中 urllib requests Python2.x中 urllib和urllib2 urllib 和 ur ...
详解：Python2中的urllib、urllib2与Python3中的urllib以及第三方模块requests
在python2中,urllib和urllib2都是接受URL请求的相关模块,但是提供了不同的功能.两个最显著的不同如下: 1.urllib2可以接受一个Request类的实例来设置URL请求的hea ...
Python3中使用urllib的方法详解(header,代理,超时,认证,异常处理)_python
我们可以利用urllib来抓取远程的数据进行保存哦,以下是python3 抓取网页资源的多种方法,有需要的可以参考借鉴. 1.最简单 import urllib.request response = ...
在python3中使用urllib.request编写简单的网络爬虫
转自:http://www.cnblogs.com/ArsenalfanInECNU/p/4780883.html Python官方提供了用于编写网络爬虫的包 urllib.request, 我们主要 ...
Python3中使用urllib的方法详解(header,代理,超时,认证,异常处理)
出自 http://www.jb51.net/article/93125.htm
python3中urllib的基本使用
urllib 在python3中,urllib和urllib2进行了合并,现在只有一个urllib模块,urllib和urllib2的中的内容整合进了urllib.request,urlparse整合 ...
urllib.parse.quote
sklearn实战-乳腺癌细胞数据挖掘(博主亲自录制视频) https://study.163.com/course/introduction.htm?courseId=1005269003& ...
Python 的 urllib.parse 库解析 URL
Python 中的 urllib.parse 模块提供了很多解析和组建 URL 的函数. 解析url urlparse() 函数可以将 URL 解析成 ParseResult 对象.对象中包含了六 ...
Python爬虫之urllib.parse详解
Python爬虫之urllib.parse 转载地址 Python 中的 urllib.parse 模块提供了很多解析和组建 URL 的函数. 解析url 解析url( urlparse() ) ur ...

随机推荐

2.2使用urllib的简单传输
使用urllib传输文件 from urllib.request import urlopen filename = 'new_1.py' password = 'password' #如果设置密码 ...
Codeforces Round #309 (Div. 1) A（组合数学）
题目:http://codeforces.com/contest/553/problem/A 题意:给你k个颜色的球,下面k行代表每个颜色的球有多少个,规定第i种颜色的球的最后一个在第i-1种颜色的球 ...
Hide Data into bitmap with ARGB8888 format
将保存重要信息,如银行卡密码的文本文件隐藏到ARGB8888的A通道. bitmap.h #ifndef BMP_H #define BMP_H #include <fstream> #i ...
«面向对象程序设计（java）»第三周学习总结周强 201771010141
实验目的与要求 (1)进一步掌握Eclipse集成开发环境下java程序开发基本步骤: (2)熟悉PTA平台线上测试环境: (3)掌握Java语言构造基本程序语法知识(ch1-ch3): (4)利用已 ...
Locust 参数化
概述: 和Loadrunner一样对于多用户并发时,重复登入或者数据的重复使用会造成脚本的失败,那么我们引入Loadrunner的参数化概念,对用户数据进行参数化来使脚本运行成功. 头绪: use ...
JUnit4测试报错：class not found XXX
初学java框架,最近用eclipse跟着视频坐淘淘商城这个项目,其中使用了JUnit4做单元测试.当运行测试代码时,项目报错:class not found xxx. 借助了其他大神的博客,论坛等 ...
ubuntu 16.04 更换源
进入/etc/apt/ cd /etc/apt 在修改前先对 sources.list文件进行备份 sudo cp sources.list sources.list.bak 修改sources.li ...
mysql命令行使用
连接数据库 mysql -P 端口号 -h 远程机地址/ip -u 用户名 -p mysql -uroot -p123456 修改数据库密码 mysqladmin -uroot -p123456 ...
I think I need a boat house
I think I need a boat house. Fred Mapper is considering purchasing some land in Louisiana to build h ...
前端基础----CSS语法、CSS四种引入方式、CSS选择器、CSS属性操作
一.CSS语法 CSS 规则由两个主要的部分构成:选择器,以及一条或多条声明. 例如: h1 {color:red; font-size:14px;} 二.CSS四种引入方式 1,行内式行内式是在标 ...