python3中的urllib.parse的常用方法

将URL按一定的格式进行拆分

使用 urllib.parse.urlparse将url分为6个部分，返回一个包含6个字符串项目的元组：协议、位置、路径、参数、查询、片段

参照官方地址：https://docs.python.org/3/library/urllib.parse.html

import urllib.parse

#urlparse将url分为6个部分

url ="https://i.cnblogs.com/EditPosts.aspx?opt=1"

url1 = "cheme://netloc/path;parameters?query#fragment"

url_change = urllib.parse.urlparse(url)

print(url_change)

输出结果为：

ParseResult(scheme='https', netloc='i.cnblogs.com', path='/EditPosts.aspx', params='', query='opt=1', fragment='')

其中 scheme 是协议 netloc 是域名服务器 path 相对路径 params是参数，query是查询的条件

使用 urllib.parse.urlsplit 将url分为5个部分，返回一个包含字符串项目的元组：协议、位置、路径、查询、片段

 import urllib.parse

 #urlsplit将url分为5个部分

 url ="https://i.cnblogs.com/EditPosts.aspx?opt=1"

 url_change = urllib.parse.urlsplit(url)

 print(url_change)

输出结果为：

ParseResult(scheme='https', netloc='i.cnblogs.com', path='/EditPosts.aspx',query='opt=1', fragment='')

其中 scheme 是协议 netloc 是域名服务器 path 相对路径，query是查询的条件

对URL按照一定的规格进行拼接

使用 urllib.parse.urljoin将相对的一个地址组合成一个url，对于输入没有限制，开头必须是http://或者https://，否则将不组合前面的部分。

 import urllib.parse

 host = "https://127.0.0.1"

 #host ="127.0.0.1"

 port = ""

 new_url = urllib.parse.urljoin(host,port)

 print(new_url)

输出结果为：

　　https://127.0.0.1/8888

如果 host ="127.0.0.1"，则输出的只是： 8888

parse_qs 有几种实现

urllib.parse.parse_qs 返回字典
urllib.parse.parse_qsl 返回列表

import urllib.parse

#urlparse将url分为6个部分

url ="https://i.cnblogs.com/EditPosts.aspx?opt=1"

url_change = urllib.parse.urlparse(url) # 将url拆分为6个部分

query = url_change.query #取出拆分后6个部分中的查询模块query

lst_query = urllib.parse.parse_qsl(query)  #使用parse_qsl返回列表

dict1 =dict(lst_query)  #将返回的列表转换为字典

dict_query =urllib.parse.parse_qs(query)  #使用parse_qs返回字典

print("使用parse_qsl返回列表  ：",lst_query)

print("将返回的列表转换为字典 ：",dict1)

print("使用parse_qs返回字典   : ",dict_query)

# data = "test=test&test2=test2&test2=test3"

# print(urllib.parse.parse_qsl(data)) #返回列表

# print(urllib.parse.parse_qs(data))  #返回字典

python3中的urllib.parse的常用方法的更多相关文章

Python2中的urllib、urllib2和 Python3中的urllib、requests
目录 Python2.x中 urllib和urllib2 常用方法和类 Python3.x中 urllib requests Python2.x中 urllib和urllib2 urllib 和 ur ...
详解：Python2中的urllib、urllib2与Python3中的urllib以及第三方模块requests
在python2中,urllib和urllib2都是接受URL请求的相关模块,但是提供了不同的功能.两个最显著的不同如下: 1.urllib2可以接受一个Request类的实例来设置URL请求的hea ...
Python3中使用urllib的方法详解(header,代理,超时,认证,异常处理)_python
我们可以利用urllib来抓取远程的数据进行保存哦,以下是python3 抓取网页资源的多种方法,有需要的可以参考借鉴. 1.最简单 import urllib.request response = ...
在python3中使用urllib.request编写简单的网络爬虫
转自:http://www.cnblogs.com/ArsenalfanInECNU/p/4780883.html Python官方提供了用于编写网络爬虫的包 urllib.request, 我们主要 ...
Python3中使用urllib的方法详解(header,代理,超时,认证,异常处理)
出自 http://www.jb51.net/article/93125.htm
python3中urllib的基本使用
urllib 在python3中,urllib和urllib2进行了合并,现在只有一个urllib模块,urllib和urllib2的中的内容整合进了urllib.request,urlparse整合 ...
urllib.parse.quote
sklearn实战-乳腺癌细胞数据挖掘(博主亲自录制视频) https://study.163.com/course/introduction.htm?courseId=1005269003& ...
Python 的 urllib.parse 库解析 URL
Python 中的 urllib.parse 模块提供了很多解析和组建 URL 的函数. 解析url urlparse() 函数可以将 URL 解析成 ParseResult 对象.对象中包含了六 ...
Python爬虫之urllib.parse详解
Python爬虫之urllib.parse 转载地址 Python 中的 urllib.parse 模块提供了很多解析和组建 URL 的函数. 解析url 解析url( urlparse() ) ur ...

随机推荐

PHP有关守护进程，以及流程控制和信号处理函数
守护进程(Daemon)是运行在后台的一种特殊进程.它独立于控制终端并且周期性地执行某种任务或等待处理某些发生的事件.守护进程是一种很有用的进程.PHP也可以实现守护进程的功能. 1.基本概念进程 ...
ubuntu14.04, Cloudera Manager 5.11.1, cdh5.11.1 postgresql离线部署
最近一段时间团队接到的项目需要处理的数据量非常大,之前的处理方式难以满足现有需求.最近两周前前后后折腾了不少,在搭建了hadoop+hbase+hive+spark的一个集群后,由于感觉管理和监控太麻 ...
format格式化和函数
{[name][:][[fill]align][sign][#][0][width][,][.precision][type]}用{ }包裹name命名传递给format以命名=值写法, 非字典映射 ...
jq demo 九宫格抽奖
<!DOCTYPE HTML> <html> <head> <meta http-equiv="Content-Type" content ...
GitHub入门与实践读书笔记一：欢迎来到GitHubde世界
1.什么是GitHub GitHubshi为开发者提供Git仓库的托管服务.除此之外,还为开发者提供能帮助提高代码效率和品质的功能. GitHub和Git的区别? Git是源码仓库而GitHub是在网 ...
[IntelliJ IDEA入门] 新建一个Java项目
新建一个Project 是否有JDK配置选择JavaEE 点击Next 项目路径和文件 .idea (directory based) 创建项目的时候自动创建一个 .idea 的项目配置目录来保存项 ...
php源码学习——开篇
这个系列是对php源码的学习记录.由于本人水平有限,可能并不能写的非常清晰和深入,所以,可能只适合本人阅读:) 初次接触php源码,看到陌生的文件夹和大量的文件,可能会觉得茫然无措.php-inter ...
2019-04-10-day029-粘包处理
内容回顾 osi五层协议不是真实存在的,只是抽象出来的模型应用层传输层 TCP/UDP TCP :全双工,可靠的,面向连接的,速度慢,对数据大小没有限制建立连接 :三次握手 SYN ACK 断 ...
centos7.3 64位安装git
1.安装编译git时需要的包 # yum install curl-devel expat-devel gettext-devel openssl-devel zlib-devel # yum ins ...
smartgit的安装
smartgit是非常好用的一个图形化git工具,有Ubuntu版本的,直接去官网下载即可,但使用smartgit要求先jre. 直接去官网上下载jre:https://www.java.com/zh ...