python之路day06--python2/3小区别,小数据池的概念,编码的进阶str转为bytes类型,编码和解码
python2
#print() print'abc'
#range() xrange()生成器
#raw_input() python3
# print('abc')
# range()
# input()
= 赋值
== 比较值是否相等
is 比较的是内存地址是否一致,返回True or False
id(内容) 返回内容
li1 =[1,2,3]
li2 =li1 #赋值
print(li1 is li2) #True
print(id(li1),id(li2))#48358464 48358464
小数据池
小数据池,也称为小整数缓存机制,或者称为驻留机制等等,博主认为,只要你在网上查到的这些名字其实说的都是一个意思,叫什么因人而异。
那么到底什么是小数据池?他有什么作用呢?
大前提:小数据池也是只针对 int(float),str,bool。
小数据池是针对不同代码块之间的缓存机制!!!
按数据类型划分
数字,字符串 ————> 小数据池的概念,在一定的范围内,共用一个内存地址,节省内存空间
数字的范围 -5-256
字符串:1/不能含有特殊字符
2/str*20 还是同一个地址,str*21 后都是两个地址
i1 =2
i2 =2
print(id(i1),id(i2)) #1779386016 1779386016 i1 =300
i2 =300
print(id(i1),id(i2)) #58219664 58219664 i1 =300
i2 =i1 #赋值运算地址是一样的
print(id(i1),id(i2)) # 51010704 51010704
剩下的list,dict,tuple,set 都不是一个地址,没有小数据池的概念
编码的进阶 str--bytes 类型
ascii A:00000010 8位 用一个字节来表示一个字母,字符 unicode A:00000010 00000001 00000010 00000010 32位 4个字节
中:00000010 00000001 00000010 00000010 32位 4个字节
utf-8 : A:00000010 8位 一个字节
中:00000010 00000001 00000010 24位 3个字节 gbk: A: 00000110 8位一个字节
中:00000010 00000110 16位2个字节 1/各个编码之间的二进制,是不能互相识别的,会产生乱码
2/文件的存储,传输,不能是unicode(只能是utff-8,gbk,ascii等)。因为unicode用4个字节表示一个字符,占用空间太大,传输慢。
py3:
文本 str在内存中是用unicdoe编码的。 bytes类型:也是一种数据类型,是一种特殊的。是以(utff-8,gbk,ascii等编码的)
str与bytes 方法都差不多,只是内存中编码不同。 对于英文:
str: 表现形式 s ='alex'
编码方式: 010101010 用的是unicode编码 bytes:表现形式:s = b'alex'
编码形式:010101010 用的是utff-8,gbk,ascii等编码的
ps: s ='alex'
s1 = b'alex'
print(type(s),type(s1)) #<class 'str'> <class 'bytes'>
对于中文:
str: 表现形式 s ='中国'
编码方式: 010101010 用的是unicode编码 bytes:表现形式:s = b'x\e91\e91\e01\e21\e31\e32' 中文显示不出来,所以不用bytes,用str
编码方式:010101010 用的是utff-8,gbk,ascii等编码的
ps: s ='中国'
s1 = '中国' #python3中bytes类型中文表示不出来。
print(type(s),type(s1)) #<class 'str'> <class 'bytes'>
encode编码,如何将str-->bytes类型,方便传输存储
s1 = 'alex'
s11 = s1.encode('utf-8') #可以设置编码方式
print(s11,type(s11)) #b'alex' <class 'bytes'> s2 = '中国'
s22 = s2.encode('utf-8')
print(s22,type(s22)) #b'\xe4\xb8\xad\xe5\x9b\xbd' <class 'bytes'>
字符转编码操作
unicode相当于一个中介,utf-8要转为GBK,要先decode('utf-8')解码成unicode(--告诉unicode你是什么编码--),后在encode('gbk')编码为GBK。
encode编码、decode解码

#str --->byte encode 编码
# s = '二哥'
# b = s.encode('utf-8')
# print(b)
# #byte --->str decode 解码
# s1 = b.decode('utf-8')
# print(s1)
# s = 'abf'
# b = s.encode('utf-8')
# print(b)
# #byte --->str decode 解码
# s1 = b.decode('gbk')
# print(s1)
python之路day06--python2/3小区别,小数据池的概念,编码的进阶str转为bytes类型,编码和解码的更多相关文章
- Python 3中的str和bytes类型
Python3 中的str和bytes类型 Python3最重要的新特性之一是:对字符串和二进制数据流做了明确的区分.文本总是Unicode,由str类型表示,二进制数据则由bytes类型表示.Pyt ...
- id,is的用法,小数据池的概念及编码知识进阶
一:id 查询内存地址 name = 'alex' print(id(name)) li = [1,2,3] print(id(li)) 二:is 判断的是内存地址 name1 = 'alex@' ...
- Python之路Day06
小数据池 == 判断两个值是否相等 is -- 是,判断两边的内存地址是否相同 a=10 b=10 print(a is b) id() -- 查看内存地址 代码块 一个py文件,一个函数,一个模块, ...
- Python str 与 bytes 类型(Python2/3 对 str 的处理)
本文均在 Python 3 下测试通过,python 2.x 会略有不同. 1. str/bytes >> s = '123' >> type(s) str >> ...
- Python2和3版本对str和bytes类型的处理
python2中字符串分为2种类型: 字节类型:str,字节类型,通过decode()转化为unicode类型 unicode类型:unicode ,通过encode转化为str字节类型 字节类型 和 ...
- 初学python之路-day06
每天一篇总结,今天学习了大概有深浅拷贝,元组类型,字典类型与集合类型.第一次感觉有点难度,需要花费多点时间来掌握. 深浅拷贝,分为值拷贝.浅拷贝.深拷贝. ls = [1, 'abc', [10]] ...
- Python之路第十一天,高级(3)-线程池
线程池 简单的线程池的实现: import queue import threading import time class ThreadPool(object): def __init__(self ...
- Python str 与 bytes 类型 之间的转换
bytes:字节数组,通常用它可以描述 “一个字符串”,只不过该字符串是 “bytes类型”,所以容易与str类型混淆,他们二者之间的转换: https://blog.csdn.net/lanchu ...
- python的小数据池和深浅拷贝
小数据池 一种数据缓存机制,也称驻留机制 在同一代码块,相同的值不会开辟新的内存 特殊字符除外 小数据池只针对:在控制台时! 数字 :-5到256间的整数会被缓存 布尔值:都会缓存8 字符串 小于等于 ...
随机推荐
- C# 一般处理程序ashx接收服务端post过来json数据
这个和前端js的接收方式有点不一样,前端接收用request.form["xxx"]即可
- 软件 利用 win+R 快速启动(无需添加环境变量)
前言:以 "Typora" 软件 为例 ,无需添加环境变量,实现键盘快速启动 第一步 找到 为知笔记的快捷方式 打开文件位置 鼠标右击该软件的桌面快捷方式 复制该软件的快捷方式 第 ...
- 【原】Java学习笔记011 - 数组
package cn.temptation; import java.util.Scanner; public class Sample01 { public static void main(Str ...
- docker容器日志收集方案(方案二 filebeat+syslog本地日志收集)
与方案一一样都是把日志输出到本地文件系统使用filebeat进行扫描采集 不同的是输出的位置是不一样的 我们对docker进行如下设置 sudo docker service update --lo ...
- PowerShell执行脚本时“系统上禁止运行脚本”问题解决
PowerShell执行脚本策略错误 错误信息:PowerShell运行脚本错误--"系统上禁止运行脚本" 原因:默认执行策略为Restricted 解决:执行Set-Execut ...
- 比较两个slice、struct或者map是否相等
我们可以直接使用reflect.DeepEqual来比较两个slice.struct或者map是否相等 package main import ( "fmt" "refl ...
- 【Linux基础】查看硬件信息-硬盘
一.基础知识 1.磁盘分区 磁盘的分区主要分为基本分区(primary partion)和扩充分区(extension partion)两种,基本分区和扩充分区的数目之和不能大于四个.且基本分区可以 ...
- Python开发【内置模块篇】os模块
1.当前路径及路径下的文件 os.getcwd():查看当前所在路径. >>> import os >>> os.getcwd() 'E:\\test' >& ...
- VMware Workstation中安装linux系统(CentOS)超详细(部分转载)
首先准备一下VMware虚拟机和linux镜像文件,链接如下: 对于32位windows机子安装的是10.0.7版本的VMware Workstation,链接: https://pan.baidu. ...
- leetcode 203. Remove Linked List Elements 、83. Remove Duplicates from Sorted List 、82. Remove Duplicates from Sorted List II(剑指offer57 删除链表中重复的结点)
203题是在链表中删除一个固定的值,83题是在链表中删除重复的数值,但要保留一个:82也是删除重复的数值,但重复的都删除,不保留. 比如[1.2.2.3],83题要求的结果是[1.2.3],82题要求 ...
