欢迎关注公众号【Python开发实战】, 获取更多内容!

工具-numpy

numpy是使用Python进行数据科学的基础库。numpy以一个强大的N维数组对象为中心,它还包含有用的线性代数,傅里叶变换和随机数函数。

一维ndarray

导入numpy

import numpy as np

一维ndarray的访问和常规的Python数组类似。

a = np.array([1, 5, 3, 19, 13, 7, 3])
a[3]

输出:

19
a[2:5]

输出:

array([ 3, 19, 13])
a[2:-1]

输出:

array([ 3, 19, 13,  7])
a[:2]

输出:

array([1, 5])
a[2::2]

输出:

array([ 3, 13,  3])
a[::-1]

输出:

array([ 3,  7, 13, 19,  3,  5,  1])

当然,也可以修改ndarray的元素。

a[3] = 999
a

输出:

array([  1,   5,   3, 999,  13,   7,   3])

也可以修改一个ndarray的切片。

a[2:5] = [997, 998, 999]
a

输出:

array([  1,   5, 997, 998, 999,   7,   3])

与常规数组的区别

与常规Python数组相反,如果将一个值赋给一个ndarray切片,则整个切片里的元素都会被赋值为这个值,这是由于广播机制。

a[2:5] = -1
a

输出:

array([ 1,  5, -1, -1, -1,  7,  3])

另外,不能以这种方式增加或缩小ndarray。

try:
a[2:5] = [1, 2, 3, 4, 5, 6]
except ValueError as e:
print(e)

输出:

cannot copy sequence with size 6 to array axis with dimension 3

也不能删除元素。

try:
del a[2:5]
except ValueError as e:
print(e)

输出:

cannot delete array elements

值得注意的是,ndarray切片实际上是同一数据缓冲区上的视图。这就意味着,如果创建一个切片并对其进行修改,也将会修改原始的ndarray。

a_slice = a[2:6]
a_slice[1] = 1000
a # 原始ndarray也被修改!

输出:

array([   1,    5,   -1, 1000,   -1,    7,    3])
a[3] = 2000
a_slice # 修改切片也会修改原始ndarray!

输出:

array([  -1, 2000,   -1,    7])

如果想复制ndarray的数据,需要使用copy方法。

another_slice = a[2:6].copy()
another_slice[1] = 3000
a # 原始ndarray不变

输出:

array([   1,    5,   -1, 2000,   -1,    7,    3])
a[3] = 4000
another_slice # 修改原始ndarray不会影响切片的副本

输出:

array([  -1, 3000,   -1,    7])

多维ndarray

多维ndarray的访问也是类似的方式,通过为每个轴提供索引或切片的形式,不同轴之间的索引或切片用逗号分隔。

b = np.arange(48).reshape(4, 12)
b

输出:

array([[ 0,  1,  2,  3,  4,  5,  6,  7,  8,  9, 10, 11],
[12, 13, 14, 15, 16, 17, 18, 19, 20, 21, 22, 23],
[24, 25, 26, 27, 28, 29, 30, 31, 32, 33, 34, 35],
[36, 37, 38, 39, 40, 41, 42, 43, 44, 45, 46, 47]])
b[1, 2]   # 第1行 第2列

输出:

14
b[1, :]  # 第1行的所有列元素

输出:

array([12, 13, 14, 15, 16, 17, 18, 19, 20, 21, 22, 23])
b[:, 1]   # 第1列的所有行元素

输出:

array([ 1, 13, 25, 37])

注意!注意下面两个结果间的细微差别。

b[1, :]

输出:

array([12, 13, 14, 15, 16, 17, 18, 19, 20, 21, 22, 23])
b[1:2, :]

输出:

array([[12, 13, 14, 15, 16, 17, 18, 19, 20, 21, 22, 23]])

第一个结果是将第1行作为一个形状为(12,)的一维数组返回,第二个结果是将第1行作为形状为(1,12)的二维数组返回。

花式索引

还可以指定感兴趣的索引列表,被称为花式索引。

b[(0, 2), 2:5]

输出:

array([[ 2,  3,  4],
[26, 27, 28]])
b[:, (-1, 2, -1)]

输出:

array([[11,  2, 11],
[23, 14, 23],
[35, 26, 35],
[47, 38, 47]])

如果提供多个索引数组,将会得到一个一维ndarray,其中包含指定坐标处元素的值。

b[(-1, 2, -1, 2), (5, 9, 1, 9)]   # 返回由b[-1, 5] b[2, 9] b[-1, 1] b[2, 9]组成的一维数组

输出:

array([41, 33, 37, 33])

更高维数组

对于更高维数组,上面的索引方式也满足。

c = b.reshape(4, 2, 6)
c

输出:

array([[[ 0,  1,  2,  3,  4,  5],
[ 6, 7, 8, 9, 10, 11]], [[12, 13, 14, 15, 16, 17],
[18, 19, 20, 21, 22, 23]], [[24, 25, 26, 27, 28, 29],
[30, 31, 32, 33, 34, 35]], [[36, 37, 38, 39, 40, 41],
[42, 43, 44, 45, 46, 47]]])
c[2, 1, 4]

输出:

34
c[2, :, 3]

输出:

array([27, 33])

如果省略某些轴的坐标,则会返回这些轴中的所有元素。

c[2, 1]

输出:

array([30, 31, 32, 33, 34, 35])

省略号

也可以使用一个省略号...,表示将所有未指定的轴的元素全部包含在内。

c[2, ...]   # 相当于c[2, :, :]

输出:

array([[24, 25, 26, 27, 28, 29],
[30, 31, 32, 33, 34, 35]])
c[2, 1, ...]   # 相当于c[2, 1, :]

输出:

array([30, 31, 32, 33, 34, 35])
c[2, ..., 3]    # 相当于c[2, :, 3]

输出:

array([27, 33])
c[..., 3]   # 相当于c[:, :, 3]

输出:

array([[ 3,  9],
[15, 21],
[27, 33],
[39, 45]])

布尔索引

还可以在一个轴上提供一系列布尔值,来指定要访问的索引。

d = np.arange(48).reshape(4, 12)
d

输出:

array([[ 0,  1,  2,  3,  4,  5,  6,  7,  8,  9, 10, 11],
[12, 13, 14, 15, 16, 17, 18, 19, 20, 21, 22, 23],
[24, 25, 26, 27, 28, 29, 30, 31, 32, 33, 34, 35],
[36, 37, 38, 39, 40, 41, 42, 43, 44, 45, 46, 47]])
rows_on = np.array([True, False, True, False])
b[rows_on, :] # 相当于b[(0, 2), :]

输出:

array([[ 0,  1,  2,  3,  4,  5,  6,  7,  8,  9, 10, 11],
[24, 25, 26, 27, 28, 29, 30, 31, 32, 33, 34, 35]])
cols_on = np.array([False, True, False] * 4)
b[:, cols_on] # 相当于b[:, (1, 4, 7, 10)]

输出:

array([[ 1,  4,  7, 10],
[13, 16, 19, 22],
[25, 28, 31, 34],
[37, 40, 43, 46]])

np.ix_

不能以上面那种方式在多个轴上使用布尔索引,但是可以使用np.ix_函数来解决。

d[np.ix_(rows_on, cols_on)]

输出:

array([[ 1,  4,  7, 10],
[25, 28, 31, 34]])
np.ix_(rows_on, cols_on)

输出:

(array([[0],
[2]], dtype=int64), array([[ 1, 4, 7, 10]], dtype=int64))

如果使用与ndarray形状相同的布尔数组,会得到一个一维数组,该数组包含所有坐标为True的元素值,通常与条件运算符一起使用。

b[b % 3 == 1]

输出:

array([ 1,  4,  7, 10, 13, 16, 19, 22, 25, 28, 31, 34, 37, 40, 43, 46])

numpy教程04---ndarray的索引的更多相关文章

  1. 转:Numpy教程

    因为用到theano写函数的时候饱受数据结构困扰 于是上网找了一篇numpy教程(theano的数据类型是基于numpy的) 原文排版更好,阅读体验更佳: http://phddreamer.blog ...

  2. Python 机器学习库 NumPy 教程

    0 Numpy简单介绍 Numpy是Python的一个科学计算的库,提供了矩阵运算的功能,其一般与Scipy.matplotlib一起使用.其实,list已经提供了类似于矩阵的表示形式,不过numpy ...

  3. numpy教程

    [转]CS231n课程笔记翻译:Python Numpy教程 原文链接:https://zhuanlan.zhihu.com/p/20878530 译者注:本文智能单元首发,翻译自斯坦福CS231n课 ...

  4. NumPy 教程目录

    NumPy 教程目录 1 Lesson1--NumPy NumPy 安装 2 Lesson2--NumPy Ndarray 对象 3 Lesson3--NumPy 数据类型 4 Lesson4--Nu ...

  5. Mysql实战45讲 04讲深入浅出索引(上)读书笔记 极客时间

    极客时间 Mysql实战45讲 04讲深入浅出索引 极客时间(上)读书笔记  笔记体悟 1.索引的作用:提高数据查询效率2.常见索引模型:哈希表.有序数组.搜索树3.哈希表:键 - 值(key - v ...

  6. [译]Vulkan教程(04)基础代码

    [译]Vulkan教程(04)基础代码 General structure 通用结构 In the previous chapter you've created a Vulkan project w ...

  7. 【GStreamer开发】GStreamer播放教程04——既看式流

    目的 在<GStreamer基础教程--流>里面我们展示了如何在较差的网络条件下使用缓冲这个机制来提升用户体验.本教程在<GStreamer基础教程--流>的基础上在扩展了一下 ...

  8. Elasticsearch入门教程(三):Elasticsearch索引&映射

    原文:Elasticsearch入门教程(三):Elasticsearch索引&映射 版权声明:本文为博主原创文章,遵循CC 4.0 BY-SA版权协议,转载请附上原文出处链接和本声明. 本文 ...

  9. 【转】numpy教程

    [转载说明] 本来没有必要转载的,只是网上的版本排版不是太好,看的不舒服.所以转过来,重新排版,便于自己查看. 基础篇 NumPy的主要对象是同种元素的多维数组. 这是一个所有的元素都是一种类型.通过 ...

随机推荐

  1. ASP.NET Core框架探索之Authentication

    今天我们来探索一下ASP.NET Core中关于权限认证,所谓权限认证,就是通过某些方式获取到用户的信息. 需要开启权限认证,我们首先需要在容器中注入认证服务,使用services.AddAuthen ...

  2. 03 Java的数据类型分为两大类 类型转换 八大基本类型

    数据类型 强类型语言:要求变量的使用要严格符合规定,所有变量都必须先定义后才能使用 Java的数据类型分为两大类 基本类型(primitive type) 数值类型 整数类型 byte占1个字节范围: ...

  3. LGP3126题解

    这道题还有点意思. 路径要求是一个回文串,回文串立马枚举中点.中点只可能在对角线上. 枚举对角线上的一个点,然后两边的路径必须完全相同. 既然路径上的字符必须完全相同,那么每个前缀也必须完全相同. 考 ...

  4. 《前端运维》一、Linux基础--10定时任务

    一.进程管理 进程(Process)是计算机中的程序关于某数据集合上的一次运行活动,是系统进行资源分配和调度的基本单位,是操作系统结构的基础.在早期面向进程设计的计算机结构中,进程是程序的基本执行实体 ...

  5. C# 杂七杂八知识点

    本文源自在工作过程中一些比较容易混淆或者理解不太清晰的知识点进行整理备忘. sealed修饰符 当sealed关键字修饰类,该类不能被继承. 当sealed关键字修饰方法的时候,该方法不能在其子类中重 ...

  6. I 安装饮水机 中国石油大学新生训练赛#10

    问题 I: 安装饮水机 时间限制: 1 Sec  内存限制: 128 MB提交 状态 题目描述 为倡导城市低碳生活,市文明办计划举办马拉松比赛,为确保比赛安全,沿途设置了一些观察点.每个观察点派一个观 ...

  7. 请说一说Servlet的生命周期?

    servlet有良好的生存期的定义,包括加载和实例化.初始化.处理请求以及服务结束.这个生存期由javax.servlet.Servlet接口的init,service和destroy方法表达. Se ...

  8. 你了解过Servlet3.0吗?

    Servlet3.0相对于Servlet2.0来说最大的改变是引入了Annotation标注来取代xml配置,用于简化web应用的开发和部署.最主要几项特性: 1. 新增的注解支持:该版本新增了若干注 ...

  9. 解释JDBC抽象和DAO模块?

    通过使用JDBC抽象和DAO模块,保证数据库代码的简洁,并能避免数据库资源错误关闭导致的问题,它在各种不同的数据库的错误信息之上,提供了一个统一的异常访问层.它还利用Spring的AOP 模块给Spr ...

  10. EMQX_AUTH_USERNAME 使用

    emqx_auth_username 它通过比对每个终端的接入的 username 和 password 与 EMQ X 中存储的是否一致来实现终端接入的控制.其功能逻辑如下: emqx_auth_u ...