Numpy 与 DataFrame对比与应用
(一)对比Numpty 与 DataFrame默认索引取值不同点
Numpy索引取值
#Numpy索引取值
data=np.empty((2,4),dtype=int)
print(data)
''' [[4128860 6029375 3801157 7340124]
[7602297 7274600 3342446 54]] ''' #取行
print('取第一行结果')
print(data[0]) #[4128860 6029375 3801157 7340124] 默认data【0】拿到的是数组第一行的值
'''
取第一行结果
[4128860 6029375 3801157 7340124] ''' #取列
print('取第一列的结果')
print(data[:,[0]])
'''
取第一列的结果
[[4128860]
[7602297]]
'''
DataFrame索引取值
#Dataframe的索引取值
data=pd.DataFrame(data)
print(data) '''原始DataFrame数组 0 1 2 3
0 4128860 6029375 3801157 7340124
1 7602297 7274600 3342446 54 ''' #取行的值
print('取第二行的值')
print(data[1:2])
'''
取第一行的值
0 1 2 3
0 4128860 6029375 3801157 7340124
''' #取列的值
print('取第一列的值')
print(data[0]) #这里data【0】拿到的是第一列的值
'''
取第一列的值
0 4128860
1 7602297
Name: 0, dtype: int32 '''
(二)Numpy与DataFrame之间转换
Numpy数组:
通过Numpy生成一个随机5行5列数组
import random
data=np.zeros((5,5),dtype=int)
通过random模块改变数组中的每个值
for i in range(len(data)):
for j in range(len(data[0])):
data[i][j] = random.randint(0,5) print(data) '''Numpy初始的数组结构 [[1 4 4 0 2]
[3 2 5 5 2]
[3 4 1 5 5]
[2 3 1 0 1]
[4 4 1 1 1]] '''
查看Numpy数组类型
#看Numpy初始的数组类型
print(type(data)) #<class 'numpy.ndarray'>
将Numpy数组转为DataFrame数组:
data_new=pd.DataFrame(data)
print(data_new) '''转换为DataFrame之后的结构
0 1 2 3 4
0 1 4 4 0 2
1 3 2 5 5 2
2 3 4 1 5 5
3 2 3 1 0 1
4 4 4 1 1 1 '''
查看转换后的数组类型
#看装换之后的数据类型
print(type(data_new)) #<class 'pandas.core.frame.DataFrame'>
Numpy 与 DataFrame对比与应用的更多相关文章
- Spark与Pandas中DataFrame对比
Pandas Spark 工作方式 单机single machine tool,没有并行机制parallelism不支持Hadoop,处理大量数据有瓶颈 分布式并行计算框架,内建并行机制paral ...
- Spark与Pandas中DataFrame对比(详细)
Pandas Spark 工作方式 单机single machine tool,没有并行机制parallelism不支持Hadoop,处理大量数据有瓶颈 分布式并行计算框架,内建并行机制paral ...
- Scipy和Numpy的插值对比
技术背景 插值法在图像处理和信号处理.科学计算等领域中是非常常用的一项技术.不同的插值函数,可以根据给定的数据点构造出来一系列的分段函数.这一点有别于函数拟合,函数拟合一般是指用一个给定形式的连续函数 ...
- 利用pandas进行数据分析之二:DataFrame与Series数据结构对比
Series与DataFrame对比学习 文章为本人原创,未经同意请勿转载,http://www.cnblogs.com/smallcrystal/ Series:构建的方法,一组数组(列表或元组), ...
- dataframe,list,numpy之间的互相转换
dataframe,numpy,list之间的互相转换 由于目前学校要做一些数据分析处理的作业有要用到dataframe,list,numpy之间的转化,所以在此总结一下这些用法. dataframe ...
- Pandas 之 Series / DataFrame 初识
import numpy as np import pandas as pd Pandas will be a major tool of interest throughout(贯穿) much o ...
- python numpy笔记:给matlab使用者
利用Numpy,python可以进行有效的科学计算.本文给过去常用matlab,现在正学习Numpy的人. 在进行矩阵运算等操作时,使用array还是matrix?? 简短的回答,更多的时候使用arr ...
- Spark核心类:SQLContext和DataFrame
http://blog.csdn.net/pipisorry/article/details/53320669 pyspark.sql.SQLContext Main entry point for ...
- PySpark的DataFrame处理方法
转:https://blog.csdn.net/weimingyu945/article/details/77981884 感谢! ---------------------------------- ...
随机推荐
- mysql常用命令添加外键主键约束存储过程索引
数据库连接 mysql -u root -p123456 查看表 show databases 创建数据库设置编码 create table books character set utf8; 创建用 ...
- 散度(Divergence)和旋度(Curl)
原文链接 散度(Divergence) 散度的讨论应从向量和向量场说起.向量是数学中研究多维计算的基本概念.比如,速度可以分解为相互独立的分量,则速度就是一个多维的向量.假如空间中的每一个位置都有一个 ...
- css的position定位终极总结
relative相对定位是相对于自己的位置定位,absolute绝对定位是向上级一级一级搜索有position属性的div,如果没有找到就相对于body定位
- int ,long long 范围
类型名称 字节数 取值范围signed char 1 -128-+127short int 2 -32768-+32767int 4 -2147483648-+2147483647(10位数 2^31 ...
- BZOJ1491: [NOI2007]社交网络(Floyd 最短路计数)
Time Limit: 10 Sec Memory Limit: 64 MBSubmit: 2343 Solved: 1266[Submit][Status][Discuss] Descripti ...
- Percona-Tookit工具包之pt-sift
Preface We've got a lot of files related with system performance which generated by pt-stalk ...
- js延迟加载的方式有哪些?
共有:defer和async.动态创建DOM方式(用得最多).按需异步载入js defer属性:(页面load后执行) HTML 4.01 为 <script>标签定义了 defer属性. ...
- java-反射和代理
1.类的编译和运行简易过程: java的源码文件(也称为编译单元,以.java为后缀的文件) ↓ 文件内最多只能有一个public修饰的类,否则编译器报错:某个类被public修饰,该类名必需与文件名 ...
- 生产-消费模式的synchronized和lock实现(十)
lock: package com.net.thread.lock; import java.util.concurrent.locks.Condition; import java.util.con ...
- python web框架的介绍
随着互联网的兴起,web开发变得愈发的重要.Python作为当前火热的语言, 其中的web开发框架可以说是百花齐放,下面聊一聊这些框架. 一: 基于Python的代表性Web框架 Django Dja ...