Numpy 与 DataFrame对比与应用
(一)对比Numpty 与 DataFrame默认索引取值不同点
Numpy索引取值
#Numpy索引取值
data=np.empty((2,4),dtype=int)
print(data)
''' [[4128860 6029375 3801157 7340124]
[7602297 7274600 3342446 54]] ''' #取行
print('取第一行结果')
print(data[0]) #[4128860 6029375 3801157 7340124] 默认data【0】拿到的是数组第一行的值
'''
取第一行结果
[4128860 6029375 3801157 7340124] ''' #取列
print('取第一列的结果')
print(data[:,[0]])
'''
取第一列的结果
[[4128860]
[7602297]]
'''
DataFrame索引取值
#Dataframe的索引取值
data=pd.DataFrame(data)
print(data) '''原始DataFrame数组 0 1 2 3
0 4128860 6029375 3801157 7340124
1 7602297 7274600 3342446 54 ''' #取行的值
print('取第二行的值')
print(data[1:2])
'''
取第一行的值
0 1 2 3
0 4128860 6029375 3801157 7340124
''' #取列的值
print('取第一列的值')
print(data[0]) #这里data【0】拿到的是第一列的值
'''
取第一列的值
0 4128860
1 7602297
Name: 0, dtype: int32 '''
(二)Numpy与DataFrame之间转换
Numpy数组:
通过Numpy生成一个随机5行5列数组
import random
data=np.zeros((5,5),dtype=int)
通过random模块改变数组中的每个值
for i in range(len(data)):
for j in range(len(data[0])):
data[i][j] = random.randint(0,5) print(data) '''Numpy初始的数组结构 [[1 4 4 0 2]
[3 2 5 5 2]
[3 4 1 5 5]
[2 3 1 0 1]
[4 4 1 1 1]] '''
查看Numpy数组类型
#看Numpy初始的数组类型
print(type(data)) #<class 'numpy.ndarray'>
将Numpy数组转为DataFrame数组:
data_new=pd.DataFrame(data)
print(data_new) '''转换为DataFrame之后的结构
0 1 2 3 4
0 1 4 4 0 2
1 3 2 5 5 2
2 3 4 1 5 5
3 2 3 1 0 1
4 4 4 1 1 1 '''
查看转换后的数组类型
#看装换之后的数据类型
print(type(data_new)) #<class 'pandas.core.frame.DataFrame'>
Numpy 与 DataFrame对比与应用的更多相关文章
- Spark与Pandas中DataFrame对比
Pandas Spark 工作方式 单机single machine tool,没有并行机制parallelism不支持Hadoop,处理大量数据有瓶颈 分布式并行计算框架,内建并行机制paral ...
- Spark与Pandas中DataFrame对比(详细)
Pandas Spark 工作方式 单机single machine tool,没有并行机制parallelism不支持Hadoop,处理大量数据有瓶颈 分布式并行计算框架,内建并行机制paral ...
- Scipy和Numpy的插值对比
技术背景 插值法在图像处理和信号处理.科学计算等领域中是非常常用的一项技术.不同的插值函数,可以根据给定的数据点构造出来一系列的分段函数.这一点有别于函数拟合,函数拟合一般是指用一个给定形式的连续函数 ...
- 利用pandas进行数据分析之二:DataFrame与Series数据结构对比
Series与DataFrame对比学习 文章为本人原创,未经同意请勿转载,http://www.cnblogs.com/smallcrystal/ Series:构建的方法,一组数组(列表或元组), ...
- dataframe,list,numpy之间的互相转换
dataframe,numpy,list之间的互相转换 由于目前学校要做一些数据分析处理的作业有要用到dataframe,list,numpy之间的转化,所以在此总结一下这些用法. dataframe ...
- Pandas 之 Series / DataFrame 初识
import numpy as np import pandas as pd Pandas will be a major tool of interest throughout(贯穿) much o ...
- python numpy笔记:给matlab使用者
利用Numpy,python可以进行有效的科学计算.本文给过去常用matlab,现在正学习Numpy的人. 在进行矩阵运算等操作时,使用array还是matrix?? 简短的回答,更多的时候使用arr ...
- Spark核心类:SQLContext和DataFrame
http://blog.csdn.net/pipisorry/article/details/53320669 pyspark.sql.SQLContext Main entry point for ...
- PySpark的DataFrame处理方法
转:https://blog.csdn.net/weimingyu945/article/details/77981884 感谢! ---------------------------------- ...
随机推荐
- ceph-文件存储
文件存储 ceph文件系统提供了任何大小的符合posix标准的分布式文件系统,它使用Ceph RADOS存储数据.要实现ceph文件系统,需要一个正在运行的ceph存储集群和至少一个ceph元数据服务 ...
- C#声明方法
一.声明方法 方法是类中用于执行计算或其它行为的成员. 方法可以分为: ?静态方法:可以通过类进行访问.?实例方法:可以通过类的对象进行访问. 1. C#方法的声明 声明方法的语法格式如下: 访问修饰 ...
- git 学习笔记 window操作系统
一.准备工作 1.设置好操作者和邮箱 $ git config --global user.name "Your Name" $ git config --global user. ...
- 面试-Spring理解
转自http://hui.sohu.com/infonews/article/6331404387079946240 spring呢,是pivotal公司维护的一系列开源工具的总称,最为人所知的是sp ...
- EBS补丁时遇到的问题
今天在给R12.1.3打17525552的时候,出现了这样的一个错误 ATTENTION: All workers either have failed or are waiting: FAILED: ...
- lintcode_397_最长上升连续子序列
最长上升连续子序列 描述 笔记 数据 评测 给定一个整数数组(下标从 0 到 n-1, n 表示整个数组的规模),请找出该数组中的最长上升连续子序列.(最长上升连续子序列可以定义为从右到左或从左到 ...
- Hibernate进阶学习3
Hibernate进阶学习3 测试hibernate的多表关联操作(一对多,多对一,多对多) 表之间的关系主要在类与元数据配置文件中体现 package com.hibernate.domain; i ...
- macOs 使用Homebrew升级到MySQL 8系列之后,php无法连接解决方法
当前时间2018-9-28 在使用brew install mysql 默认安装为 MySQL 8,但是使用php连接到数据库之后,出现了这种错误 (Unexpected server respose ...
- scrapy--dytt(电影天堂)
喜欢看电影的小伙伴,如果想看新的电影,然后没去看电影院看,没有正确的获得好的方法,大家就可以在电影天堂里进行下载.这里给大家提供一种思路. 1.dytt.py # -*- coding: utf-8 ...
- 微信小程序推广方案
拥有小程序只是基础,能玩转小程序运营才是关键.本文将会简单讲述十种最实用的小程序推广策略,结合具体案例阐述商家企业如何在拥有小程序后玩转小程序,快速实现小程序的推广. 一. 公众号+小程序 小程序可以 ...