Pandas基本介绍

1、pandas主要的两个数据结构：Series和DataFrame

Series的字符串表现形式为：索引在左边，值在右边。由于我们没有为数据指定索引。于是会自动创建一个0到N-1（N为长度）的整数型索引。

>>> import pandas as pd

>>> import numpy as np

>>> s = pd.Series([1,3,6,np.nan,44,1])

>>> print(s)

0     1.0

1     3.0

2     6.0

3     NaN

4    44.0

5     1.0

dtype: float64

DataFrame是一个表格型的数据结构，它包含有一组有序的列，每列可以是不同的值类型（数值，字符串，布尔值等）。DataFrame既有行索引也有列索引，它可以被看做由Series组成的大字典。

>>> dates = pd.date_range('',periods=6)

>>> df = pd.DataFrame(np.random.randn(6,4),index=dates,columns=['a','b','c','d'])

>>> print(df)

                   a         b         c         d

2016-01-01  1.306762  1.506943  0.682025 -0.054329

2016-01-02  2.626875  0.086998  0.307123 -0.498728

2016-01-03 -0.941697  0.206144  1.719719  1.084614

2016-01-04 -0.610912 -1.120358 -0.635338  1.145777

2016-01-05 -0.150501  0.768586 -0.158341  0.704960

2016-01-06 -0.759211  0.271800  0.768166 -0.293015

2、DataFrame的一些简单运用

>>> print(df['b'])

2016-01-01    1.506943

2016-01-02    0.086998

2016-01-03    0.206144

2016-01-04   -1.120358

2016-01-05    0.768586

2016-01-06    0.271800

Freq: D, Name: b, dtype: float64

>>> df1 = pd.DataFrame(np.arange(12).reshape((3,4)))#创建一组没有给定行标签和列标签的数据 df1:

>>> print(df1)

   0  1   2   3

0  0  1   2   3

1  4  5   6   7

2  8  9  10  11

>>> df2 = pd.DataFrame({'A' : 1.,

...                     'B' : pd.Timestamp(''),

...                     'C' : pd.Series(1,index=list(range(4)),dtype='float32'),

...                     'D' : np.array([3] * 4,dtype='int32'),

...                     'E' : pd.Categorical(["test","train","test","train"]),

...                     'F' : 'foo'})#另一种生成df的方法

>>>print(df2)

     A          B    C  D      E    F

0  1.0 2013-01-02  1.0  3   test  foo

1  1.0 2013-01-02  1.0  3  train  foo

2  1.0 2013-01-02  1.0  3   test  foo

3  1.0 2013-01-02  1.0  3  train  foo

>>> print(df2.dtypes)#查看数据中的类型

A           float64

B    datetime64[ns]

C           float32

D             int32

E          category

F            object

dtype: object

>>> print(df2.index) #查看对列的序号

Int64Index([0, 1, 2, 3], dtype='int64')

>>> print(df2.columns)#查看每种数据的名称

Index(['A', 'B', 'C', 'D', 'E', 'F'], dtype='object')

>>> print(df2.values)#查看所有df2的值

[[1.0 Timestamp('2013-01-02 00:00:00') 1.0 3 'test' 'foo']

 [1.0 Timestamp('2013-01-02 00:00:00') 1.0 3 'train' 'foo']

 [1.0 Timestamp('2013-01-02 00:00:00') 1.0 3 'test' 'foo']

 [1.0 Timestamp('2013-01-02 00:00:00') 1.0 3 'train' 'foo']]

>>> df2.describe()#数据的总结

         A    C    D

count  4.0  4.0  4.0

mean   1.0  1.0  3.0

std    0.0  0.0  0.0

min    1.0  1.0  3.0

25%    1.0  1.0  3.0

50%    1.0  1.0  3.0

75%    1.0  1.0  3.0

max    1.0  1.0  3.0

>>> print(df2.T)#翻转数据，transpose

                     0                    1                    2                    3

A                    1                    1                    1                    1

B  2013-01-02 00:00:00  2013-01-02 00:00:00  2013-01-02 00:00:00  2013-01-02 00:00:00

C                    1                    1                    1                    1

D                    3                    3                    3                    3

E                 test                train                 test                train

F                  foo                  foo                  foo                  foo

>>> print(df2.sort_index(axis=1, ascending=False))#对数据的index进行排序并输出

     F      E  D    C          B    A

0  foo   test  3  1.0 2013-01-02  1.0

1  foo  train  3  1.0 2013-01-02  1.0

2  foo   test  3  1.0 2013-01-02  1.0

3  foo  train  3  1.0 2013-01-02  1.0

>>> print(df2.sort_values(by='B'))#对数据值排序输出

     A          B    C  D      E    F

0  1.0 2013-01-02  1.0  3   test  foo

1  1.0 2013-01-02  1.0  3  train  foo

2  1.0 2013-01-02  1.0  3   test  foo

3  1.0 2013-01-02  1.0  3  train  foo

Pandas基本介绍的更多相关文章

[数据分析工具] Pandas 功能介绍（一）
如果你在使用 Pandas(Python Data Analysis Library) 的话,下面介绍的对你一定会有帮助的. 首先我们先介绍一些简单的概念 DataFrame:行列数据,类似 Exce ...
【学习】pandas 基础介绍说明【pandas】
本文来源于<利用python进行数据分析>中文版,大家有兴趣可以看原版,入门的东西得脚踏实地哈 1.pandas 数据结构介绍首先熟悉它的两个主要数据结构,Series 和 DataFr ...
python之pandas简单介绍及使用（一）
python之pandas简单介绍及使用(一) 一. Pandas简介1.Python Data Analysis Library 或 pandas 是基于NumPy 的一种工具,该工具是为了解决数据 ...
读书笔记一、pandas数据结构介绍
pandas数据结构介绍主要两种数据结构:Series和DataFrame. Series Series是一种类似于一维数组的对象,由一组数据(各种NumPy数据类型)+数据标签(即索引)组 ...
[数据分析工具] Pandas 功能介绍（二）
条件过滤我们需要看第一季度的数据是怎样的,就需要使用条件过滤体感的舒适适湿度是40-70,我们试着过滤出体感舒适湿度的数据最后整合上面两种条件,在一季度体感湿度比较舒适的数据列排序数据按照某 ...
Python 数据处理扩展包： numpy 和 pandas 模块介绍
一.numpy模块 NumPy(Numeric Python)模块是Python的一种开源的数值计算扩展.这种工具可用来存储和处理大型矩阵,比Python自身的嵌套列表(nested list str ...
数据处理之pandas简单介绍
Offical Website :http://pandas.pydata.org/ 一:两种基本的数据类型结构 Series 和 DataFrame 先来看一下Series import panda ...
pandas基本介绍-【老鱼学pandas】
前面我们学习了numpy,现在我们来学习一下pandas. Python Data Analysis Library 或 pandas 主要用于处理类似excel一样的数据格式,其中有表头.数据序列号 ...
pandas简短介绍
1.数据结构维数名称描述 1 Series 一维带标签单一数据类型的数组 2 DataFrame 不同数据类型的列 2.十分钟学习pandas 2.1.导入所需模块 import pandas ...

随机推荐

大数据_Kafka_Kafka自动创建不存在的Topics / 删除已存在的Topics
大数据_Kafka_Kafka自动创建不存在的Topics / 删除已存在的Topics 2016年10月11日 18:22:59 高达一号阅读数:8655 版权声明:本文为博主原创文章,未经博 ...
kubectl windows
https://storage.googleapis.com/kubernetes-release/release/v1.10.3/bin/windows/amd64/kubectl.exe
jQuery写省级联动列表，创造二维数组，以及如何存/调用二维数组中的数据
jQuery写省级联动列表,创造二维数组来存放数据,然后通过each来遍历调用,通过creatTxtNode创建文本节点,通过createElement创建标签option,在通过append将文本写 ...
multi_compile
[multi_compile] Used to compile the shader code multiple times with different preprocessor directi ...
linux中awk命令学习
awk是一个强大的文本分析工具,awk就是把文件逐行的读入,以空格为默认分隔符将每行切片,切开的部分再进行各种分析处理. 通常获取某一行时,我们会使用 “grep 关键字“进行查找,但在读取某一列时, ...
Oracle11g RAC安装
双节点RAC环境,数据库 racdb 实例1:racdb1 实例2:racdb2 1.IP规划名称 oracle-db1 oracle-db2PUBLIC I ...
telnet ip/域名端口是否成功
有时候会ping ip 通,但是telnet不通,可能端口未开. telnet不成功,则显示不能打开到主机的链接,链接失败 . telnet成功,则进入telnet页面(全黑的),证明端口可用.
ext.js的目录结构的简单解释
adapter:负责将里面提供第三方底层库(包括Ext自带的底层库)映射为Ext所支持的底层库. build: 压缩后的ext全部源码(里面分类存放). docs: API帮助文档. ...
java面试题：分布式
分布式分为分布式缓存(Redis).分布式锁(Redis或Zookeeper).分布式服务(Dubbo或SpringCloud).分布式服务协调(Zookeeper).分布式消息队列(Kafka.Ra ...
Django 的认识，题型
Django 的认识,面试题链接:https://www.cnblogs.com/chongdongxiaoyu/p/9403399.html 1. 对Django的认识? #1.Django是走大 ...

Pandas基本介绍

Pandas基本介绍的更多相关文章

随机推荐

热门专题