Pandas 合并 concat

pandas处理多组数据的时候往往会要用到数据的合并处理,使用 concat是一种基本的合并方式.而且concat中有很多参数可以调整,合并成你想要的数据形式.

1、axis(合并方向)：axis=0是预设值，因此未设定任何参数时，函数默认axis=0。

>>> import pandas as pd

>>> import numpy as np

#定义资料集

>>> df1 = pd.DataFrame(np.ones((3,4))*0, columns=['a','b','c','d'])

>>> df2 = pd.DataFrame(np.ones((3,4))*1, columns=['a','b','c','d'])

>>> df3 = pd.DataFrame(np.ones((3,4))*2, columns=['a','b','c','d'])

#concat纵向合并

>>> res = pd.concat([df1, df2, df3], axis=0)

>>> print(res)

     a    b    c    d

0  0.0  0.0  0.0  0.0

1  0.0  0.0  0.0  0.0

2  0.0  0.0  0.0  0.0

0  1.0  1.0  1.0  1.0

1  1.0  1.0  1.0  1.0

2  1.0  1.0  1.0  1.0

0  2.0  2.0  2.0  2.0

1  2.0  2.0  2.0  2.0

2  2.0  2.0  2.0  2.0

仔细观察会发现结果的index是0, 1, 2, 0, 1, 2, 0, 1, 2，若要将index重置，请看下面。

2、ignore——index(重置index)

#承上一个例子，并将index_ignore设定为True

>>> res = pd.concat([df1, df2, df3], axis=0, ignore_index=True)

>>> print(res)

     a    b    c    d

0  0.0  0.0  0.0  0.0

1  0.0  0.0  0.0  0.0

2  0.0  0.0  0.0  0.0

3  1.0  1.0  1.0  1.0

4  1.0  1.0  1.0  1.0

5  1.0  1.0  1.0  1.0

6  2.0  2.0  2.0  2.0

7  2.0  2.0  2.0  2.0

8  2.0  2.0  2.0  2.0

结果的index变0, 1, 2, 3, 4, 5, 6, 7, 8。

3、join(合并方式)

join='outer'为预设值，因此未设定任何参数时，函数默认join='outer'。此方式是依照column来做纵向合并，有相同的column上下合并在一起，其他独自的column个自成列，原本没有值的位置皆以NaN填充。

>>> import pandas as pd

>>> import numpy as np

>>> df1 = pd.DataFrame(np.ones((3,4))*0, columns=['a','b','c','d'], index=[1,2,3])

>>> df2 = pd.DataFrame(np.ones((3,4))*1, columns=['b','c','d','e'], index=[2,3,4])

#纵向"外"合并df1与df2

>>> res = pd.concat([df1, df2], axis=0, join='outer')

>>> print(res)

     a    b    c    d    e

1  0.0  0.0  0.0  0.0  NaN

2  0.0  0.0  0.0  0.0  NaN

3  0.0  0.0  0.0  0.0  NaN

2  NaN  1.0  1.0  1.0  1.0

3  NaN  1.0  1.0  1.0  1.0

4  NaN  1.0  1.0  1.0  1.0

#原理同上个例子的说明，但只有相同的column合并在一起，其他的会被抛弃。

#纵向"内"合并df1与df2

>>> res = pd.concat([df1, df2], axis=0, join='inner')

>>> print(res)

     b    c    d

1  0.0  0.0  0.0

2  0.0  0.0  0.0

3  0.0  0.0  0.0

2  1.0  1.0  1.0

3  1.0  1.0  1.0

4  1.0  1.0  1.0

#重置index并打印结果

>>> res = pd.concat([df1, df2], axis=0, join='inner', ignore_index=True)

>>> print(res)

     b    c    d

0  0.0  0.0  0.0

1  0.0  0.0  0.0

2  0.0  0.0  0.0

3  1.0  1.0  1.0

4  1.0  1.0  1.0

5  1.0  1.0  1.0

4、join_axes(依照axes合并)

>>> import pandas as pd

>>> import numpy as np

>>> df1 = pd.DataFrame(np.ones((3,4))*0, columns=['a','b','c','d'], index=[1,2,3])

>>> df2 = pd.DataFrame(np.ones((3,4))*1, columns=['b','c','d','e'], index=[2,3,4])

#依照`df1.index`进行横向合并

>>> res = pd.concat([df1, df2], axis=1, join_axes=[df1.index])

>>> print(res)

     a    b    c    d    b    c    d    e

1  0.0  0.0  0.0  0.0  NaN  NaN  NaN  NaN

2  0.0  0.0  0.0  0.0  1.0  1.0  1.0  1.0

3  0.0  0.0  0.0  0.0  1.0  1.0  1.0  1.0

#移除join_axes，并打印结果

>>> res = pd.concat([df1, df2], axis=1)

>>> print(res)

     a    b    c    d    b    c    d    e

1  0.0  0.0  0.0  0.0  NaN  NaN  NaN  NaN

2  0.0  0.0  0.0  0.0  1.0  1.0  1.0  1.0

3  0.0  0.0  0.0  0.0  1.0  1.0  1.0  1.0

4  NaN  NaN  NaN  NaN  1.0  1.0  1.0  1.0

5、append(添加数据)

append只有纵向合并，没有横向合并。

>>> import pandas as pd

>>> import numpy as np 

>>> df1 = pd.DataFrame(np.ones((3,4))*0, columns=['a','b','c','d'])

>>> df2 = pd.DataFrame(np.ones((3,4))*1, columns=['a','b','c','d'])

>>> df3 = pd.DataFrame(np.ones((3,4))*1, columns=['a','b','c','d'])

>>> s1 = pd.Series([1,2,3,4], index=['a','b','c','d'])

#将df2合并到df1的下面，以及重置index，并打印出结果

>>> res = df1.append(df2, ignore_index=True)

>>> print(res)

     a    b    c    d

0  0.0  0.0  0.0  0.0

1  0.0  0.0  0.0  0.0

2  0.0  0.0  0.0  0.0

3  1.0  1.0  1.0  1.0

4  1.0  1.0  1.0  1.0

5  1.0  1.0  1.0  1.0

#合并多个df，将df2与df3合并至df1的下面，以及重置index，并打印出结果

>>> res = df1.append([df2, df3], ignore_index=True)

>>> print(res)

     a    b    c    d

0  0.0  0.0  0.0  0.0

1  0.0  0.0  0.0  0.0

2  0.0  0.0  0.0  0.0

3  1.0  1.0  1.0  1.0

4  1.0  1.0  1.0  1.0

5  1.0  1.0  1.0  1.0

6  1.0  1.0  1.0  1.0

7  1.0  1.0  1.0  1.0

8  1.0  1.0  1.0  1.0

#合并series，将s1合并至df1，以及重置index，并打印出结果

>>> res = df1.append(s1, ignore_index=True)

>>> print(res)

     a    b    c    d

0  0.0  0.0  0.0  0.0

1  0.0  0.0  0.0  0.0

2  0.0  0.0  0.0  0.0

3  1.0  2.0  3.0  4.0

Pandas 合并 concat的更多相关文章

【转】Pandas学习笔记（五）合并 concat
Pandas学习笔记系列: Pandas学习笔记(一)基本介绍 Pandas学习笔记(二)选择数据 Pandas学习笔记(三)修改&添加值 Pandas学习笔记(四)处理丢失值 Pandas学 ...
pandas的concat函数和append方法
pd.concat(objs, axis=0, join='outer', join_axes=None, ignore_index=False,keys=None, levels=None, nam ...
python pandas合并多个excel(xls和xlsx)文件（弹窗选择文件夹和保存文件）
# python pandas合并多个excel(xls和xlsx)文件(弹窗选择文件夹和保存文件) import tkinter as tk from tkinter import filedial ...
python pandas 合并数据函数merge join concat combine_first 区分
pandas对象中的数据可以通过一些内置的方法进行合并:pandas.merge,pandas.concat,实例方法join,combine_first,它们的使用对象和效果都是不同的,下面进行区分 ...
Pandas合并数据集之concat、combine_first方法
轴向连接(concat) Numpy import numpy as np import pandas as pd from pandas import Series arr = np.arange( ...
pandas合并数据集-【老鱼学pandas】
有两个数据集,我们想把他们的结果根据相同的列名或索引号之类的进行合并,有点类似SQL中的从两个表中选择出不同的记录并进行合并返回. 合并首先准备数据: import pandas as pd imp ...
Pandas合并数据集之merge、join方法
合并数据集 pandas.merge 可根据一个或多个键将不同DataFrame中的行连接起来. pandas.concat 可以沿着一条轴将多个对象堆叠到一起. combine_first merg ...
Pandas 合并merge
pandas中的merge和concat类似,但主要是用于两组有key column的数据,统一索引的数据. 通常也被用在Database的处理当中. 1.依据一组key合并 >>> ...
pandas 合并数据
1. pandas 的merge,join 就不说了. 2. 神奇的: concat append 参考: PANDAS 数据合并与重塑(concat篇) 3.

随机推荐

php利用array_search与array_column实现二维数组查找
利用array_search与array_column实现二维数组查找,不用自己写个循环,减少工作量. <?php $userdb = array( 0 => array( 'uid' = ...
关于DDR3控制器的使用
关于DDR3控制器的使用 mig_7series_0 u_mig_7series_0 ( // Memory interface ports .ddr3_addr (ddr3_addr), // ou ...
AndroidStudio 开发JNI
Android版本不断更新,发现网上很多JNI的教程,都不太适用了,会遇到各种问题,今天自己来总结一个. NDK下载我们下载NDK,有两种下载方式: 这是Google官方下载点击下载NDK: 通过 ...
uniDAC的安装和使用
1.解压后把UniDAC文件夹 2.在UniDAC\Source\Delphi7文件夹中找到Make.bat文件,鼠标右键“编辑”确认DELPHI7的安装路径是否正确(建议:设置成绝对路径了,防止因为 ...
对于使用JDBC连接mysql数据时The server time zone value '¤¤°ê¼Ð·Ç®É¶¡'...的异常问题解决。
相信很多小伙伴和我一样遇到了这类问题,在使用JDBC连接mysql数据库的时候发生SQLException如下所示的异常情况! java.sql.SQLException: The server ti ...
beautifulSoup《转》
beautifulSoup基本用法及find选择器总结来源于官方文档:https://www.crummy.com/software/BeautifulSoup/bs4/doc/index.zh.h ...
实验三：xen环境下的第一个虚拟机的安装
实验名称: xen环境下的第一个虚拟机的安装实验环境: 我们这里继续上面实验二来完成这个实验: 环境则是xen的安装环境,如下图: 开启虚拟机的的硬件辅助虚拟化功能: 实验要求: 这里我们通过安装b ...
vue+窗格切换+田字+dicom显示_03
环境:vue+webpack+cornerstone ide:vs code 需求:窗格设置+拼图设置代码: 主体:printPage.vue <div class="div mid ...
5-安装sqoop
1.解压,修改权限 sudo tar -zvxf sqoop-1.4.6.bin__hadoop-2.0.4-alpha.tar.gz -C /opt/app/ sudo chown -R hadoo ...
什么是Java序列化，如何实现java序列化
简要解释: 序列化就是一种用来处理对象流的机制,所谓对象流也就是将对象的内容进行流化.可以对流化后的对象进行读写操作,也可将流化后的对象传输于网络之间. 序列化是为了解决在对对象流进行读写操作时所 ...

Pandas 合并 concat

Pandas 合并 concat的更多相关文章

随机推荐

热门专题