pandas-14 concatenate和combine_first的用法

concatenate主要作用是拼接series和dataframe的数据。

combine_first可以做来填充数据。

其中numpy和panads中都有concatenate()方法，如：np.concatenate([arr1, arr2])、pd.concat([s1, s2])

Series类型可以使用 s2 中的数值来填充 s1，如：s1.combine_first(s2)

Dataframe类型同样可以使用 df2 中的数组来填充 df1，如：df1.combine_first(df2)

import numpy as np

import pandas as pd

from pandas import Series, DataFrame

# 设置一个随机种子，方便调试

np.random.seed(666)

# Series

arr1 = np.arange(9).reshape(3, 3)

arr2 = np.arange(9).reshape(3, 3)

# numpy的 concatenate 用法

print(np.concatenate([arr1, arr2]))

'''

[[0 1 2]

 [3 4 5]

 [6 7 8]

 [0 1 2]

 [3 4 5]

 [6 7 8]]

'''

print(np.concatenate([arr1, arr2], axis=1))

'''

[[0 1 2 0 1 2]

 [3 4 5 3 4 5]

 [6 7 8 6 7 8]]

'''

s1 = Series([1, 2, 3], index=['A', 'B', 'C'])

s2 = Series([4, 5], index=['E', 'F'])

# 可以看出和numpy的效果一样

print(pd.concat([s1, s2]))

'''

A    1

B    2

C    3

E    4

F    5

dtype: int64

'''

# 用法和 np 一样 axis = 1, 等于增加了一列

print(pd.concat([s1, s2], axis=1))

# 但是，返回的是一个 <class 'pandas.core.frame.DataFrame'>

print(type(pd.concat([s1, s2], axis=1)))

'''

     0    1

A  1.0  NaN

B  2.0  NaN

C  3.0  NaN

E  NaN  4.0

F  NaN  5.0

'''

df1 = DataFrame(np.random.randn(4, 3), columns=['X', 'Y', 'Z'])

print(df1)

'''

          X         Y         Z

0  0.824188  0.479966  1.173468

1  0.909048 -0.571721 -0.109497

2  0.019028 -0.943761  0.640573

3 -0.786443  0.608870 -0.931012

'''

df2 = DataFrame(np.random.randn(3, 3), columns=['X', 'Y', 'A'])

print(df2)

'''

          X         Y         A

0  0.978222 -0.736918 -0.298733

1 -0.460587 -1.088793 -0.575771

2 -1.682901  0.229185 -1.756625

'''

print(pd.concat([df1, df2]))

'''

          A         X         Y         Z

0       NaN  0.824188  0.479966  1.173468

1       NaN  0.909048 -0.571721 -0.109497

2       NaN  0.019028 -0.943761  0.640573

3       NaN -0.786443  0.608870 -0.931012

0 -0.298733  0.978222 -0.736918       NaN

1 -0.575771 -0.460587 -1.088793       NaN

2 -1.756625 -1.682901  0.229185       NaN

'''

# combine

s1 = Series([2, np.nan, 4, np.nan], index=['A', 'B', 'C', 'D'])

s2 = Series([1, 2, 3, 4], index=['A', 'B', 'C', 'D'])

# 用 s2 中的数值来填充 s1

print(s1.combine_first(s2))

'''

A    2.0

B    2.0

C    4.0

D    4.0

dtype: float64

'''

df1 = DataFrame({

    'X':[1, np.nan, 3, np.nan],

    'Y':[5, np.nan, 7, np.nan],

    'Z':[9, np.nan, 11, np.nan]

})

df2 = DataFrame({

    'Z':[np.nan, 10, np.nan, 12],

    'A':[1, 2, 3, 4]

})

# 功能同样是填充

print(df1.combine_first(df2))

'''

     A    X    Y     Z

0  1.0  1.0  5.0   9.0

1  2.0  NaN  NaN  10.0

2  3.0  3.0  7.0  11.0

3  4.0  NaN  NaN  12.0

'''

pandas-14 concatenate和combine_first的用法的更多相关文章

9.14.16 Django ORM进阶用法
2018-9-14 14:26:45 ORM 练习题 : http://www.cnblogs.com/liwenzhou/articles/8337352.html 2018-9-14 21:1 ...
Pandas | 14 统计函数
统计方法有助于理解和分析数据的行为.可以将这些统计函数应用到Pandas的对象上. pct_change()函数系列,DatFrames和Panel都有pct_change()函数.此函数将每个元素 ...
[Python] Pandas 中 Series 和 DataFrame 的用法笔记
目录 1. Series对象自定义元素的行标签使用Series对象定义基于字典创建数据结构 2. DataFrame对象自定义行标签和列标签使用DataFrame对象可以基于字典创建数据结构 ...
ASP.NET Core 6框架揭秘实例演示[14]：日志的进阶用法
为了对各种日志框架进行整合,微软创建了一个用来提供统一的日志编程模式的日志框架.<日志的基本编程模式>以实例演示的方式介绍了日志的基本编程模式,现在我们来补充几种"进阶" ...
14. js字符串截取substring用法
columnIds = columnIds.substring(0, columnIds.length-1);
pandas.drop/isnull/fillna/astype的用法
删除表中的某一行或者某一列更明智的方法是使用drop,它不改变原有的df中的数据,而是返回另一个dataframe来存放删除后的数据. (1)清理无效数据 df[df.isnull()] #返回的是个 ...
14.Python bytes类型及用法
Python 3 新增了 bytes 类型,用于代表字节串(这是本教程创造的一个词,用来和字符串对应).字符串(str)由多个字符组成,以字符为单位进行操作:字节串(bytes)由多个字节组成,以字节 ...
Pandas：loc iloc ix用法
参考:Pandas中关于 loc \ iloc \ ix 用法的理解相同点使用形式都是 df.xxx[ para1 , para2 ] #xxx表示loc iloc ix#df表示一个DataFr ...
Pandas常用功能总结
1.读取.csv文件 df2 = pd.read_csv('beijingsale.csv', encoding='gb2312',index_col='id',sep='\t',header=Non ...

随机推荐

Java API设计原则清单
在设计Java API的时候总是有很多不同的规范和考量.与任何复杂的事物一样,这项工作往往就是在考验我们思考的缜密程度.就像飞行员起飞前的检查清单,这张清单将帮助软件设计者在设计Java API的过程 ...
使用NPOI或EPPlus来导出Excel文件实例，可在Excel文件加密
使用NPOI.dll组件来导出Excel文件,并设置样式,Nuget引用即可. packages\NPOI.2.1.3.1\lib\net20\NPOI.dll #region Excel prote ...
用GEOquery从GEO数据库下载数据--转载
https://www.plob.org/article/9969.html Gene Expression Omnibus database (GEO)是由NCBI负责维护的一个数据库,设计初衷是为 ...
log-structured-merge-trees
https://juejin.im/post/5bbbf7615188255c59672125 https://www.cnblogs.com/siegfang/archive/2013/01/12/ ...
QByteArray数据进行CRC32校验时产生的随机结果
QT中使用QByteArray来存放了C++中的char数组. 两端使用相同的crc32进行校验,QT中却产生了随机的校验结果, C++端产生唯一的正确校验结果. 查看QByteArray相关资料,未 ...
VC 获取系统特殊文件夹的路径如：系统目录，桌面等
转载:https://blog.csdn.net/qq_23992597/article/details/50963343 如果需要,请在StdAfx.h中添加 #include <shlobj ...
Cassandra开发入门文档第四部分（集合类型、元组类型、时间序列、计数列）
Cassandra 提供了三种集合类型,分别是Set,List,MapSet: 非重复集,存储了一组类型相同的不重复元素,当被查询时会返回排好序的结果,但是内部构成是无序的值,应该是在查询时对结果进行 ...
SVM – 核函数
核函数的起源是对于线性不可分的分类情况,其实可以通过p次方多项式,及非线性模型进行分类:然后对于这类非线性多次方的,其实可以按照广义线性模型来进行升维变形,使之成为线性模型,这样就可以放到SVM中来进 ...
K8S使用入门-添加一个node
上一篇博客我们已经将K8S部署起来了,现在我们就来介绍一下如何简单使用K8S (1)添加节点注意事项:不能和k8s master节点的主机名一样.否则会导致k8s无法正常识别出该节点添加节点是比较 ...
[Mobi] 移动端应用技术选型的思考, Native, Flutter, Quasar, React Native
今天我主要是从开发 **不同产品** 和 **技术力量差别** 两个方面来做一个比较: Native 除了两端的技术力量要求高.花的功夫多,没毛病,看你有没有这个实力. Flutter 通过实现中间层 ...

pandas-14 concatenate和combine_first的用法

pandas-14 concatenate和combine_first的用法

pandas-14 concatenate和combine_first的用法的更多相关文章

随机推荐

热门专题