本博主要总结DaraFrame数据筛选方法（loc,iloc,ix,at,iat），并以操作csv文件为例进行说明

1. 数据筛选

    a   b   c

（1）单条件筛选

df[df['a']>]

# 如果想筛选a列的取值大于30的记录,但是之显示满足条件的b，c列的值可以这么写

df[['b','c']][df['a']>]

# 使用isin函数根据特定值筛选记录。筛选a值等于30或者54的记录

df[df.a.isin([, ])]

（2）多条件筛选

　　可以使用&（并）与| （或）操作符或者特定的函数实现多条件筛选

# 使用&筛选a列的取值大于30，b列的取值大于40的记录

df[(df['a'] > ) & (df['b'] > )]

（3）索引筛选

a. 切片操作

　　df[行索引，列索引]或df[[列名1，列名2]]

#使用切片操作选择特定的行

df[:]

#传入列名选择特定的列

df[['a','c']]

b. loc函数

　　当每列已有column name时，用 df [ ‘a’ ] 就能选取出一整列数据。如果你知道column names 和index，且两者都很好输入，可以选择 .loc同时进行行列选择。

In []: df.loc[,'c']

Out[]: 

In []: df.loc[:,['a','c']]

Out[]:

    a   c

In []: df.loc[[,,],['a','c']]

Out[]:

    a   c

c. iloc函数

　　如果column name太长，输入不方便，或者index是一列时间序列，更不好输入，那就可以选择 .iloc了，该方法接受列名的index,iloc 使得我们可以对column使用slice（切片）的方法对数据进行选取。这边的 i 我觉得代表index，比较好记点。

In []: df.iloc[,]

Out[]: 

In []: df.iloc[:,[,]]

Out[]:

    a   c

In []: df.iloc[[,,],[,]]

Out[]:

    a   c

In []: df.iloc[[,,],:]

Out[]:

    a   b

d. ix函数

　　ix的功能更加强大，参数既可以是索引，也可以是名称，相当于，loc和iloc的合体。需要注意的是在使用的时候需要统一，在行选择时同时出现索引和名称，同样在同行选择时同时出现索引和名称。

df.ix[:,['a','b']]

Out[]:

    a   b

In []: df.ix[[,,],['a','b']]

Out[]:

    a   b

In []: df.ix[[,,],[,]]

Out[]:

    a   c

e. at函数

　　根据指定行index及列label，快速定位DataFrame的元素，选择列时仅支持列名。

In []: df.at[,'a']

Out[]:

f. iat函数

　　与at的功能相同，只使用索引参数

In []: df.iat[,]

Out[]:

2. csv操作

　　csv文件内容

Supplier Name,Invoice Number,Part Number,Cost,Purchase Date

Supplier X,-,,$500.00 ,//

Supplier X,-,,$500.00 ,//

Supplier X,-,,$750.00 ,//

Supplier X,-,,$750.00 ,//

Supplier Y,-,,$250.00 ,//

Supplier Y,-,,$250.00 ,//

Supplier Y,-,,$125.00 ,//

Supplier Y,-,,$125.00 ,//

Supplier Z,-,,$615.00 ,//

Supplier Z,-,,$615.00 ,//

Supplier Z,-,,$615.00 ,//

Supplier Z,-,,$615.00 ,//

（1）csv文件读写

　　关于read_csv函数中的参数说明参考博客：https://blog.csdn.net/liuweiyuxiang/article/details/78471036

import pandas as pd

# 读写csv文件

df = pd.read_csv("supplier_data.csv")

df.to_csv("supplier_data_write.csv",index=None)

（2）筛选特定的行

#Supplier Nmae列中姓名包含'Z'，或者Cost列中的值大于600

print(df[df["Supplier Name"].str.contains('Z')])

print(df[df['Cost'].str.strip('$').astype(float) > ])

print(df.loc[(df["Supplier Name"].str.contains('Z'))|(df['Cost'].str.strip('$').astype(float) > 600.0),:])

#行中的值属于某个集合

li = [,]

print(df[df['Part Number'].isin(li)])

print(df.loc[df['Part Number'].astype(int).isin(li),:])

#行中的值匹配某个模式

print(df[df['Invoice Number'].str.startswith("001-")])

（3）选取特定的列

#选取特定的列

#列索引值,打印1，3列

print(df.iloc[:,::])

#列标题打印

print(df.loc[:,["Invoice Number", "Part Number"]])

#选取连续的行

print(df.loc[:,:])

python之pandas数据筛选和csv操作的更多相关文章

Python之pandas数据加载、存储
Python之pandas数据加载.存储 0. 输入与输出大致可分为三类: 0.1 读取文本文件和其他更好效的磁盘存储格式 2.2 使用数据库中的数据 0.3 利用Web API操作网络资源 1. 读 ...
Pandas 数据筛选,去重结合group by
Pandas 数据筛选,去重结合group by 需求今小伙伴有一个Excel表, 是部门里的小伙9月份打卡记录, 关键字段如下: 姓名, 工号, 日期, 打卡方式, 时间, 详细位置, IP地址. ...
python/numpy/pandas数据操作知识与技巧
pandas针对dataframe各种操作技巧集合: filtering: 一般地,使用df.column > xx将会产生一个只有boolean值的series,以该series作为dataf ...
python三大类型数据筛选
如何在列表,字典,集合中根据条件刷选数据说明: 本文分析的类型: 列表字典集合结合每种类型筛选数据的方法的不同,区分出方法间的差异. 一.列表案例需求:过滤掉列表中的负数. li = [1, ...
用Python将处理数据得到的csv文件分类（按顺序）保存
用Python中的os和numpy库对文件夹及处理数据后得到的文件进行分类保存: import numpy as np import os for m in range(699,0,-35): cur ...
用Python的pandas框架操作Excel文件中的数据教程
用Python的pandas框架操作Excel文件中的数据教程本文的目的,是向您展示如何使用pandas 来执行一些常见的Excel任务.有些例子比较琐碎,但我觉得展示这些简单的东西与那些你可以在其 ...
小白学 Python 数据分析（6）：Pandas （五）基础操作（2）数据选择
人生苦短,我用 Python 前文传送门: 小白学 Python 数据分析(1):数据分析基础小白学 Python 数据分析(2):Pandas (一)概述小白学 Python 数据分析(3):P ...
python 抓取数据，pandas进行数据分析并可视化展示
感觉要总结总结了,希望这次能写个系列文章分享分享心得,和大神们交流交流,提升提升. 因为半桶子水的水平,一直在想写什么,为什么写,怎么写. 直到现在找到了一种好的办法: 1.写什么自己手上掌握的,工 ...
Python的工具包[1] -> pandas数据预处理 -> pandas 库及使用总结
pandas数据预处理 / pandas data pre-processing 目录关于 pandas pandas 库 pandas 基本操作 pandas 计算 pandas 的 Series ...

随机推荐

保护你的代码，生成.a文件以及.framework文件需要注意的地方
一个好的设计,一个方便使用的控件封装,一个酷炫的动画... 是不是迫不及待要分享给大家你的每一个突然蹦出来的好的idea,那就下手吧! 可是,你想要的只是让大家使用它,而不是把所有技术点都公开给每个人 ...
[转]《Python爬虫学习系列教程》
<Python爬虫学习系列教程>学习笔记 http://cuiqingcai.com/1052.html 大家好哈,我呢最近在学习Python爬虫,感觉非常有意思,真的让生活可以方便很多. ...
Java经纬读坐标的距离计算
问题引出: 今天遇到经纬度坐标转换距离的工作,根据网站登录者的IP确定登录者目前的位置信息,将其经纬度信息与所有的营业厅的经纬度进行对比,网页上显示出距离登录者最近的营业厅地址,本打算就做一个二维坐标 ...
Maven的SSM框架配置文件：
applicationContext.xml: <?xml version="1.0" encoding="UTF-8"?> <beans x ...
HDU 1263 二维map
题意:给出一份水果的交易表,根据地区统计出水果的交易情况. 思路:二维map使用. #include<cstdio> #include<string> #include ...
centos7 -lvm卷组
老忘,记一下基本的逻辑卷管理概念: PV(Physical Volume)- 物理卷物理卷在逻辑卷管理中处于最底层,它可以是实际物理硬盘上的分区,也可以是整个物理硬盘,也可以是raid设备. ...
Java JDBC概要总结一(基本操作和SQL注入问题)
JDBC定义: JDBC(Java DataBase Connectivity,java数据库连接)是一种用于执行SQL语句的Java API.JDBC是Java访问数据库的标准规范,可以为不同的关系 ...
MyCat配置和使用
1.什么是MyCat2.MyCat应用场景3.使用MyCat路由实现读写分离4.SpringBoot动态数据源切换原理5..SpringBoot项目实现读写分离使用MyCat实现读写分离什么是My ...
glance cache
用在多个glance API server 中,对相同的image文件提供服务.该cache对用户透明. 配置文件有一个image_cache_max_size,超过的话image cache会被修剪 ...
虚拟主机(多站点配置)的实现--centos上的实现
Apache中配置多主机多站点,可以通过两种方式实现将同一个域名的不同端口映射到不同的站点(虚拟主机) 将同一个端口映射成不同的域名,不同的域名映射到不同的站点两种方法可以同时存在,局域网通过 ...

python之pandas数据筛选和csv操作

1. 数据筛选

（1）单条件筛选

（2）多条件筛选

（3）索引筛选

a. 切片操作

b. loc函数

c. iloc函数

d. ix函数

e. at函数

f. iat函数

2. csv操作

csv文件内容

（1）csv文件读写

（2）筛选特定的行

（3）选取特定的列

python之pandas数据筛选和csv操作的更多相关文章

随机推荐

热门专题

　　csv文件内容