pandas(一)

pandas.io

1.概述，主要从txt，json，pkl，csv，excel中读取数据，读取的数据最终转化为pandas.core.frame.DataFrame类型的df

先来看总的api

from pandas.io.clipboards import read_clipboard #读剪切板

from pandas.io.excel import ExcelFile, ExcelWriter, read_excel #读excel

from pandas.io.feather_format import read_feather

from pandas.io.gbq import read_gbq

from pandas.io.html import read_html

from pandas.io.json import read_json

from pandas.io.packers import read_msgpack, to_msgpack

from pandas.io.parquet import read_parquet

from pandas.io.parsers import read_csv, read_fwf, read_table

from pandas.io.pickle import read_pickle, to_pickle

from pandas.io.pytables import HDFStore, read_hdf

from pandas.io.sas import read_sas

from pandas.io.spss import read_spss

from pandas.io.sql import read_sql, read_sql_query, read_sql_table

from pandas.io.stata import read_stata

io的api里主要包含了读取操作，写入操作主要在pandas.core.frame.DataFrame

2.一个为操作pkl文件的demo

import pandas as pd

original_df = pd.DataFrame({"foo": range(5), "bar": range(5, 10)})

pd.to_pickle(original_df, "~/work/data/dummy.pkl")

df = pd.read_pickle("~/work/data/dummy.pkl")

如果df想写入为csv或其他格式可以调用df.to_csv

pandas(一)的更多相关文章

pandas基础-Python3
未完 for examples: example 1: # Code based on Python 3.x # _*_ coding: utf-8 _*_ # __Author: "LEM ...
10 Minutes to pandas
摘要一.创建对象二.查看数据三.选择和设置四.缺失值处理五.相关操作六.聚合七.重排(Reshaping) 八.时间序列九.Categorical类型十.画图十一 ...
利用Python进行数据分析(15) pandas基础: 字符串操作
字符串对象方法 split()方法拆分字符串: strip()方法去掉空白符和换行符: split()结合strip()使用: "+"符号可以将多个字符串连接起来: join( ...
利用Python进行数据分析(10) pandas基础: 处理缺失数据
数据不完整在数据分析的过程中很常见. pandas使用浮点值NaN表示浮点和非浮点数组里的缺失数据. pandas使用isnull()和notnull()函数来判断缺失情况. 对于缺失数据一般处理 ...
利用Python进行数据分析(12) pandas基础: 数据合并
pandas 提供了三种主要方法可以对数据进行合并: pandas.merge()方法:数据库风格的合并: pandas.concat()方法:轴向连接,即沿着一条轴将多个对象堆叠到一起: 实例方法c ...
利用Python进行数据分析(9) pandas基础: 汇总统计和计算
pandas 对象拥有一些常用的数学和统计方法. 例如,sum() 方法,进行列小计: sum() 方法传入 axis=1 指定为横向汇总,即行小计: idxmax() 获取最大值对应的索 ...
利用Python进行数据分析(8) pandas基础: Series和DataFrame的基本操作
一.reindex() 方法:重新索引针对 Series 重新索引指的是根据index参数重新进行排序. 如果传入的索引值在数据里不存在,则不会报错,而是添加缺失值的新行. 不想用缺失值,可以用 ...
利用Python进行数据分析(7) pandas基础: Series和DataFrame的简单介绍
一.pandas 是什么 pandas 是基于 NumPy 的一个 Python 数据分析包,主要目的是为了数据分析.它提供了大量高级的数据结构和对数据处理的方法. pandas 有两个主要的数据结构 ...
pandas.DataFrame对行和列求和及添加新行和列
导入模块: from pandas import DataFrame import pandas as pd import numpy as np 生成DataFrame数据 df = DataFra ...
pandas.DataFrame排除特定行
使用Python进行数据分析时,经常要使用到的一个数据结构就是pandas的DataFrame 如果我们想要像Excel的筛选那样,只要其中的一行或某几行,可以使用isin()方法,将需要的行的值以列 ...

随机推荐

安装kubernetes遇见coredns坑
安装kubernetes遇见问题 kubectl describe pod coredns -n kube-system, 查看发现coredns readiness 一直unhealthy, 并且一 ...
科学 multi port
issues/679 create new UUID cat /proc/sys/kernel/random/uuid example config : multi port , multi user ...
[题解] CF438E The Child and Binary Tree
CF438E The Child and Binary Tree Description 给一个大小为\(n\)的序列\(C\),保证\(C\)中每个元素各不相同,现在你要统计点权全在\(C\)中,且 ...
关于torch.flatten的笔记
先看函数参数: torch.flatten(input, start_dim=0, end_dim=-1) input: 一个 tensor,即要被“推平”的 tensor. start_dim: “ ...
【TensorFlow】tf.reset_default_graph()函数
转载 https://blog.csdn.net/duanlianvip/article/details/98626111 tf.reset_default_graph函数用于清除默认图形堆栈并重置 ...
mybatis的批量update
方法有三种:1.通过java代码batch方式,xml文件只需一条update语句.java代码繁琐 2.xml使用foreach,“;”分割多条update语句,要求:jdbc的url需加上allo ...
51nod 1392：装盒子匈牙利+贪心
1392 装盒子基准时间限制:1 秒空间限制:131072 KB 分值: 160 难度:6级算法题收藏关注有n个长方形盒子,第i个长度为Li,宽度为Wi,我们需要把他们套放.注意一个盒子 ...
kubelet组件详解---链接
https://blog.csdn.net/jettery/article/details/78891733
MSE（均方误差）、RMSE （均方根误差）、MAE （平均绝对误差）
1.MSE(均方误差)(Mean Square Error) MSE是真实值与预测值的差值的平方然后求和平均. 范围[0,+∞),当预测值与真实值完全相同时为0,误差越大,该值越大. import n ...
NiFi_Demo_调度示例
1.背景要求:每天凌晨1:00后开始每2min执行一次sql查询 2.作业编排 3.各模块配置 3.1 GenerateFlowFile 作用:用于产生flowfile,该flowfile内容为空. ...

pandas(一)

pandas(一)的更多相关文章

随机推荐

热门专题