Python使用xlrd、pandas包从Excel读取数据

#coding=utf-8

# pip install xlrd

import xlrd

def read_from_xls(filepath,index_col_list):

    #filepath：读取文件路径，例如：filepath = r'D:/Python_workspace/test.xlsx'

　　#index_col_list：读取列的索引列表，例如第一、二、三、四列为：[1,2,3,4]

    # 设置GBK编码

    xlrd.Book.encoding = "gbk"

    rb = xlrd.open_workbook(filepath)

    #print(rb)

    sheet = rb.sheet_by_index(0) #表示Excel的第一个Sheet

    nrows = sheet.nrows

    data_tmp_x = []  #例如数据为x,y,z坐标数据

    data_tmp_y = []

    data_tmp_z = []

    for index_col in index_col_list: #依次选择第index_col列

        for i in range(nrows):

            tt=i+1   #读取第tt行，除去第一行的列名

            if tt >= nrows:

                break

            else:

                tmp = float(sheet.cell_value(tt,index_col)) #读取第几行第几列的数据内容

                if index_col == 2:

                    data_tmp_x.append(tmp)

                elif index_col == 3:

                    data_tmp_y.append(tmp)

                elif index_col == 4:

                    data_tmp_z.append(tmp)

    data_tmp = np.mat([data_tmp_x,data_tmp_y,data_tmp_z])

    return data_tmp

# 使用pandas读取excel

# filepath: xlsx文件路径名

import pandas as pd

data = pd.read_excel(filepath)

province_name = data['province'].values.tolist() # province为列名，结果形成列表

province_people = data['count'].values.tolist()

-------- pandas读取excel —— pd.read_excel --------

部分参数说明：

def read_excel(io,

               sheet_name=0,

               header=0,

               names=None,

               index_col=None,

               usecols=None,

               squeeze=False,

               dtype=None,

               engine=None,

               converters=None,

               true_values=None,

               false_values=None,

               skiprows=None,

               nrows=None,

               na_values=None,

               parse_dates=False,

               date_parser=None,

               thousands=None,

               comment=None,

               skipfooter=0,

               convert_float=True,

               **kwds)

io：excel文件路径

sheet_name：string, int, mixed list of strings/ints, or None, default 0，sheet表名

    * Defaults to 0 -> 1st sheet as a DataFrame

    * 1 -> 2nd sheet as a DataFrame

    * "Sheet1" -> 1st sheet as a DataFrame

    * [0,1,"Sheet5"] -> 1st, 2nd & 5th sheet as a dictionary of DataFrames

    * None -> All sheets as a dictionary of DataFrames

header：指定作为列名的行，默认为0，即取第一行作为列名；若数据不含列名，则设定 header = None

names：可用列表等参数指定列名序列，如果没有列名，则需要先设置 header=None；如果只有一列，需要设置为列表形式，例如：['第一列']，否则会出现错误：TypeError: Index(...) must be called with a collection of some kind

names : array-like, default None

    List of column names to use. If file contains no header row,

    then you should explicitly pass header=None

index_col：以某一列作为行标签，也就是行索引

skiprows：从头开始跳过的行数，可以传列表

skipfooter：省略从末尾开始的行数

na_values：识别NA/NaN数据，并替换为该值

na_values : scalar, str, list-like, or dict, default None

    Additional strings to recognize as NA/NaN. If dict passed, specific

    per-column NA values. By default the following values are interpreted

    as NaN: '""" + fill("', '".join(sorted(_NA_VALUES)), 70, subsequent_indent="    ") + """'.

squeeze：当传入数据只有一列时，返回序列Series，而不是Dataframe数据

squeeze : boolean, default False

    If the parsed data only contains one column then return a Series

nrows：要解析的行数

nrows : int, default None

    Number of rows to parse

    .. versionadded:: 0.23.0

## 欢迎有错误进行指正，也可交流改进

Python使用xlrd、pandas包从Excel读取数据的更多相关文章

沉淀，再出发：python中的pandas包
沉淀,再出发:python中的pandas包一.前言 python中有很多的包,正是因为这些包工具才使得python能够如此强大,无论是在数据处理还是在web开发,python都发挥着重要的作用,下 ...
Python数据分析：pandas玩转Excel （二）
1 对Excel文件的操作方法一: 使用xlrd库或者xlwt库进行对excel表格的操作读与写: 方法二: pandas库同样支持excel的读写操作:且更加简便. 2 pd.read_excel ...
Python之路-pandas包的详解与使用
什么是pandas pandas是一种Python数据分析的利器,是一个开源的数据分析包,最初是应用于金融数据分析工具而开发出来的,因此pandas为时间序列分析提供了很好的支持.pandas是PyD ...
TestNG参数化测试之Excel读取数据
1.新建Excel文档,准备好测试数据在当前工程的resources目录下,新建文件名为testdata的Excel文档打开Excel,将当前sheet重命名为calculator,构造num1. ...
Jmeter 5.1 从excel读取数据执行接口自动化
思路:数据在excel文件中进行维护,然后转换成csv格式,jme中读取数据执行: 1.将接口各数据在excel文件中进行维护,然后存为csv格式,我的数据如下: 2.jmeter脚本,配置csv文件 ...
python第二十九课——文件读写(读取数据操作)
演示读取数据操作:path=r'a.txt' 1.打开文件f1=open(path,'r') 2.读取数据content1=f1.read(3)print(content1) content1=f1. ...
python之从文件中按行读取数据
#!/usr/bin/env python3 # -*- coding: utf-8 -*- __author__ = 'jiangwenwen' # 从文件中按行读取数据 file = open(& ...
python使用xlrd和xlwt读写Excel文件
版权声明:本文为博主原创文章,未经允许不得转载. 安装模块如果使用的是Linux系统,并且安装了pip,可以直接使用pip安装xlrd, xlwt: pip install xlwt pip ins ...
Python数据分析：pandas玩转Excel （一）
目录 1 pandas简介 2 导入 3 使用 4 读取.写入 1 pandas简介 1.Pandas是什么? Pandas是一个强大的分析结构化数据的工具集: 它的使用基础是Numpy(提供高性能的 ...

随机推荐

AWS 身份及验证服务（四）
IAM 概述集中管理访问AWS资源的访问权限和用户身份认证支持联合访问管理,支持LADP第三方服务 (Identity Provider) 是非区域相关的服务,全局有效创建用户.组和角色以应用策 ...
关于TV工厂菜单参数的具体说明
1.ADC Adjust 此项是针对YPbPr.VGA端口进行处理的,在三路R/G/B或者YPb/Pr信号输入到芯片时候,由于存在硬件上的偏差,导致信号和标准信号存在偏差,需要对信号进行ADC校正.光 ...
Linux 线程实现机制分析(转载)
自从多线程编程的概念出现在 Linux 中以来,Linux 多线应用的发展总是与两个问题脱不开干系:兼容性.效率.本文从线程模型入手,通过分析目前 Linux 平台上最流行的 LinuxThreads ...
[转帖]JAVA虚拟机和安卓虚拟机的区别
作者:天光链接:https://www.zhihu.com/question/20207106/answer/14654536来源:知乎著作权归作者所有.商业转载请联系作者获得授权,非商业转载请注明出 ...
快速搭建ssh项目
环境:oracle11g.myeclipse2014 首先在web项目中添加spring框架现在已经添加完spring框架了然后我们开始添加Hibernate框架到这一步Hibernate框架就 ...
java并发知识点
前言先列出java并发涉及的知识点,后面再慢慢补. java并发 1 常见概念进程/线程进程:程序执行的实体,操作系统资源调度资源分配的基本单元线程:程序执行的最小单元,拥有独立的堆栈和局部变 ...
解决idea中maven项目无法读取src/main/java目录下面的配置文件问题
解决idea中maven项目无法读取src/main/java目录下面的配置文件问题当我们在maven项目中使用Mybatis的时候,需要给Mybatis配置核心xml文件(MyBatis-Conf ...
python学习-51 shelve模块
import shelve f=shelve.open(r'shelve') #f['stu_info'] = {'name':'john','age':'18'} #f['stu2_info'] = ...
ps 指令
ps显示系统当前进程信息, ps 存在多个版本,因此 ps options 的种类繁多.这里只列举平时开发过程中常用的命令,如果有错误或者更好的例子.烦请在评论区指出语法 ps [options] ...
C#进阶系列——WebApi接口返回值类型详解
阅读目录一.void无返回值二.IHttpActionResult 1.Json(T content) 2.Ok(). Ok(T content) 3.NotFound() 4.其他 5.自定义I ...

Python使用xlrd、pandas包从Excel读取数据

Python使用xlrd、pandas包从Excel读取数据的更多相关文章

随机推荐

热门专题