示例python 批量操作excel统计销售榜品牌及销售额
示例统计销售榜品牌及销售额
import pandas as pd
import numpy as np
import os os.chdir('F:\\50mat\源数据1000张表格') name = '户外服装&滑雪衣.xlsx'
df = pd.read_excel(name)
df.head()
打印结果
日期 转化率 访客数 三级类目 客单价 品牌
0 2019-08 0.036466 837 滑雪衣 3887.646034 品牌-5
1 2019-08 0.006110 9951 滑雪衣 1890.920192 品牌-7
2 2019-08 0.008279 11067 滑雪衣 1001.541028 品牌-19
3 2019-08 0.003647 25296 滑雪衣 986.192182 品牌-17
4 2019-08 0.006012 5053 滑雪衣 2818.957816 品牌-14
df['日期'].unique()
打印结果
array(['2019-08', '2019-07', '2019-06', '2019-05', '2019-04', '2019-03',
'2019-02', '2019-01', '2018-12', '2018-11', '2018-10', '2018-09'],
dtype=object)
一:操作单表
销售额
df['销售额'] = df['访客数'] * df['转化率'] * df['客单价'] df.head()
打印结果
日期 转化率 访客数 三级类目 客单价 品牌 销售额
0 2019-08 0.036466 837 滑雪衣 3887.646034 品牌-5 118657.898127
1 2019-08 0.006110 9951 滑雪衣 1890.920192 品牌-7 114977.898920
2 2019-08 0.008279 11067 滑雪衣 1001.541028 品牌-19 91761.540049
3 2019-08 0.003647 25296 滑雪衣 986.192182 品牌-17 90969.935091
4 2019-08 0.006012 5053 滑雪衣 2818.957816 品牌-14 85634.834594
二:汇总销售额
# 汇总销售额
df_sum = df.groupby('品牌')['销售额'].sum().reset_index()
df_sum.head()
打印结果
品牌 销售额
0 品牌-1 5.479539e+06
1 品牌-10 2.913271e+06
2 品牌-11 2.298716e+06
3 品牌-12 2.821199e+06
4 品牌-13 3.256508e+06
添加行业标签
# 添加行业标签
df_sum['行业'] = name.replace('.xlsx','') df_sum.head()
打印结果
品牌 销售额 行业
0 品牌-1 5.479539e+06 户外服装&滑雪衣
1 品牌-10 2.913271e+06 户外服装&滑雪衣
2 品牌-11 2.298716e+06 户外服装&滑雪衣
3 品牌-12 2.821199e+06 户外服装&滑雪衣
4 品牌-13 3.256508e+06 户外服装&滑雪衣
三:操作所有表格
import time start = time.time() result = pd.DataFrame() for name in os.listdir():
df = pd.read_excel(name)
df['销售额'] = df['访客数'] * df['转化率'] * df['客单价']
df_sum = df.groupby('品牌')['销售额'].sum().reset_index()
df_sum['行业标签'] = name.replace('.xlsx','') result = pd.concat([result,df_sum]) final = result.groupby('品牌')['销售额'].sum().reset_index().sort_values('销售额', ascending = False) end = time.time() print('操作用时:{}s'.format(end-start))
操作用时:6.295360088348389s
# 将科学计算法,改为两位小数
pd.set_option('display.float_format', lambda x :'%.2f' % x) print(final.head())
final.describe()
打印结果
品牌 销售额
15 品牌-5 1226223640.73
8 品牌-17 1195280571.60
2 品牌-11 1151829215.73
4 品牌-13 1150687029.66
3 品牌-12 1143519788.23
销售额
count 20.00
mean 1084854125.76
std 63774592.90
min 979272391.61
25% 1050719265.66
50% 1071804742.94
75% 1118990465.22
max 1226223640.73
七:数据分析模型
# 表格处理示例:销售榜品牌及销售额 import pandas as pd
import numpy as np
import os
import time
os.chdir('F:\\50mat\源数据1000张表格') name = '户外服装&滑雪衣.xlsx'
df = pd.read_excel(name) result = pd.DataFrame() for name in os.listdir():
df = pd.read_excel(name)
df['销售额'] = df['访客数'] * df['转化率'] * df['客单价']
df_sum = df.groupby('品牌')['销售额'].sum().reset_index()
df_sum['行业标签'] = name.replace('.xlsx','') result = pd.concat([result,df_sum]) final = result.groupby('品牌')['销售额'].sum().reset_index().sort_values('销售额', ascending = False) # 将科学计算法,改为两位小数
pd.set_option('display.float_format', lambda x :'%.2f' % x) print(final.head(10))
加油:一只阿木木
示例python 批量操作excel统计销售榜品牌及销售额的更多相关文章
- 使用Python处理Excel文件的一些代码示例
笔记:使用Python处理Excel文件的一些代码示例,以下代码来自于<Python数据分析基础>一书,有删改 #!/usr/bin/env python3 # 导入读取Excel文件的库 ...
- python制作简单excel统计报表3之将mysql数据库中的数据导入excel模板并生成统计图
python制作简单excel统计报表3之将mysql数据库中的数据导入excel模板并生成统计图 # coding=utf-8 from openpyxl import load_workbook ...
- python制作简单excel统计报表2之操作excel的模块openpyxl简单用法
python制作简单excel统计报表2之操作excel的模块openpyxl简单用法 # coding=utf-8 from openpyxl import Workbook, load_workb ...
- Python导出Excel为Lua/Json/Xml实例教程(二):xlrd初体验
Python导出Excel为Lua/Json/Xml实例教程(二):xlrd初体验 相关链接: Python导出Excel为Lua/Json/Xml实例教程(一):初识Python Python导出E ...
- python操作excel表格(xlrd/xlwt)
最近遇到一个情景,就是定期生成并发送服务器使用情况报表,按照不同维度统计,涉及python对excel的操作,上网搜罗了一番,大多大同小异,而且不太能满足需求,不过经过一番对源码的"研究&q ...
- Python处理Excel(转载)
1. Python 操作 Excel 的函数库 我主要尝试了 3 种读写 Excel 的方法: 1> xlrd, xlwt, xlutils: 这三个库的好处是不需要其它支持,在任何操作系统上都 ...
- python处理Excel - xlrd xlwr openpyxl
python处理Excel - xlrd xlwr openpyxl 1 xlrd和xlwt Todo: 使用xlrd和xlwt读写Excel文件的方法和示例代码,待续... 参考链接: Creati ...
- 【转】python操作excel表格(xlrd/xlwt)
[转]python操作excel表格(xlrd/xlwt) 最近遇到一个情景,就是定期生成并发送服务器使用情况报表,按照不同维度统计,涉及python对excel的操作,上网搜罗了一番,大多大同小异, ...
- Python实现代码统计工具——终极加速篇
Python实现代码统计工具--终极加速篇 声明 本文对于先前系列文章中实现的C/Python代码统计工具(CPLineCounter),通过C扩展接口重写核心算法加以优化,并与网上常见的统计工具做对 ...
- Python 利用Python操作excel表格之xlwt介绍
利用Python操作excel表格之xlwt介绍 by:授客 QQ:1033553122 直接上代码 案例1 #!/usr/bin/env python # -*- coding:utf-8 ...
随机推荐
- Linux Centos7搭建RabbitMQ
下载依赖 yum -y install epel-release yum -y update 安装Erlang yum -y install erlang socat 测试安装成功 erl -vers ...
- yb课堂之单机和分布式应用的登陆校验解决方案 《七》
单机tomcat应用登陆校验 session保存在浏览器和应用服务器会话之间 用户登陆成功,服务端会保存一个session,当然客户端有一个sessionId 客户端会把sessionId保存在coo ...
- 全网最适合入门的面向对象编程教程:06 类和对象的Python实现-自定义类的数据封装
全网最适合入门的面向对象编程教程:06 类和对象的 Python 实现-自定义类的数据封装 摘要: 本文我们主要介绍了数据封装的基本概念和特性,如何设置自定义类的私有属性和私有方法,protect 属 ...
- Display、Visibility 和 Opacity 的区别
<style> .d1{ display: none; } .d2{ visibility: visible; } .d3{ opacity: 0; } </style> &l ...
- 题解:P10672 【MX-S1-T1】壁垒
暑期集训=依托答辩. 分析 种类数是奇数一定无解. 否则每种数字先输出一次,在此过程中每增加两个数时,因为每个数字种类数都不一样,所以前缀种类数也同时增加 \(2\),保证一定为偶数. 然后输出完以后 ...
- __int128的输入输出(快读快输)
引言:__int128不能用\(cin\)\(cout\)或\(scanf\)\(printf\). 快读 思想:把每一个字符读入,组成数字. int read(){ int x = 0,y = 1; ...
- Net8将Serilog日志推送ES,附视频
这是一个Serilog的实践Demo,包括了区别记录存放,AOP 日志记录,EF 执行记录,并且将日志推送到Elastic Search. 说在前面的话 自从AI出来之后,学习的曲线瞬间变缓了,学习的 ...
- Jmeter函数助手27-urlencode
urlencode函数用于将字符串进行application/x-www-form-urlencoded编码格式化. String to encode in URL encoded chars:填入字 ...
- 轻松搞定 Nginx 在 CentOS 和 Ubuntu 上的安装与配置
注:这是对我以前博客进行优化后再次发布的,博客中的截图为以前的.原博客已删除. 如何安装nginx nginx是一款开源.高性能的Web和反向代理服务器,支持HTTP.HTTPS.SMTP.POP3和 ...
- 买二手NVIDIA网卡被坑记录:某宝的咸鱼二手交易网站上购入NVIDIA Mellanox ConnectX-3 网卡 居然不支持Windows 11操作系统 —— 老二手40Gbps的NVIDIA网卡已经不被新操作系统支持
原本是打算去大连的人工智能计算中心去做技术负责人的,不过考虑到工作性质再考虑到自己的一些现实情况也就放弃了这个职位(比较在大连理工大学的博士学位还没有读下来,还是有所牵挂的).同时,由于自己已经退出了 ...