2003031121-浦娟-python数据分析五一假期作业

项目	内容
课程班级博客链接	20级数据班（本）
这个作业要求链接	Python作业
博客名称	2003031121-浦娟-python数据分析五一假期作业
要求	每道题要有题目,代码(使用插入代码,不会插入代码的自己查资料解决，不要直接截图代码！！),截图（只截运行结果）。

作业：

把期中考试代码看懂、运行并调通，要求每一行或每个重要功能写上注释。

一、分析1996~2015年人口数据特征间的关系

import numpy as np

import matplotlib.pyplot as plt

#使⽤numpy库读取数据

data=np.load('E:/桌面/populations.npz',allow_pickle=True)

print(data.files)#查看⽂件中的数组

print(data['data'])

print(data['feature_names'])

plt.rcParams['font.sans-serif'] = 'SimHei' # 设置中文显示

plt.rcParams['axes.unicode_minus'] = False# 防止字符无法显示

name=data['feature_names']#提取其中的feature_names数组，视为数据的标签

values=data['data']#提取其中的data数组，视为数据的存在位置

p1=plt.figure(figsize=(12,12))#确定画布大小

pip1=p1.add_subplot(2,1,1)#创建一个两行个一列的图并开始绘制

#在子图上绘制散点图

plt.scatter(values[0:20,0],values[0:20,1])#,marker='8',color='red'

plt.ylabel('总人口（万人）')

plt.legend('年末')

plt.title('1996~2015年末与各类人口散点图')

pip2=p1.add_subplot(2,1,2)#绘制图2

plt.scatter(values[0:20,0],values[0:20,2])#,marker='o',color='yellow'

plt.scatter(values[0:20,0],values[0:20,3])#,marker='D',color='green'

plt.scatter(values[0:20,0],values[0:20,4])#,marker='p',color='blue'

plt.scatter(values[0:20,0],values[0:20,5])#,marker='s',color='purple'

plt.xlabel('时间')

plt.ylabel('总人口（万人）')

plt.xticks(values[0:20,0])

plt.legend(['男性','女性','城镇','乡村'])

#在⼦图上绘制折线图

p2=plt.figure(figsize=(12,12))

p1=p2.add_subplot(2,1,1)

plt.plot(values[0:20,0],values[0:20,1])#,linestyle = '-',color='r',marker='8'

plt.ylabel('总人口（万人）')

plt.xticks(range(0,20,1),values[range(0,20,1),0],rotation=45)#rotation设置倾斜度

plt.legend('年末')

plt.title('1996~2015年末总与各类人口折线图')

p2=p2.add_subplot(2,1,2)

plt.plot(values[0:20,0],values[0:20,2])#,'y-'

plt.plot(values[0:20,0],values[0:20,3])#,'g-.'

plt.plot(values[0:20,0],values[0:20,4])#,'b-'

plt.plot(values[0:20,0],values[0:20,5])#,'p-'

plt.xlabel('时间')

plt.ylabel('总人口（万人）')

plt.xticks(values[0:20,0])

plt.legend(['男性','女性','城镇','乡村'])

#显示图片

plt.show()

二、读取并查看P2P网络贷款数据主表的基本信息

import os

import pandas as pd

master = pd.read_csv('E:/桌面/Training_Master .csv',encoding='gbk')

print('P2P网络贷款主表数据的维度为：',master.ndim)

print('P2P网络贷款主表数据的形状大小为：',master.shape)

print('P2P网络贷款主表数据的占用内存为：',master.memory_usage)

print('P2P网络贷款主表数据的描述性统计为：\n',master.describe())

三、提取用户信息更新表和登录信息表的时间信息

import pandas as pd

LogInfo  = pd.read_csv('E:/桌面/Training_LogInfo .csv',encoding='gbk')

Userupdate   = pd.read_csv('E:/桌面/Training_Userupdate.csv',encoding='gbk')

# 转换时间字符串

LogInfo['Listinginfo1']=pd.to_datetime(LogInfo['Listinginfo1'])

LogInfo['LogInfo3']=pd.to_datetime(LogInfo['LogInfo3'])

print('转换登录信息表的时间字符串前5行：\n',LogInfo.head())

Userupdate['ListingInfo1']=pd.to_datetime(Userupdate['ListingInfo1'])

Userupdate['UserupdateInfo2']=pd.to_datetime(Userupdate['UserupdateInfo2'])

print('转换用户信息更新表的时间字符串前5行：\n',Userupdate.head())

四、使用分组聚合方法进一步分析用户信息更新表和登录信息表

import pandas as pd

import numpy as np

LogInfo  = pd.read_csv('E:/桌面/Training_LogInfo .csv',encoding='gbk')

Userupdate   = pd.read_csv('E:/桌面/Training_Userupdate.csv',encoding='gbk')

# 使用groupby方法对用户信息更新表和登录信息表进行分组

LogGroup = LogInfo[['Idx','LogInfo3']].groupby(by = 'Idx')

UserGroup = Userupdate[['Idx','UserupdateInfo2']].groupby(by = 'Idx')

# 使用agg方法求取分组后的最早，最晚，更新登录时间

print('分组后的最早登录时间为：\n',LogGroup.agg(np.min))

print('分组后的最晚登录时间为：\n',LogGroup.agg(np.max))

print('分组后的最早更新时间为：\n',UserGroup.agg(np.min))

print('分组后的最晚更新时间为：\n',UserGroup.agg(np.max))

# 使用size方法求取分组后的数据的信息更新次数与登录次数

print('分组后的数据的信息更新次数为：\n',LogGroup.size())

print('分组后的数据的登录次数为：\n',UserGroup.size())

2003031121-浦娟-python数据分析五一假期作业的更多相关文章

2003031121——浦娟——Python数据分析第七周作业——MySQL的安装及使用
项目要求课程班级博客链接 20级数据班(本) 作业要求链接 Python第七周作业博客名称 2003031121--浦娟--Python数据分析第七周作业--MySQL的安装及使用要求每道题 ...
2003031121-浦娟-python数据分析第四周作业-第二次作业
项目内容课程班级博客链接 20级数据班(本) 作业链接 Python第四周作业第二次作业博客名称 2003031121-浦娟-python数据分析第四周作业-matolotlib的应用要求每 ...
2003031121-浦娟-python数据分析第三周作业-第一次作业
项目内容课程班级博客链接 https://edu.cnblogs.com/campus/pexy/20sj 作业链接 https://edu.cnblogs.com/campus/pexy/20s ...
Python 数据分析（二本实验将学习利用 Python 数据聚合与分组运算，时间序列，金融与经济数据应用等相关知识
Python 数据分析(二) 本实验将学习利用 Python 数据聚合与分组运算,时间序列,金融与经济数据应用等相关知识第1节 groupby 技术第2节数据聚合第3节分组级运算和转换第4 ...
Python数据分析(二): Numpy技巧 (2/4)
numpy.pandas.matplotlib(+seaborn)是python数据分析/机器学习的基本工具. numpy的内容特别丰富,我这里只能介绍一下比较常见的方法和属性. 昨天晚上发了第一 ...
Python数据分析(二): Numpy技巧 (3/4)
numpy.pandas.matplotlib(+seaborn)是python数据分析/机器学习的基本工具. numpy的内容特别丰富,我这里只能介绍一下比较常见的方法和属性. 昨天晚上发了第一 ...
零基础学习Python数据分析
网上虽然有很多Python学习的教程,但是大多是围绕Python网页开发等展开.数据分析所需要的Python技能和网页开发等差别非常大,本人就是浪费了很多时间来看这些博客.书籍.所以就有了本文,希望能 ...
［Python数据分析］新股破板买入，赚钱几率如何？
这是本人一直比较好奇的问题,网上没搜到,最近在看python数据分析,正好自己动手做一下试试.作者对于python是零基础,需要从头学起. 在写本文时,作者也没有完成这个小分析目标,边学边做吧. ＝＝ ...
【Python数据分析】Python3多线程并发网络爬虫-以豆瓣图书Top250为例
基于上两篇文章的工作 [Python数据分析]Python3操作Excel-以豆瓣图书Top250为例 [Python数据分析]Python3操作Excel(二) 一些问题的解决与优化已经正确地实现 ...

随机推荐

如何实现 Spring Boot 应用程序的安全性？
为了实现 Spring Boot 的安全性,我们使用 spring-boot-starter-security 依赖项,并且必须添加安全配置.它只需要很少的代码.配置类将必须扩展WebSecurity ...
SpringBoot DevTools 的用途是什么？
SpringBoot 开发者工具,或者说 DevTools,是一系列可以让开发过程变得简便的工具.为了引入这些工具,我们只需要在 POM.xml 中添加如下依赖: 1 <dependency&g ...
synchronize、Lock、ReenTrantLock 的区别
synchronize 和Lock: 1.synchronize 系java 内置关键字:而Lock 是一个类 2.synchronize 可以作用于变量.方法.代码块:而Lock 是显式地指定开始和 ...
Spring与Web项目整合的原理
引言: 在刚开始我们接触IOC时,我们加载并启用SpringIOC是通过如下代码手动加载 applicationContext.xml 文件,new出context对象,完成Bean的创建和属性的注入 ...
Flask 简单使用,这一篇就够了!
#Flask 安装依赖包及作用 - jinja2 模板语言 (flask依赖包) - markupsafe 防止css攻击 (flask依赖包) - werkzeug --wkz 类似于django中 ...
（stm32学习总结）—SPI-FLASH 实验
SPI总线 SPI 简介 SPI 的全称是"Serial Peripheral Interface",意为串行外围接口,是Motorola 首先在其 MC68HCXX 系列处理器上 ...
决策树算法4:CHAID
原理: 其中 n = a+b+c+d 卡方计算(例子)使用 sklearn完成 data.csv中的部分数据 #如何使用卡方检测相关度 from sklearn.feature_selection i ...
c++中的左值和右值的理解
1.左值和右值的概念 C++中左值(lvalue)和右值(rvalue)是比较基础的概念,虽然平常几乎用不到,但C++11之后变得十分重要,它是理解 move/forward 等新语义的基础. 左值与 ...
使用前端开发工具包WijmoJS - 创建自定义DropDownTree控件（包含源代码）
概述最近,有客户向我们请求开发一个前端下拉控件,需求是显示了一个列表,其中包含可由用户单独选择的项目控件,该控件将在下拉列表中显示多选TreeView(树形图). 如今WijmoJS已经实现了该控件 ...
ubantu系统之虚拟机不识别usb接口
1. 下载和 virtualbox 同一版本的 Orcale VM VirtualBox Extension Pack 并在ubantu上安装:2. 启动虚拟机,选中菜单栏中"设置" ...

2003031121-浦娟-python数据分析五一假期作业

2003031121-浦娟-python数据分析五一假期作业的更多相关文章

随机推荐

热门专题