目标

用paddlepaddle来重写之前那个手写的梯度下降方案，简化内容

流程

实际上就做了几个事：

数据准备：将一个批次的数据先转换成nparray格式，再转换成Tensor格式
前向计算：将一个批次的样本数据灌入网络中，计算出结果
计算损失函数：以前向计算的结果和真是房价作为输入，通过算是函数sqare_error_cost计算出损失函数。
反向传播：执行梯度反向传播backward函数，即从后到前逐层计算每一层的梯度，并根据设置的优化算法更新参数(opt.step函数)。

paddlepaddle做了什么？

paddle库替你做了前向计算和损失函数计算，以及反向传播相关的计算函数

数据准备

这部分代码和之前一样，读取数据是独立的

点击查看代码

#数据划分函数不依赖库，还是自己读

def load_data():

    # 从文件导入数据

    datafile = './work/housing.data'

    data = np.fromfile(datafile, sep=' ', dtype=np.float32)

    # 每条数据包括14项，其中前面13项是影响因素，第14项是相应的房屋价格中位数

    feature_names = [ 'CRIM', 'ZN', 'INDUS', 'CHAS', 'NOX', 'RM', 'AGE', \

                      'DIS', 'RAD', 'TAX', 'PTRATIO', 'B', 'LSTAT', 'MEDV' ]

    feature_num = len(feature_names)

    # 将原始数据进行Reshape，变成[N, 14]这样的形状

    data = data.reshape([data.shape[0] // feature_num, feature_num])

    # 将原数据集拆分成训练集和测试集

    # 这里使用80%的数据做训练，20%的数据做测试

    # 测试集和训练集必须是没有交集的

    ratio = 0.8

    offset = int(data.shape[0] * ratio)

    training_data = data[:offset]

    # 计算train数据集的最大值，最小值

    maximums, minimums = training_data.max(axis=0), training_data.min(axis=0)

    # 记录数据的归一化参数，在预测时对数据做归一化

    global max_values

    global min_values

    max_values = maximums

    min_values = minimums

    # 对数据进行归一化处理

    for i in range(feature_num):

        data[:, i] = (data[:, i] - min_values[i]) / (maximums[i] - minimums[i])

    # 训练集和测试集的划分比例

    training_data = data[:offset]

    test_data = data[offset:]

    return training_data, test_data

定义一个依赖paddle库的类

点击查看代码

class Regressor(paddle.nn.Layer):

    #self代表对象自身

    def __init__(self):

        #初始化父类的参数

        super(Regressor, self).__init__()

        #定义一层全连接层，输入维度是13，输出维度是1

        self.fc = Linear(in_features=13, out_features=1)

    #网络的前向计算函数

    def forward(self, inputs):

        x = self.fc(inputs)

        return x

在上面这个类中，不论是前向计算还是初始化，都是继承了这个paddle.nn.Layer类，用其内部的成员函数执行的

代码

我们定义一个循环来执行这个流程，如下：

点击查看代码

EPOCH_NUM = 10   # 设置外层循环次数

BATCH_SIZE = 10  # 设置batch大小

# 定义外层循环

for epoch_id in range(EPOCH_NUM):

    # 在每轮迭代开始之前，将训练数据的顺序随机的打乱

    np.random.shuffle(training_data)

    # 将训练数据进行拆分，每个batch包含10条数据

    mini_batches = [training_data[k:k+BATCH_SIZE] for k in range(0, len(training_data), BATCH_SIZE)]

    # 定义内层循环

    for iter_id, mini_batch in enumerate(mini_batches):

        x = np.array(mini_batch[:, :-1]) # 获得当前批次训练数据

        y = np.array(mini_batch[:, -1:]) # 获得当前批次训练标签（真实房价）

        # 将numpy数据转为飞桨动态图tensor的格式

        house_features = paddle.to_tensor(x)

        prices = paddle.to_tensor(y)

        # 前向计算

        predicts = model(house_features)

        # 计算损失

        loss = F.square_error_cost(predicts, label=prices)

        avg_loss = paddle.mean(loss)

        if iter_id%20==0:

            print("epoch: {}".format(epoch_id))

            print("iter: {}".format(str(iter_id)))

            print("loss is : {}".format(float(avg_loss)))

        # 反向传播，计算每层参数的梯度值

        avg_loss.backward()

        # 更新参数，根据设置好的学习率迭代一步

        opt.step()

        # 清空梯度变量，以备下一轮计算

        opt.clear_grad()

保存模型

在梯度下降得到一个模型了之后，可以把这个神经网络模型保存下来

点击查看代码

paddle.save(model.state_dict(), 'LR_model.pdparams')

print("模型保存成功，模型参数保存在LR_model.pdparams中")

读取模型

在启动模型之前，当然可以读取这样一个模型：

点击查看代码

def load_one_example():

    # 从上边已加载的测试集中，随机选择一条作为测试数据

    idx = np.random.randint(0, test_data.shape[0])

    idx = -10

    one_data, label = test_data[idx, :-1], test_data[idx, -1]

    # 修改该条数据shape为[1,13]

    one_data =  one_data.reshape([1,-1])

    return one_data, label        

# 参数为保存模型参数的文件地址

#读取保存模型

model_dict = paddle.load('LR_model.pdparams')

model.load_dict(model_dict) #读取模型文件

model.eval()	#转变为预测模式

尝试进行预测

点击查看代码

# 参数为数据集的文件地址

one_data, label = load_one_example()

# 将数据转为动态图的variable格式

one_data = paddle.to_tensor(one_data)

#model是定义的模型，这个model(one_data)实际上是对one_Data进行了一次前向传播

predict = model(one_data)

# 因为这个predict的值实际上是做了归一化处理的，所以这里需要进行反归一化处理

predict = predict * (max_values[-1] - min_values[-1]) + min_values[-1]

# 对label数据做反归一化处理

label = label * (max_values[-1] - min_values[-1]) + min_values[-1]

#模型预测值是22.72234,，实际值是19.700000762939453

print("Inference result is {}, the corresponding label is {}".format(predict.numpy(), label))

机器学习笔记（二）使用paddlepaddle，再探波士顿房价预测的更多相关文章

机器学习实战二：波士顿房价预测 Boston Housing
波士顿房价预测 Boston housing 这是一个波士顿房价预测的一个实战,上一次的Titantic是生存预测,其实本质上是一个分类问题,就是根据数据分为1或为0,这次的波士顿房价预测更像是预测一 ...
波士顿房价预测 - 最简单入门机器学习 - Jupyter
机器学习入门项目分享 - 波士顿房价预测该分享源于Udacity机器学习进阶中的一个mini作业项目,用于入门非常合适,刨除了繁琐的部分,保留了最关键.基本的步骤,能够对机器学习基本流程有一个最清晰 ...
深度学习-06(PaddlePaddle体系结构与基本概念[Tensor、Layer、Program、Variable、Executor、Place]线性回归、波士顿房价预测)
文章目录深度学习-06(PaddlePaddle基础) paddlePaddle概述 PaddlePaddle简介什么是PaddlePaddle 为什么学习PaddlePaddle PaddleP ...
《用Python玩转数据》项目—线性回归分析入门之波士顿房价预测（二）
接上一部分,此篇将用tensorflow建立神经网络,对波士顿房价数据进行简单建模预测. 二.使用tensorflow拟合boston房价datasets 1.数据处理依然利用sklearn来分训练集 ...
Tensorflow之多元线性回归问题（以波士顿房价预测为例）
一.根据波士顿房价信息进行预测,多元线性回归+特征数据归一化 #读取数据 %matplotlib notebook import tensorflow as tf import matplotlib. ...
Android学习笔记（四）——再探Intent
//此系列博文是<第一行Android代码>的学习笔记,如有错漏,欢迎指正! 我们可以使用 Intent 来启动一个活动, 还可以在启动活动的时候传递数据的,下面一起来看一下: 一.向下一 ...
机器学习笔记(二)- from Andrew Ng的教学视频
省略了Octave的使用方法结束,以后用得上再看吧 week three: Logistic Regression: 用于0-1分类 Hypothesis Representation: :Sigmo ...
【Head First Servlets and JSP】笔记14：session再探 & Listener示例
对于session的“CRUD” 会话迁移别忘了HttpSessionBindingListener Listener示例 1.session的“增”与“删”——session的创建和撤销的调用主体 ...
【udacity】机器学习-波士顿房价预测小结
Evernote Export 机器学习的运行步骤 1.导入数据没什么注意的,成功导入数据集就可以了,打印看下数据的标准格式就行用个info和describe 2.分析数据这里要详细分析数据的内 ...
【udacity】机器学习-波士顿房价预测
import numpy as np import pandas as pd from Udacity.model_check.boston_house_price import visuals as ...

随机推荐

Java核心知识体系8：Java如何保证线程安全性
Java核心知识体系1:泛型机制详解 Java核心知识体系2:注解机制详解 Java核心知识体系3:异常机制详解 Java核心知识体系4:AOP原理和切面应用 Java核心知识体系5:反射机制详解 J ...
Java操作Word修订功能：启用、接受、拒绝、获取修订
Word的修订功能是一种在文档中进行编辑和审阅的功能.它允许多个用户对同一文档进行修改并跟踪这些修改,以便进行审查和接受或拒绝修改.修订功能通常用于团队合作.专业编辑和文件审查等场景. 本文将从以下几 ...
有了Excel和PPT，为什么我们还需要数据可视化工具？
在当今信息时代,数据扮演着越来越重要的角色,而数据的可视化呈现正是一种强大的工具,能够帮助我们更好地理解和利用这些数据.虽然Excel和PPT在处理数据方面有着不可否认的作用,但在处理大规模.复杂数据 ...
从零玩转设计模式之抽象工厂设计模式-chouxiangshejimoshi
title: 从零玩转设计模式之抽象工厂设计模式 date: 2022-12-08 16:05:03.28 updated: 2022-12-11 23:03:16.842 url: https:// ...
ESXi6.7物理机安装之网卡驱动封装Realtek PCIe GBE Family Controller =瑞昱r8168网卡驱动
https://blog.whsir.com/post-3423.html "我这里先提供一个ESXI6.5封装好的r8168网卡驱动ESXI6.5u2.iso,如果你的网卡也是这个,可以直 ...
JavaScript异步编程3——Promise的链式使用
目录概述详论 1️⃣回调地狱 2️⃣Promise实现参考概述在上一篇文章<JavaScript异步编程2--结合XMLHttpRequest使用Promise>中,简要介绍了A ...
Cesium案例解析(九)——Rotatable2DMap旋转2D地图
目录 Cesium的Rotatable 2D Map示例展示了一个旋转的二维地图: 'use strict'; var viewer = new Cesium.Viewer('cesiumContai ...
问鼎CodeXGLUE榜单，华为云UniXcoder-VESO-v1算法取得突破
摘要:华为云PaaS技术创新团队基于UniXcoder模型,在公开测试数据集(CodeXGLUE)上的代码搜索任务评测结果上取得突破,在CodeXGLUE榜单上排名中第一. 本文分享自华为云社区< ...
火山引擎 VeDI 零售行业解决方案聚焦精准营销场景提升品牌转化
更多技术交流.求职机会,欢迎关注字节跳动数据平台微信公众号,回复[1]进入官方交流群你知道,为了能让你买到合适的商品,品牌商们有多努力吗? 精准营销并不是一个新词,但近年来,随着营销渠道/平台的更加 ...
使用 docker-compose 部署 folkmq 消息中间件
仓库拉取 docker-compose.yml 文件: https://github.com/noear/folkmq/tree/main/deploy version: '3.5' services ...

机器学习笔记（二）使用paddlepaddle，再探波士顿房价预测

目标

流程

paddlepaddle做了什么？

数据准备

定义一个依赖paddle库的类

代码

保存模型

读取模型

尝试进行预测

机器学习笔记（二）使用paddlepaddle，再探波士顿房价预测的更多相关文章

随机推荐

热门专题