动手学习pytorch——（2）softmax和分类模型

　　内容太多，捡重要的讲。

　　在分类问题中，通常用离散的数值表示类别，这里存在两个问题。1.输出值的范围不确定，很难判断值的意义。2.真实标签是离散值，这些离散值与不确定的范围的输出值之间的误差难以衡量。

　　softmax运算符解决了这两个问题。它把输出值变成了值为正且和为1的概率分布。

　　对于一个分类问题，假设有a个特征，b个样本，c个输出，单层的全连接网络，那么有a*b个w（权重），c个b（偏差）。

　　为了提升计算效率，常对小批量数据做矢量计算。softmax回归的矢量计算表达式如下。

　　计算loss用交叉熵损失函数，如下：

　　最后讲讲softmax的简洁实现：

import torch

from torch import nn

from torch.nn import init

import numpy as np

import sys

sys.path.append("/home/kesci/input")

import d2lzh1981 as d2l

from collections import OrderedDict

batch_size = 256

train_iter, test_iter = d2l.load_data_fashion_mnist(batch_size)

num_inputs = 784

num_outputs = 10

class LinearNet(nn.Module):

    def __init__(self, num_inputs, num_outputs):

        super(LinearNet, self).__init__()

        self.linear = nn.Linear(num_inputs, num_outputs)

    def forward(self, x): # x 的形状: (batch, 1, 28, 28)

        y = self.linear(x.view(x.shape[0], -1))

        return y

class FlattenLayer(nn.Module):

    def __init__(self):

        super(FlattenLayer, self).__init__()

    def forward(self, x): # x 的形状: (batch, *, *, ...)

        return x.view(x.shape[0], -1)

net = nn.Sequential(

        # FlattenLayer(),

        # LinearNet(num_inputs, num_outputs)

        OrderedDict([

           ('flatten', FlattenLayer()),

           ('linear', nn.Linear(num_inputs, num_outputs))]) 

init.normal_(net.linear.weight, mean=0, std=0.01)   #参数初始化

init.constant_(net.linear.bias, val=0)

loss = nn.CrossEntropyLoss()

optimizer = torch.optim.SGD(net.parameters(), lr=0.1)

num_epochs = 5

d2l.train_ch3(net, train_iter, test_iter, loss, num_epochs, batch_size, None, None, optimizer)

代码摘自平台。

动手学习pytorch——（2）softmax和分类模型的更多相关文章

softmax和分类模型
softmax和分类模型内容包含: softmax回归的基本概念如何获取Fashion-MNIST数据集和读取数据 softmax回归模型的从零开始实现,实现一个对Fashion-MNIST训练集 ...
L2 Softmax与分类模型
softmax和分类模型内容包含: softmax回归的基本概念如何获取Fashion-MNIST数据集和读取数据 softmax回归模型的从零开始实现,实现一个对Fashion-MNIST训练集 ...
[ DLPytorch ] 线性回归&Softmax与分类模型&多层感知机
线性回归基础知识实现过程学习笔记批量读取 torch_data = Data.TensorDataset(features, labels) dataset = Data.DataLoader ...
NLP学习（2）----文本分类模型
实战:https://github.com/jiangxinyang227/NLP-Project 一.简介: 1.传统的文本分类方法:[人工特征工程+浅层分类模型] (1)文本预处理: ①(中文) ...
动手学习pytorch——（1）线性回归
最近参加了伯禹教育的动手学习深度学习项目,现在对第一章(线性回归)部分进行一个总结. 这里从线性回归模型之从零开始的实现和使用pytorch的简洁两个部分进行总结. 损失函数,选取平方函数来评估误差, ...
【动手学pytorch】softmax回归
一.什么是softmax? 有一个数组S,其元素为Si ,那么vi 的softmax值,就是该元素的指数与所有元素指数和的比值.具体公式表示为: softmax回归本质上也是一种对数据的估计二.交叉 ...
动手学习Pytorch(4)--过拟合欠拟合及其解决方案
过拟合.欠拟合及其解决方案过拟合.欠拟合的概念权重衰减丢弃法模型选择.过拟合和欠拟合训练误差和泛化误差在解释上述现象之前,我们需要区分训练误差(training error)和泛化误差 ...
动手学习Pytorch(6)--卷积神经网络基础
卷积神经网络基础本节我们介绍卷积神经网络的基础概念,主要是卷积层和池化层,并解释填充.步幅.输入通道和输出通道的含义. 二维卷积层本节介绍的是最常见的二维卷积层,常用于处理图像数据. 二维 ...
动手学习Pytorch(7)--LeNet
Convolutional Neural Networks 使用全连接层的局限性: 图像在同一列邻近的像素在这个向量中可能相距较远.它们构成的模式可能难以被模型识别. 对于大尺寸的输入图像,使用全连接 ...

随机推荐

Scala实践12
1.内部类和抽象类型成员作为对象成员内部类在Scala中,可以让类将其他类作为成员.这些内部类是封闭类的成员.在Scala中,这样的内部类绑定到外部对象.假设希望编译器在编译时阻止我们混合哪些节点 ...
springboot2 整合mongodb
在springboot2中使用MongoDB 1.引入依赖 <dependency> <groupId>org.springframework.boot</groupId ...
bfs + 路径输出
You are given two pots, having the volume of A and B liters respectively. The following operations c ...
Python的re模块，正则表达式用法详解，正则表达式中括号的用法
Python的re模块,正则表达式 #导入re模块 import re 1.match方法的使用: result = re.match(正则表达式,待匹配的字符串) 正则表达式写法: 第一部分: 字 ...
Oracle RAC服务器重启故障排查
Oracle Real Application Clusters(Oracle RAC),相对于Oracle单实例来说部署安装和维护都增加了难度,尤其在日常的维护和故障处理过程中,各种日志的查看更加重 ...
vue引用外部JS的两种种方案
前言肯定会遇到没有npm化的库自己写的js 方法在Vue中该怎么引用呢第一种如果库是es6写的就可以用import 引入比如我自己写的http 封装接口的方法就可以这样子导入哦第二种 ...
java jdk9的特性 jshell
1.进入 jshell 2.推出 /exit() 和python的解释器用法差不多
python练习题-9-6
本代码是<Python核心编程(第二版)>第九章的9-6练习题,完成的功能为:文件比较:比较两个文本文件是否相同,如果不同,给出第一个不同处的行号和列号. #!/usr/bin/env p ...
机器学习-向量机SVM
一.介绍二.编程 1.支持向量机的核函数 import numpy as npimport matplotlib.pyplot as pltfrom sklearn import svmfrom s ...
通过示例学习rholang（上部：课程0-6）
通过例子和实践来学习rho语言.下面的例子和练习都很值得去运行.阅读.修改和完善.修改练习和教程中任何你感到有意思的代码,这样能够获得最好的学习效果.该教程包含了rho语言最常见以及最重要的特性,足以 ...

动手学习pytorch——（2）softmax和分类模型

动手学习pytorch——（2）softmax和分类模型的更多相关文章

随机推荐

热门专题