梯度下降与pytorch

记得在tensorflow的入门里，介绍梯度下降算法的有效性时使用的例子求一个二次曲线的最小值。

这里使用pytorch复现如下：

1、手动计算导数，按照梯度下降计算

import torch

#使用梯度下降法求y=x^2+2x+1 最小值 从x=3开始

x=torch.Tensor([3])

for epoch in range(100):

    y=x**2+2*x+1    

    x-=(2*x+2)*0.05  #导数是 2*x+2

    print('min y={1:.2}, x={0:.2}'.format(x[0],y[0]))

min y=1.6e+01, x=2.6

min y=1.3e+01, x=2.2

min y=1e+01, x=1.9

...

min y=0.0, x=-1.0

min y=0.0, x=-1.0

min y=0.0, x=-1.0

min y=0.0, x=-1.0

2、使用torch的autograd计算

import torch

from torch.autograd import Variable

#使用梯度下降法求y=x^2+2x+1 最小值 从x=3开始

x=Variable(torch.Tensor([3]),requires_grad=True)

for epoch in range(100):

    y=x**2+2*x+1

    y.backward()

    x.data-=x.grad.data*0.05

    x.grad.data.zero_()

    print('min y={1:.2}, x={0:.2}'.format(x.data[0],y.data[0]))

min y=1.6e+01, x=2.6

min y=1.3e+01, x=2.2

min y=1e+01, x=1.9

...

min y=0.0, x=-1.0

min y=0.0, x=-1.0

min y=0.0, x=-1.0

min y=0.0, x=-1.0

下边来实验下使用梯度下降法求解直线回归问题，也就是最小二乘法的梯度下降求解（实际上回归问题的最优方式解广义逆矩阵和值的乘积）

#最小二乘法 拟合y=3x+1

n=100

x=torch.rand((n))

y=x*3+1+torch.rand(n)/5   #y=3x+1

k=Variable(torch.Tensor([1]),requires_grad=True)

b=Variable(torch.Tensor([0]),requires_grad=True)

for epoch in range(100):

    l=torch.sum((k*x+b-y)**2)/100  #MSE 最小二乘法 加上随即噪声

    l.backward()

    k.data-=k.grad.data*0.3

    b.data-=b.grad.data*0.3

    print("k={:.2},b={:.2},l={:.2}".format(k.data[0],b.data[0],l.data))

    k.grad.data.zero_()

    b.grad.data.zero_()

k=1.7,b=1.3,l=4.7

k=1.9,b=1.5,l=0.37

k=2.0,b=1.6,l=0.11

k=2.1,b=1.6,l=0.088

k=2.1,b=1.6,l=0.081

k=2.1,b=1.6,l=0.075

...

k=3.0,b=1.1,l=0.0033

k=3.0,b=1.1,l=0.0033

k=3.0,b=1.1,l=0.0033

同样也可以使用torch里内置的mseloss

#最小二乘法 拟合y=3x+1

n=100

x=torch.rand((n))

y=x*3+1+torch.rand(n)/5   #y=3x+1 加上随机噪声

k=Variable(torch.Tensor([1]),requires_grad=True)

b=Variable(torch.Tensor([0]),requires_grad=True)

loss=torch.nn.MSELoss()

for epoch in range(100):

    l=loss(k*x+b,y)    #MSE 最小二乘法

    l.backward()

    k.data-=k.grad.data*0.3

    b.data-=b.grad.data*0.3

    print("k={:.2},b={:.2},l={:.2}".format(k.data[0],b.data[0],l.data))

    k.grad.data.zero_()

    b.grad.data.zero_()

k=1.7,b=1.3,l=4.7

k=1.9,b=1.6,l=0.35

k=2.0,b=1.6,l=0.09

...

k=2.9,b=1.1,l=0.0035

k=2.9,b=1.1,l=0.0035

k=2.9,b=1.1,l=0.0035

k=2.9,b=1.1,l=0.0035

k=2.9,b=1.1,l=0.0035

备注：新版本的torch里把torch.Variable 废除了，合并到torch.Tensor里了，好消息。数据类型统一了。原文：https://pytorch.org/docs/stable/autograd.html

Variable (deprecated)

The Variable API has been deprecated: Variables are no longer necessary to use autograd with tensors.

梯度下降与pytorch的更多相关文章

梯度下降优化算法综述与PyTorch实现源码剖析
现代的机器学习系统均利用大量的数据,利用梯度下降算法或者相关的变体进行训练.传统上,最早出现的优化算法是SGD,之后又陆续出现了AdaGrad.RMSprop.ADAM等变体,那么这些算法之间又有哪些 ...
[深度学习] pytorch学习笔记（2）(梯度、梯度下降、凸函数、鞍点、激活函数、Loss函数、交叉熵、Mnist分类实现、GPU)
一.梯度导数是对某个自变量求导,得到一个标量. 偏微分是在多元函数中对某一个自变量求偏导(将其他自变量看成常数). 梯度指对所有自变量分别求偏导,然后组合成一个向量,所以梯度是向量,有方向和大小. ...
梯度下降（Gradient Descent）小结
在求解机器学习算法的模型参数,即无约束优化问题时,梯度下降(Gradient Descent)是最常采用的方法之一,另一种常用的方法是最小二乘法.这里就对梯度下降法做一个完整的总结. 1. 梯度在微 ...
从梯度下降到Fista
前言: FISTA(A fast iterative shrinkage-thresholding algorithm)是一种快速的迭代阈值收缩算法(ISTA).FISTA和ISTA都是基于梯度下降的 ...
线性回归、梯度下降（Linear Regression、Gradient Descent）
转载请注明出自BYRans博客:http://www.cnblogs.com/BYRans/ 实例首先举个例子,假设我们有一个二手房交易记录的数据集,已知房屋面积.卧室数量和房屋的交易价格,如下表: ...
随机梯度下降（Stochastic gradient descent）和批量梯度下降（Batch gradient descent ）的公式对比、实现对比[转]
梯度下降(GD)是最小化风险函数.损失函数的一种常用方法,随机梯度下降和批量梯度下降是两种迭代求解思路,下面从公式和实现的角度对两者进行分析,如有哪个方面写的不对,希望网友纠正. 下面的h(x)是要拟 ...
为什么是梯度下降？SGD
在机器学习算法中,为了优化损失函数loss function ,我们往往采用梯度下降算法来进行优化.举个例子: 线性SVM的得分函数和损失函数分别为: ...
Stanford大学机器学习公开课（二）：监督学习应用与梯度下降
本课内容: 1.线性回归 2.梯度下降 3.正规方程组监督学习:告诉算法每个样本的正确答案,学习后的算法对新的输入也能输入正确的答案 1.线性回归问题引入:假设有一房屋销售的数据如下: 引 ...
Matlab梯度下降解决评分矩阵分解
for iter = 1:num_iters %梯度下降用户向量 for i = 1:m %返回有0有1 是逻辑值 ratedIndex1 = R_training(i,:)~=0 ; %U(i,: ...

随机推荐

hdu 1057 A + B Again
A + B Again Problem Description There must be many A + B problems in our HDOJ , now a new one is com ...
：迭代器模式1：Iterator
//今天一口气把这一章前半部分的iterator例子的所有代码写完,涉及到了不少指针的内容,竟然一次性编译通过.... //Iterator与Menu之间应该不是has a的关系,先这样着吧. #if ...
2.1FTP的简单传输
第一个简单的FTP传输实例 from ftplib import FTP nonpassive = False filename = 'new_1.py' dirname = '.' sitename ...
js 循环遍历数组
var a =[1,3,4]; a.each(functiom{ .... }) or for (var x in a ){ .... }
201621123001《Java程序设计》第1周学习总结
1. 本周学习总结认识java的三个层次:java语法面向对象设计能力应用 . 学习eclipse创建java文件的方法. 学习markdown的基本语法,了解写博客的几种常用形式. 了解JVM ...
ubuntu 实用命令收集
dig 查看域名解析最下面server为DNS解析地址 dig google.com sudo -s 转为root方式 curl ip.gs 获取本机外网的ip地理地址开启ipv4转发功能 /et ...
20165326 java第一周学习笔记
第一周学习笔记一.理论视频学习 1.Java的特点:简单.面向对象.平台无关 2.Java的开发步骤&简单的应用程序: 文本编辑器写入代码命名类名.java,文件类型所有文件,编码ANSI ...
给视频加上遮盖层, 移入隐藏, 移开显示遮盖 ;;; mouseover ,和 mouseout
如下图所示: 主要就是给遮盖定位 . 但是有一个问题就是 video的高度不是固定的 . 如果 video 和遮盖在一个父级div里, 无法确定位置, 如果用js效果不是很好. 思路: v ...
__new__() 与__init__()的区别
__new__作用于__init__之前.前者可以决定是否调用后者,或者说可以决定调用那个类的__init__方法. 首先要知道在面向对象编程中,实例化基本遵循创建实例对象,初始化实例对象,最后返回实 ...
设置环境下文本格式为UTF-8
1.在页面创建一个template.txt文本格式,默认是ANSI,将其格式改为UTF-8 2.将template.txt丢到C:\Windows\ShellNew文件夹里面 3.打开命令行工具win ...

梯度下降与pytorch

Variable (deprecated)

梯度下降与pytorch的更多相关文章

随机推荐

热门专题