线性回归和梯度下降代码demo

程序所用文件：https://files.cnblogs.com/files/henuliulei/%E5%9B%9E%E5%BD%92%E5%88%86%E7%B1%BB%E6%95%B0%E6%8D%AE.zip

线性回归

决定系数越接近一那么预测效果越好

对于多元线性回归和一元线性回归推导理论是一致的，只不过参数是多个参数而已

梯度下降

梯度下降法存在局部最小值

太小迭代次数多，太大将无法迭代到最优质

梯度下降发容易到达局部最小值

凸函数使用局部下降法一定可以到全部最小值，所以不存在局部最小值才可以

下面两个demo是一元函数的拟合

1使用梯度下降法的数学公式进行的机器学习代码

 import numpy as np

 from matplotlib import  pyplot as plt

 #读取数据

 data = np.genfromtxt('data.csv',delimiter=',')

 x_data = data[:, ]

 y_data = data[:, ]

 #plt.scatter(x_data, y_data)

 #plt.show()

 lr = 0.0001

 k =

 b =

 epochs =

 def compute_loss(x_data, y_data, b, k):#计算损失函数

     m = float(len(x_data))

     sum =

     for i in range(, len(x_data)):

         sum += (y_data[i] - (k*x_data[i] + b))**

     return sum/(*m)

 def gradient(x_data, y_data, k, b, lr, epochs):#进行梯度下降

     m = float(len(x_data))

     for i in range(,epochs):

         k_gradient =

         b_gradiet =

         for j in range(,len(x_data)):

             k_gradient += (/m)*((x_data[j] * k + b) - y_data[j])

             b_gradiet += (/m)*((x_data[j] * k + b) - y_data[j]) * x_data[j]

         k -= lr * k_gradient

         b -= lr * b_gradiet

         if i %  == :

             print(i)

             plt.plot(x_data, y_data, 'b.')

             plt.plot(x_data, k*x_data + b, 'r')

             plt.show()

     return k, b

 k,b = gradient(x_data, y_data, , , lr, epochs)

 plt.plot(x_data, k * x_data + b, 'r')

 plt.plot(x_data, y_data, 'b.')

 print('loss =:',compute_loss(x_data, y_data, b, k),'b =:',b,'k =:',k)

 plt.show()

2 使用Python的sklearn库

 import numpy as np

 from matplotlib import  pyplot as plt

 from sklearn.linear_model import LinearRegression

 #读取数据

 data = np.genfromtxt('data.csv',delimiter=',')

 x_data = data[:, ]

 y_data = data[:, ]

 plt.scatter(x_data, y_data)

 plt.show()

 x_data = data[:, , np.newaxis]#使一位数据编程二维数据

 y_data = data[:, , np.newaxis]

 model =LinearRegression()

 model.fit(x_data, y_data)#传进的参数必须是二维的

 plt.plot(x_data, y_data, 'b.')

 plt.plot(x_data, model.predict(x_data), 'r')#画出预测的线条

 plt.show()

3使用梯度下降法完成多元线性回归（以二元为例）

 import numpy as np

 from numpy import genfromtxt

 import matplotlib.pyplot as plt

 from mpl_toolkits.mplot3d import Axes3D #用来画3D图的包

 # 读入数据

 data = genfromtxt(r"Delivery.csv",delimiter=',')

 print(data)

 # 切分数据

 x_data = data[:,:-]

 y_data = data[:,-]

 print(x_data)

 print(y_data)

 # 学习率learning rate

 lr = 0.0001

 # 参数

 theta0 =

 theta1 =

 theta2 =

 # 最大迭代次数

 epochs = 

 # 最小二乘法

 def compute_error(theta0, theta1, theta2, x_data, y_data):

     totalError =

     for i in range(, len(x_data)):

         totalError += (y_data[i] - (theta1 * x_data[i,] + theta2*x_data[i,] + theta0)) **

     return totalError / float(len(x_data))

 def gradient_descent_runner(x_data, y_data, theta0, theta1, theta2, lr, epochs):

     # 计算总数据量

     m = float(len(x_data))

     # 循环epochs次

     for i in range(epochs):

         theta0_grad =

         theta1_grad =

         theta2_grad =

         # 计算梯度的总和再求平均

         for j in range(, len(x_data)):

             theta0_grad += (/m) * ((theta1 * x_data[j,] + theta2*x_data[j,] + theta0) - y_data[j])

             theta1_grad += (/m) * x_data[j,] * ((theta1 * x_data[j,] + theta2*x_data[j,] + theta0) - y_data[j])

             theta2_grad += (/m) * x_data[j,] * ((theta1 * x_data[j,] + theta2*x_data[j,] + theta0) - y_data[j])

         # 更新b和k

         theta0 = theta0 - (lr*theta0_grad)

         theta1 = theta1 - (lr*theta1_grad)

         theta2 = theta2 - (lr*theta2_grad)

     return theta0, theta1, theta2

 print("Starting theta0 = {0}, theta1 = {1}, theta2 = {2}, error = {3}".

       format(theta0, theta1, theta2, compute_error(theta0, theta1, theta2, x_data, y_data)))

 print("Running...")

 theta0, theta1, theta2 = gradient_descent_runner(x_data, y_data, theta0, theta1, theta2, lr, epochs)

 print("After {0} iterations theta0 = {1}, theta1 = {2}, theta2 = {3}, error = {4}".

       format(epochs, theta0, theta1, theta2, compute_error(theta0, theta1, theta2, x_data, y_data)))

 ax = Axes3D(plt.figure())#和下面的代码功能一样

 #ax = plt.figure().add_subplot(, projection='3d')#plt.figure().add_subplot和plt.subplot的作用是一致的

 ax.scatter(x_data[:, ], x_data[:, ], y_data, c='r', marker='o', s=)  # 点为红色三角形

 x0 = x_data[:, ]

 x1 = x_data[:, ]

 # 生成网格矩阵

 x0, x1 = np.meshgrid(x0, x1)#生成一个网格矩阵，矩阵的每个点的第一个轴的取值来自于x0范围内，第二个坐标轴的取值来自于x1范围内

 z = theta0 + x0 * theta1 + x1 * theta2

 # 画3D图

 ax.plot_surface(x0, x1, z)

 # 设置坐标轴

 ax.set_xlabel('Miles')

 ax.set_ylabel('Num of Deliveries')

 ax.set_zlabel('Time')

 # 显示图像

 plt.show()

4：使用Python的sklearn库完成多元线性回归

import numpy as np

from numpy import genfromtxt

from sklearn import linear_model

import matplotlib.pyplot as plt

from mpl_toolkits.mplot3d import Axes3D

# 读入数据

data = genfromtxt(r"Delivery.csv",delimiter=',')

print(data)

# 切分数据

x_data = data[:,:-]

y_data = data[:,-]

print(x_data)

print(y_data)

# 创建模型

model = linear_model.LinearRegression()

model.fit(x_data, y_data)

# 系数

print("coefficients:",model.coef_)

# 截距

print("intercept:",model.intercept_)

# 测试

x_test = [[,]]

predict = model.predict(x_test)

print("predict:",predict)

ax = plt.figure().add_subplot(, projection='3d')

ax.scatter(x_data[:, ], x_data[:, ], y_data, c='r', marker='o', s=)  # 点为红色三角形

x0 = x_data[:, ]

x1 = x_data[:, ]

# 生成网格矩阵

x0, x1 = np.meshgrid(x0, x1)

z = model.intercept_ + x0*model.coef_[] + x1*model.coef_[]

# 画3D图

ax.plot_surface(x0, x1, z)#参数是二维的，而model.prodict(x_data)是一维的。

# 设置坐标轴

ax.set_xlabel('Miles')

ax.set_ylabel('Num of Deliveries')

ax.set_zlabel('Time')

# 显示图像

plt.show()

5 多项式回归拟合

 import numpy as np

 import matplotlib.pyplot as plt

 from sklearn.preprocessing import PolynomialFeatures#多项式

 from sklearn.linear_model import LinearRegression

 # 载入数据

 data = np.genfromtxt("job.csv", delimiter=",")

 x_data = data[:,]

 y_data = data[:,]

 plt.scatter(x_data,y_data)

 plt.show()

 x_data

 x_data = x_data[:,np.newaxis]

 y_data = y_data[:,np.newaxis]

 x_data

 # 创建并拟合模型

 model = LinearRegression()

 model.fit(x_data, y_data)

 # 画图

 plt.plot(x_data, y_data, 'b.')

 plt.plot(x_data, model.predict(x_data), 'r')

 plt.show()

 # 定义多项式回归,degree的值可以调节多项式的特征

 poly_reg  = PolynomialFeatures(degree=)

 # 特征处理

 x_poly = poly_reg.fit_transform(x_data)

 # 定义回归模型

 lin_reg = LinearRegression()

 # 训练模型

 lin_reg.fit(x_poly, y_data)

 # 画图

 plt.plot(x_data, y_data, 'b.')

 plt.plot(x_data, lin_reg.predict(poly_reg.fit_transform(x_data)), c='r')

 plt.title('Truth or Bluff (Polynomial Regression)')

 plt.xlabel('Position level')

 plt.ylabel('Salary')

 plt.show()

 # 画图

 plt.plot(x_data, y_data, 'b.')

 x_test = np.linspace(,,)

 x_test = x_test[:,np.newaxis]

 plt.plot(x_test, lin_reg.predict(poly_reg.fit_transform(x_test)), c='r')

 plt.title('Truth or Bluff (Polynomial Regression)')

 plt.xlabel('Position level')

 plt.ylabel('Salary')

 plt.show()

线性回归和梯度下降代码demo的更多相关文章

机器学习算法整理（一）线性回归与梯度下降 python实现
回归算法以下均为自己看视频做的笔记,自用,侵删! 一.线性回归 θ是bias(偏置项) 线性回归算法代码实现 # coding: utf-8 get_ipython().run_line_mag ...
线性回归、梯度下降（Linear Regression、Gradient Descent）
转载请注明出自BYRans博客:http://www.cnblogs.com/BYRans/ 实例首先举个例子,假设我们有一个二手房交易记录的数据集,已知房屋面积.卧室数量和房屋的交易价格,如下表: ...
Andrew Ng机器学习公开课笔记 -- 线性回归和梯度下降
网易公开课,监督学习应用.梯度下降 notes,http://cs229.stanford.edu/notes/cs229-notes1.pdf 线性回归(Linear Regression) 先看个 ...
斯坦福机器学习视频笔记 Week1 线性回归和梯度下降 Linear Regression and Gradient Descent
最近开始学习Coursera上的斯坦福机器学习视频,我是刚刚接触机器学习,对此比较感兴趣:准备将我的学习笔记写下来, 作为我每天学习的签到吧,也希望和各位朋友交流学习. 这一系列的博客,我会不定期的更 ...
Machine Learning--week2 多元线性回归、梯度下降改进、特征缩放、均值归一化、多项式回归、正规方程与设计矩阵
对于multiple features 的问题(设有n个feature),hypothesis 应该改写成 \[ \mathit{h} _{\theta}(x) = \theta_{0} + \the ...
2018.4.23-ml笔记(线性回归、梯度下降)
线性回归:找到最合适的一条线来最好的拟合我们的数据点. hθ(x) = θixi=θTx θ被称之为权重参数 θ0为拟合参数对每个样本yi=θTxi + εi 误差ε是独立并且具有 ...
线性回归与梯度下降（ML作业）
Loss函数题目一:完成computeCost.m function J = computeCost(X, y, theta) %COMPUTECOST Compute cost for linea ...
机器学习算法（优化）之一：梯度下降算法、随机梯度下降（应用于线性回归、Logistic回归等等）
本文介绍了机器学习中基本的优化算法—梯度下降算法和随机梯度下降算法,以及实际应用到线性回归.Logistic回归.矩阵分解推荐算法等ML中. 梯度下降算法基本公式常见的符号说明和损失函数 X :所有 ...
从梯度下降到Fista
前言: FISTA(A fast iterative shrinkage-thresholding algorithm)是一种快速的迭代阈值收缩算法(ISTA).FISTA和ISTA都是基于梯度下降的 ...

随机推荐

Spring 源码学习——加载 Bean
继上次注册 bean 之后好久没更新,这两天有空查了查资料也自己看了看 spring BeanFactory 的 getBean(beanName); 这个方法.因时间有限不能像之前那样复制代码并一行 ...
Qt学习笔记----信号与槽实现的四种方式
1.以按钮为例,首先添加一个按钮,对象名为pushButton,在按钮是右键单击选择“转到槽”即可,在转到槽选择面板(右图)里面选择需要进行的操作,比如单击clicked() 2.选择菜单“编辑”,找 ...
【笔记篇】单调队列优化dp学习笔记&&luogu2569_bzoj1855股票交♂易
DP颂 DP之神圣洁美丽算法光芒照大地我们怀着崇高敬意跪倒在DP神殿里你的复杂能让蒟蒻试图入门却放弃在你光辉照耀下面 AC真心不容易 dp大概是最经久不衰亘古不化的算法了吧. 而 ...
8.0后广播在AndroidManifest.xml中注册后发送intent接收不到广播
8.0后广播在AndroidManifest.xml中注册后发送intent是接收不到广播了,看了一下原因,好像是8.0为了管理系统和节约电量特别针对广播和服务发送intent的方式启动做出的改变,也 ...
leetcode-第10周双周赛-5081-歩进数
题目描述: 自己的提交:参考全排列 class Solution: def countSteppingNumbers(self, low: int, high: int) -> List[int ...
Spring Boot 成长之路(一) 快速上手
1.创建工程利用IntelliJ IDEA新建一个Spring Boot项目的Web工程 2.查看初始化的spring boot项目工程建好之后会出现如下的目录结构: 值得注意的第一件事是,整个项 ...
requestAnimationFrame动画封装
function Animator(duration, progress) { this.duration = duration; this.progress = progress; this.nex ...
C# ObservableCollection集合排序
版权声明:本文为博主原创文章,未经博主允许不得转载. https://blog.csdn.net/BYH371256/article/details/83346807注意:ObservableColl ...
华为-eNSP模拟器路由器无法正常启动一直显示“#”
问题项如截图: 解决方案: 1. 打开自己电脑的控制面板 -->> 系统和安全 -->> Windows Defender防火墙 (运行应用通过Windows防火墙) 2 .找 ...
【bzoj 2870】最长道路tree
题目边分治边分和点分相比就是找到一条重心边,考虑所有经过这条边的路径,之后断开这条边分成两个联通块,继续分治由于每次分治重心是一条边,所以只会产生两个联通块,考虑两个联通块显然要比像点分那样考虑 ...

线性回归和梯度下降代码demo

线性回归和梯度下降代码demo的更多相关文章

随机推荐

热门专题