机器学习：Softmax Classifier (两个隐含层)

程序实现 softmax classifier, 含有两个隐含层的情况。activation function 是 ReLU : f(x)=max(0,x)

f1=w1x+b1

h1=max(0,f1)

f2=w2h1+b2

h2=max(0,f2)

f3=w3h2+b3

y=ef3i∑jef3j



function Out=Softmax_Classifier_2(train_x,  train_y, opts)

% setting learning parameters

step_size=opts.step_size;

reg=opts.reg;

batchsize = opts.batchsize;

numepochs = opts.numepochs;

K=opts.class;

h1=opts.hidden_1;

h2=opts.hidden_2;

D=size(train_x, 2);

W1=0.01*randn(D,h1);

b1=zeros(1,h1);

W2=0.01*randn(h1, h2);

b2=zeros(1,h2);

W3=0.01*randn(h2, K);

b3=zeros(1, K);

loss(1 : numepochs)=0;

num_examples=size(train_x, 1);

numbatches = num_examples / batchsize;

for epoch=1:numepochs

     kk = randperm(num_examples);

     loss(epoch)=0;

     tic;

      sprintf('epoch %d:  \n' , epoch)

     for bat=1:numbatches

         batch_x = train_x(kk((bat - 1) * batchsize + 1 : bat * batchsize), :);

         batch_y = train_y(kk((bat - 1) * batchsize + 1 : bat * batchsize), :);

         %% forward

         f1=batch_x*W1+repmat(b1, batchsize, 1);

         hiddenval_1=max(0, f1);

         f2=hiddenval_1*W2+repmat(b2, batchsize, 1);

         hiddenval_2=max(0, f2);

         scores=hiddenval_2*W3+repmat(b3, batchsize, 1);

         %% the loss

         exp_scores=exp(scores);

         dd=repmat(sum(exp_scores, 2), 1, K);

         probs=exp_scores./dd;

         correct_logprobs=-log(sum(probs.*batch_y, 2));

         data_loss=sum(correct_logprobs)/batchsize;

         reg_loss=0.5*reg*sum(sum(W1.*W1))+0.5*reg*sum(sum(W2.*W2))+0.5*reg*sum(sum(W3.*W3));

         loss(epoch) =loss(epoch)+ data_loss + reg_loss;

         %% back propagation

          % output layer

         dscores = probs-batch_y;

         dscores=dscores/batchsize;

         dW3=hiddenval_2'*dscores;

         db3=sum(dscores);

         % hidden layer 2

         dhiddenval_2=dscores*W3';

         mask=max(sign(hiddenval_2), 0);

         df_2=dhiddenval_2.*mask;

         dW2=hiddenval_1'*df_2;

         db2=sum(df_2);

         % hidden layer 1

         dhiddenval_1=df_2*W2';

         mask=max(sign(hiddenval_1), 0);

         df_1=dhiddenval_1.*mask;

         dW1=batch_x'*df_1;

         db1=sum(df_1);

         %% update

         dW3=dW3+reg*W3;

         dW2=dW2+reg*W2;

         dW1=dW1+reg*W1;

         W3=W3-step_size*dW3;

         b3=b3-step_size*db3;

         W2=W2-step_size*dW2;

         b2=b2-step_size*db2;

         W1=W1-step_size*dW1;

         b1=b1-step_size*db1;

     end

     loss(epoch)=loss(epoch)/numbatches;

    sprintf('training loss is  %f:  \n', loss(epoch))

    toc;

end

Out.W1=W1;

Out.W2=W2;

Out.W3=W3;

Out.b1=b1;

Out.b2=b2;

Out.b3=b3;

Out.loss=loss;

机器学习：Softmax Classifier (两个隐含层)的更多相关文章

机器学习： Softmax Classifier (三个隐含层)
程序实现 softmax classifier, 含有三个隐含层的情况.activation function 是 ReLU : f(x)=max(0,x) f1=w1x+b1 h1=max(0,f1 ...
机器学习 Softmax classifier (一个隐含层)
程序实现 softmax classifier, 含有一个隐含层的情况.activation function 是 ReLU : f(x)=max(0,x) f1=w1x+b1 h1=max(0,f1 ...
机器学习 Softmax classifier (无隐含层)
程序实现 Softmax classifer, 没有隐含层, f=wx+b y=efi∑jefj %% Softmax classifier function Out=Softmax_Classifi ...
理解dropout——本质是通过阻止特征检测器的共同作用来防止过拟合 Dropout是指在模型训练时随机让网络某些隐含层节点的权重不工作，不工作的那些节点可以暂时认为不是网络结构的一部分，但是它的权重得保留下来（只是暂时不更新而已），因为下次样本输入时它可能又得工作了
理解dropout from:http://blog.csdn.net/stdcoutzyx/article/details/49022443 http://www.cnblogs.com/torna ...
基于MNIST数据集使用TensorFlow训练一个包含一个隐含层的全连接神经网络
包含一个隐含层的全连接神经网络结构如下: 包含一个隐含层的神经网络结构图以MNIST数据集为例,以上结构的神经网络训练如下: #coding=utf-8 from tensorflow.exampl ...
基于MNIST数据集使用TensorFlow训练一个没有隐含层的浅层神经网络
基础在参考①中我们详细介绍了没有隐含层的神经网络结构,该神经网络只有输入层和输出层,并且输入层和输出层是通过全连接方式进行连接的.具体结构如下: 我们用此网络结构基于MNIST数据集(参考②)进行训 ...
[DeeplearningAI笔记]序列模型2.6Word2Vec/Skip-grams/hierarchical softmax classifier 分级softmax 分类器
5.2自然语言处理觉得有用的话,欢迎一起讨论相互学习~Follow Me 2.6 Word2Vec Word2Vec相对于原先介绍的词嵌入的方法来说更加的简单快速. Mikolov T, Chen ...
ubuntu之路——day13 只用python的numpy在较为底层的阶段实现单隐含层神经网络
首先感谢这位博主整理的Andrew Ng的deeplearning.ai的相关作业:https://blog.csdn.net/u013733326/article/details/79827273 ...
3.4 常用的两种 layer 层 3.7 字体与文本
3.4 常用的两种 layer 层 //在cocos2d-x中,经常使用到的两种 layer 层 : CCLayer 和 CCLayerColor //CCLayer 的创建 CCLayer* la ...

随机推荐

jquery ui 分页插件传入后台的连个參数名
參数名: page .rows page=int(request.form.get('page',1).encode('u8')) rows1=int(request.form.get('rows', ...
java中volatile关键字的含义--volatile并不能做到线程安全
在Java线程并发处理中,有一个关键字volatile的使用目前存在很大的混淆,以为使用这个关键字,在进行多线程并发处理的时候就可以万事大吉. Java语言是支持多线程的,为了解决线程并发的问题,在语 ...
软件——python,主函数
1;; 如何在spyder中运行python程序如下图, 写入一个输出 ' hellow word '的程序然后点击运行按钮就可以运行了.
（转）Windows Server 2012 R2虚拟机自激活（AVMA）技术
转自: 老丁的技术博客相信Hyper-v管理员都有这样的经历,安装多台虚拟机后,都要一台一台手工激活,如果虚拟机足够多的话,这是一项很繁琐的工作,但从Windows Server 2012 R2开始 ...
UML学习总结（3）——StarUML指导手册
StarUML使用说明-指导手册原著:Stephen Wong 翻译:火猴 StarUML是一种生成类图和其他类型的统一建模语言(UML)图表的工具.这是一个用Java语言描述 ...
20160206.CCPP体系具体解释(0016天)
代码片段(01):.指针.c+02.间接赋值.c 内容概要:内存 ///01.指针 #include <stdio.h> #include <stdlib.h> //01.取地 ...
Sass(SCSS)中文手册——入门
简书原文 https://www.jianshu.com/p/e82c27aa05c7 前言该中文手册是我在Sass中文文档的基础上编辑的,或者也可以理解为就是Sass中文文档的翻版.之所以有这篇文 ...
10.14 android输入系统_多点触摸驱动测试及Reader线程、InputStage分析
21. 多点触摸_电容屏驱动程序_实践_tiny4412 tiny4412触摸屏: 分辨率为800 x 480http://wiki.friendlyarm.com/wiki/index.php/LC ...
disabled的值无法传递到action层
假设想让表单不可输入的状态,我将表单设置为了: style="cursor:not-allowed;" disabled 可是这样设置之后就发现,在后台的action怎么都没有办法 ...
POJ 1833 生成排列
题目链接:POJ 1833 /************************************ * author : Grant Yuan * time : 2014/10/19 16:38 ...

机器学习：Softmax Classifier (两个隐含层)

机器学习：Softmax Classifier (两个隐含层)的更多相关文章

随机推荐

热门专题