GoogLeNet模型的微调

静悟生慧 2024-09-03 09:40:16 原文

我从零开始训练了GoogLeNet模型。但它没有给我带来希望的结果。
作为替代，我想对我的数据集中的GoogLeNet模型进行微调。有谁知道我应该遵循什么步骤？

采纳答案：

假设你正在尝试做图像分类。这些应该是微调模型的步骤：

1.分类层

原始分类层"loss3/classifier"输出1000个类的预测（它的mum_output设置为1000）。您需要将其替换为具有适当num_output的新图层。替换分类层：

更改图层的名称（以便当您从caffemodel文件读取原始权重时，不会与此图层的权重发生冲突）。
将num_output更改为您尝试预测的正确数量的输出类。
请注意，您需要更改所有分类图层。通常只有一个，但是GoogLeNet碰巧有三个： "loss1/classifier" ， "loss2/classifier"和"loss3/classifier" 。

2.数据

您需要创建一个新的训练数据集，其中包含您想要调整的新标签。例如，请参阅这篇文章，了解如何制作lmdb数据集。

3.你想要进行多少广泛的调谐？

微调模型时，可以训练所有模型的权重，或者选择修正一些权重（通常是较低/较深层次的过滤器），并仅训练最顶层的权重。这个选择取决于你，它通常取决于可用的训练数据量（更多的例子你可以承受更多的权重，可以进行微调）。
每个图层（包含可训练参数）都有param { lr_mult: XX } 。这个系数决定了这些权重对SGD更新的敏感程度。设置param { lr_mult: 0 }意味着你修改这个图层的权重，并且在训练过程中它们不会被改变。
相应地编辑您的train_val.prototxt 。

4.运行咖啡

运行caffe train但提供caffemodel的重量作为初始重量：

~$ $CAFFE_ROOT/build/tools/caffe train -solver /path/to/solver.ptototxt -weights /path/to/orig_googlenet_weights.caffemodel

　　

更多答案请参考GoogLeNet模型的微调。版权归stackoverflow所有，转载请保留此链接 GoogLeNet模型的微调

更多关于caffe 的细节，关注徐其华大神的系列博客，写得非常详细。

链接：http://www.cnblogs.com/denny402/tag/caffe/

GoogLeNet模型的微调的更多相关文章

Caffe-5.2-（GPU完整流程）训练（依据googlenet微调）
上一篇使用caffenet的模型微调.但由于caffenet有220M太大,測试速度太慢.因此换为googlenet. 1. 训练迭代了2800次时死机,大概20分钟. 使用的是2000次的模型. ...
DL开源框架Caffe | 模型微调（finetune）的场景、问题、技巧以及解决方案
转自:http://blog.csdn.net/u010402786/article/details/70141261 前言什么是模型的微调? 使用别人训练好的网络模型进行训练,前提是必须和别人 ...
图像分类（一）GoogLenet Inception_V1：Going deeper with convolutions
论文地址在该论文中作者提出了一种被称为Inception Network的深度卷积神经网络,它由若干个Inception modules堆叠而成.Inception的主要特点是它能提高网络中计算资源 ...
21个项目玩转深度学习：基于TensorFlow的实践详解03—打造自己的图像识别模型
书籍源码:https://github.com/hzy46/Deep-Learning-21-Examples CNN的发展已经很多了,ImageNet引发的一系列方法,LeNet,GoogLeNet ...
解读（GoogLeNet）Going deeper with convolutions
(GoogLeNet)Going deeper with convolutions Inception结构目前最直接提升DNN效果的方法是increasing their size,这里的size包 ...
[论文阅读]Going deeper with convolutions（GoogLeNet）
本文采用的GoogLenet网络(代号Inception)在2014年ImageNet大规模视觉识别挑战赛取得了最好的结果,该网络总共22层. Motivation and High Level Co ...
TensorRT加速 ——NVIDIA终端AI芯片加速用，可以直接利用caffe或TensorFlow生成的模型来predict（inference）
官网:https://developer.nvidia.com/tensorrt 作用:NVIDIA TensorRT™ is a high-performance deep learning inf ...
CNN-4: GoogLeNet 卷积神经网络模型
1.GoogLeNet 模型简介 GoogLeNet 是2014年Christian Szegedy提出的一种全新的深度学习结构,该模型获得了ImageNet挑战赛的冠军. 2.GoogLeNet 模 ...
经典分类CNN模型系列其五：Inception v2与Inception v3
经典分类CNN模型系列其五:Inception v2与Inception v3 介绍 Inception v2与Inception v3被作者放在了一篇paper里面,因此我们也作为一篇blog来对其 ...

随机推荐

HDU 1686 Oulipo【kmp求子串出现的次数】
The French author Georges Perec (1936–1982) once wrote a book, La disparition, without the letter 'e ...
见微知著(二)：解析ctf中的pwn--怎么利用double free
这次选2015年的0ctf的一道非常经典的pwn题,感觉这个题目作为练习题来理解堆还是很棒的. 运行起来,可以看出是一个实现类似于记事本功能的程序,就这一点而言,基本是套路了,功能都试一遍之后,就可以 ...
mysql对表的操作
创建表简单的方式 CREATE TABLE person ( number INT(11), name VARCHAR(255), birthday DATE ); 或者是 CREATE TABLE ...
用Python处理邮件，全文完
http://www.chinaunix.net/old_jh/55/575710.html
【最小路径覆盖】【二分图】【最大流】【Dinic】bzoj2150 部落战争
裸的最小路径覆盖. 把每个点拆点,变成二分图. 对于可以连边的点对(i,j):i->j'(1); 对于任意一点i,若i点为'.':S->i(1),i'->T(1); 答案为所有'.' ...
opencv在vc2010 express下环境搭建方法笔记+空白通用工程（已编译测试通过）（提供下载）
opencv在VC2010 express版本下的环境搭建可以参见下面的wiki,这里面讲的非常清楚. http://wiki.opencv.org.cn/index.php/VC_2010_Expr ...
Swift开发经验——外部参数名
一.什么是外部参数名? 浅显地说,外部参数名就是在调用一个方法时要在方法的参数前面加上一个特定的名字,目的是便于阅读代码,提高维护效率. 二.在最新的Xcode中,外部参数名的性质与用法如下性质 ...
TOleDBMSSQLConnectionProperties驱动MSSQL数据库
TOleDBMSSQLConnectionProperties驱动MSSQL数据库为了让MORMOT可以驱动所有版本的MSSQL,需要改用SQLOLEDB,因为所有的WINDOWS操作系统里面都提供 ...
ios(iphone/ipad)一个简单的用代码判断当前设备的方法
直接NSLog(@"current_device:%@",[UIDevice currentDevice].model); 即可看出它输出的是当前设备,所以根据这个字符串可简单的判 ...
ORA-12537：TNS：连接关闭 -------数据库最大连接数问题
问题: 我自己用PLSQL登录实验,我也登陆不了,可是让同事实验,他一会能够登录,一会不能够登录.应用还是能够正常访问,只是PLSQL登录异常. 分析: 基于这种情况去百度,有的说是配置文件有问题,有 ...