pix2pix-tensorflow搭建及其使用
pix2pix-tensorflow搭建过程
对抗神经网络
1. 环境搭建
参考:https://www.cnblogs.com/pprp/p/9463974.html
官方详细介绍:https://affinelayer.com/pix2pix/
这篇博客中详细介绍了如何搭建tensorflow环境
2. 环境说明
- 基于tensorflow1.4.1
- 建议采用 Tensorflow-gpu + cuDNN
3. 开始搭建
# clone this repo
git clone https://github.com/affinelayer/pix2pix-tensorflow.git
cd pix2pix-tensorflow
# download the CMP Facades dataset (generated from http://cmp.felk.cvut.cz/~tylecr1/facade/) 下载数据集
python tools/download-dataset.py facades
# 训练数据
python pix2pix.py \
--mode train \ # 设置mode为训练模式
--output_dir facades_train \ # 输出地址
--max_epochs 200 \ # 最大神经元熟练
--input_dir facades/train \ # 输入训练集所在地址
--which_direction BtoA # 方向
# 测试模型
python pix2pix.py \
--mode test \ #设置测试模式
--output_dir facades_test \ # 输出地址
--input_dir facades/val \ # 输入地址
--checkpoint facades_train # 检查点保存
4. 训练结果说明
测试结果:
facades_train
├── checkpoint
├── events.out.tfevents.1534087226.learner-pc
├── events.out.tfevents.1534126535.learner-pc
├── graph.pbtxt
├── model-80000.data-00000-of-00001
├── model-80000.index
├── model-80000.meta
└── options.json
其中facades_train记录的是检查点checkpoint
facades_test
├── events.out.tfevents.1534229330.learner-pc
├── graph.pbtxt
├── images
│ ├── 1-inputs.png ....
│ └── 1-targets.png ....
├── index.html
└── options.json
其中facades_test记录的是训练的结果,可以打开index.html进行查看具体的内容
5. 数据集
5.1 图片格式说明

你需要制作图片A,B,然后合成一张图片,作为一个训练图片。
其他数据集请见https://github.com/pprp/pix2pix-tensorflow
5.2 创建自己的数据集
示意图:

# Resize source images, 如上图,进行resize
python tools/process.py \
--input_dir photos/original \
--operation resize \
--output_dir photos/resized
# Create images with blank centers # 如上图,创建空白
python tools/process.py \
--input_dir photos/resized \
--operation blank \
--output_dir photos/blank
# Combine resized images with blanked images # 结合两张图片
python tools/process.py \
--input_dir photos/resized \
--b_dir photos/blank \
--operation combine \
--output_dir photos/combined
# Split into train/val set # 将图片进行分配
python tools/split.py \
--dir photos/combined
5.3 从先用图片创建图像对
如果您有两个目录,a并且b具有相应的图像(相同的名称,相同的尺寸,不同的数据),您可以将它们与process.py:
python tools/process.py \
--input_dir a \
--b_dir b \
--operation combine \
--output_dir c
这使得图像成为pix2pix.py期望的并排组合图像。
5.4 如何进行着色
对于着色,理想情况下,您的图像应具有相同的宽高比。您可以使用resize命令调整大小并裁剪它们:
python tools/process.py \
--input_dir photos/original \
--operation resize \
--output_dir photos/resized
不需要其他处理,着色模式(参见下面的训练部分)使用单个图像而不是图像对。
6. 训练
6.1 图片对
由于图片是成对的,你可以决定图片的方向是AtoB or BtoA
以maps数据集为例:
python pix2pix.py \
--mode train \
--output_dir maps_train \
--max_epochs 200 \
--input_dir maps/train \
--which_direction BtoA
6.2 上色
pix2pix.py 包括使用单个图像而不是成对处理着色的特殊代码,使用如下所示:
python pix2pix.py \ --mode
train \
--output_dir photos_train \
--max_epochs 200 \
--input_dir photos / train \
--lab_colorization
在该模式中,图像A是黑白图像(仅亮度),图像B包含该图像的颜色通道(没有亮度信息)。
提示
您可以使用tensorboard查看损失和计算图:
tensorboard --logdir = facades_train

如果您希望在网络培训时编写正在进行的图片,请使用--display_freq 50。这将facades_train/index.html使用当前的训练输入和输出更新每50个步骤。
7. 测试
测试完成--mode test。您应该指定要使用的检查点--checkpoint,这应该指向output_dir您之前创建的--mode train
以maps数据集为例:
python pix2pix.py \
--mode test \
--output_dir maps_test \
--input_dir maps/val \
checkpoint maps_train
测试模式将从提供的检查点加载一些配置选项,因此您无需指定which_direction实例。
测试运行将输出一个HTML文件facades_test/index.html,显示输入/输出/目标图像集
8. Code Validation
Validation of the code was performed on a Linux machine with a ~1.3 TFLOPS Nvidia GTX 750 Ti GPU and an Azure NC6 instance with a K80 GPU.
git clone https://github.com/affinelayer/pix2pix-tensorflow.git
cd pix2pix-tensorflow
python tools/download-dataset.py facades
sudo nvidia-docker run \
--volume $PWD:/prj \
--workdir /prj \
--env PYTHONUNBUFFERED=x \
affinelayer/pix2pix-tensorflow \
python pix2pix.py \
--mode train \
--output_dir facades_train \
--max_epochs 200 \
--input_dir facades/train \
--which_direction BtoA
sudo nvidia-docker run \
--volume $PWD:/prj \
--workdir /prj \
--env PYTHONUNBUFFERED=x \
affinelayer/pix2pix-tensorflow \
python pix2pix.py \
--mode test \
--output_dir facades_test \
--input_dir facades/val \
--checkpoint facades_train
nvidia-docker可以参看之前的文章进行安装
9. 参考文献
主要是官方给出的说明:references
pix2pix-tensorflow搭建及其使用的更多相关文章
- (转)一文学会用 Tensorflow 搭建神经网络
一文学会用 Tensorflow 搭建神经网络 本文转自:http://www.jianshu.com/p/e112012a4b2d 字数2259 阅读3168 评论8 喜欢11 cs224d-Day ...
- [DL学习笔记]从人工神经网络到卷积神经网络_3_使用tensorflow搭建CNN来分类not_MNIST数据(有一些问题)
3:用tensorflow搭个神经网络出来 为什么用tensorflow呢,应为谷歌是亲爹啊,虽然有些人说caffe更适合图像啊mxnet效率更高等等,但爸爸就是爸爸,Android都能那么火,一个道 ...
- 用Tensorflow搭建神经网络的一般步骤
用Tensorflow搭建神经网络的一般步骤如下: ① 导入模块 ② 创建模型变量和占位符 ③ 建立模型 ④ 定义loss函数 ⑤ 定义优化器(optimizer), 使 loss 达到最小 ⑥ 引入 ...
- 一文学会用 Tensorflow 搭建神经网络
http://www.jianshu.com/p/e112012a4b2d 本文是学习这个视频课程系列的笔记,课程链接是 youtube 上的,讲的很好,浅显易懂,入门首选, 而且在github有代码 ...
- 使用Tensorflow搭建回归预测模型之一:环境安装
方法1:快速包安装 一.安装Anaconda 1.官网地址:https://www.anaconda.com/distribution/,选择其中一个版本下载即可,最好安装3.7版本,因为2.7版本2 ...
- 使用Tensorflow搭建回归预测模型之二:数据准备与预处理
前言: 在前一篇中,已经搭建好了Tensorflow环境,本文将介绍如何准备数据与预处理数据. 正文: 在机器学习中,数据是非常关键的一个环节,在模型训练前对数据进行准备也预处理是非常必要的. 一.数 ...
- 用tensorflow搭建RNN(LSTM)进行MNIST 手写数字辨识
用tensorflow搭建RNN(LSTM)进行MNIST 手写数字辨识 循环神经网络RNN相比传统的神经网络在处理序列化数据时更有优势,因为RNN能够将加入上(下)文信息进行考虑.一个简单的RNN如 ...
- 用TensorFlow搭建一个万能的神经网络框架(持续更新)
我一直觉得TensorFlow的深度神经网络代码非常困难且繁琐,对TensorFlow搭建模型也十分困惑,所以我近期阅读了大量的神经网络代码,终于找到了搭建神经网络的规律,各位要是觉得我的文章对你有帮 ...
- 使用tensorflow搭建自己的验证码识别系统
目录 准备验证码数据 保存为tfrecords文件 验证码训练 学习tensorflow有一段时间了,想做点东西来练一下手.为了更有意思点,下面将搭建一个简单的验证码识别系统. 准备验证码数据 下面将 ...
- Tensorflow搭建卷积神经网络识别手写英语字母
更新记录: 2018年2月5日 初始文章版本 近几天需要进行英语手写体识别,查阅了很多资料,但是大多数资料都是针对MNIST数据集的,并且主要识别手写数字.为了满足实际的英文手写识别需求,需要从训练集 ...
随机推荐
- 【黑金ZYNQ7000系列原创视频教程】07.自定义IP——定制RTC IP实验
黑金论坛地址: http://www.heijin.org/forum.php?mod=viewthread&tid=36641&extra=page%3D1 爱奇艺地址: http: ...
- swiper的延迟加载(非官网方法)
网上找的: https://github.com/nolimits4web/Swiper/issues/626 var tabsSwiper = new Swiper('#games-content' ...
- salt-stack更换主机名
author:headsen chen date: 2018-09-30 11:22:40 1,建立master端和client端的正常连接 #master yum -y install epel ...
- Sql Server 关于SET IDENTITY_INSERT的问题
想要将值插入到自动编号(或者说是标识列,IDENTITY)中去,需要设定 SET IDENTITY_INSERT 示例: 1.首先建立一个有标识列的表: CREATE TABLE products ( ...
- 问答项目---用户注册的那些事儿(JS验证)
做注册的时候,由于每一个页面都有都要可以注册,可以把注册方法写到一个公用的方法里去,其他方法继承这个方法: 简单注册JS示例: <script type='text/javascript'> ...
- JS/Java/Python格式化金额
//java代码 public static void main(String[] args) { DecimalFormat myformat = new DecimalFormat(); ...
- opencv中Mat格式的数据访问.at
opencv3中图形存储基本为Mat格式,如果我们想获取像素点的灰度值或者RGB值,可以通过image.at<uchar>(i,j)的方式轻松获取. Mat类中的at方法对于获取图像矩阵某 ...
- Oracle管理监控 之 rac环境密码文件管理
密码文件作用: 密码文件用于dba用户的登录认证. dba用户:具备sysdba和sysoper权限的用户,即oracle的sys和system用户. RAC环境中多个节点的密码文件应该保证一致,否则 ...
- India and China Origins---hdu5652(二分 + bfs)或者(并查集)
题目链接:http://acm.hdu.edu.cn/showproblem.php?pid=5652 题意: 很久以前,中国和印度之间并没有喜马拉雅山相隔,两国的文化交流很频繁.随着喜马拉雅山海拔逐 ...
- H5上传压缩图片
看这个,比较全的 https://github.com/mhbseal/html5ImgCompress ,几乎所有痛点都解决了! PC上传图片 基本结构 form[enctype="mul ...