tensorflow 中 inter_op 和 intra

[root@localhost custom-resnet-v2]# cat runme.sh

#python demo_slim.py -h

#python demo_slim.py --cpu_num 8 --inter_op_threads 1 --intra_op_threads 8 --dump_timeline True

# export KMP_AFFINITY=verbose,granularity=fine,proclist=[0,1,2,3],explicit

# numactl -C 0-3 python demo_slim.py --cpu_num 4 --inter_op_threads 1 --intra_op_threads 4 >& run1.log &

export OMP_NUM_THREADS=8

python demo_slim.py --cpu_num 8 --inter_op_threads 1 --intra_op_threads 8

[root@localhost custom-resnet-v2]# cat demo_slim.py

# coding: utf8

import os

import sys

import numpy as np

import tensorflow as tf

from tensorflow.python.client import timeline

import argparse

import time

def make_fake_input(batch_size, input_height, input_width, input_channel):

        im = np.zeros((input_height,input_width,input_channel), np.uint8)

        im[:,:,:] = 1

        images = np.zeros((batch_size, input_height, input_width, input_channel), dtype=np.float32)

        for i in xrange(batch_size):

                images[i, 0:im.shape[0], 0:im.shape[1], :] = im

                #channel_swap = (0, 3, 1, 2)  # caffe

                #images = np.transpose(images, channel_swap)

                #cv2.imwrite("test.jpg", im)

        return images

def get_parser():

        """

        create a parser to parse argument "--cpu_num --inter_op_threads --intra_op_threads"

        """

        parser = argparse.ArgumentParser(description="Specify tensorflow parallelism")

        parser.add_argument("--cpu_num", dest="cpu_num", default=1, help="specify how many cpus to use.(default: 1)")

        parser.add_argument("--inter_op_threads", dest="inter_op_threads", default=1, help="specify max inter op parallelism.(default: 1)")

        parser.add_argument("--intra_op_threads", dest="intra_op_threads", default=1, help="specify max intra op parallelism.(default: 1)")

        parser.add_argument("--dump_timeline", dest="dump_timeline", default=False, help="specify to dump timeline.(default: False)")

        return parser

def main():

        parser = get_parser()

        args = parser.parse_args()

        #parser.print_help()

        cpu_num = int(args.cpu_num)

        inter_op_threads = int(args.inter_op_threads)

        intra_op_threads = int(args.intra_op_threads)

        dump_timeline = bool(args.dump_timeline)

        print("cpu_num: ", cpu_num)

        print("inter_op_threads: ", inter_op_threads)

        print("intra_op_threads: ", intra_op_threads)

        print("dump_timeline: ", dump_timeline)

        config = tf.ConfigProto(device_count={"CPU": cpu_num}, # limit to num_cpu_core CPU usage

                inter_op_parallelism_threads = inter_op_threads,

                intra_op_parallelism_threads = intra_op_threads,

                log_device_placement=False)

        with tf.Session(config = config) as sess:

                imgs = make_fake_input(1, 224, 224, 3)

                #init_start = time.time()

                saver = tf.train.import_meta_graph("slim_model/slim_model.ckpt.meta")

                saver.restore(sess, tf.train.latest_checkpoint("slim_model/"))

                ## Operations

                #for op in tf.get_default_graph().get_operations():

                #       print(op.name)

                #       print(op.values())

                graph = tf.get_default_graph()

                input_data = graph.get_tensor_by_name("Placeholder:0")

                fc6 = graph.get_tensor_by_name("resnet_v2/avg_fc_fc6_Conv2D/BiasAdd:0")

                #init_end = time.time()

                #print("initialization time: ", init_end-init_start, "s")

                time_start = time.time()

                for step in range(200):

                        if dump_timeline:

                                run_options = tf.RunOptions(trace_level=tf.RunOptions.FULL_TRACE)

                                run_metadata = tf.RunMetadata()

                                result = sess.run(fc6, feed_dict={input_data:imgs}, options=run_options, run_metadata=run_metadata)

                                tm = timeline.Timeline(run_metadata.step_stats)

                                ctf = tm.generate_chrome_trace_format()

                                with open('timeline.json', 'w') as f:

                                        f.write(ctf)

                        else:

                                result = sess.run(fc6, feed_dict={input_data:imgs})

                        print(result[0][0][0])

                time_end = time.time()

                avg_time = (time_end-time_start) * 1000 / 200;

                print("AVG Time: ", avg_time, " ms")

        return 0

if __name__ == "__main__":

        sys.exit(main())

tensorflow 中 inter_op 和 intra_op的更多相关文章

Tensorflow中的padding操作
转载请注明出处:http://www.cnblogs.com/willnote/p/6746668.html 图示说明用一个3x3的网格在一个28x28的图像上做切片并移动移动到边缘上的时候,如果 ...
CNN中的卷积核及TensorFlow中卷积的各种实现
声明: 1. 我和每一个应该看这篇博文的人一样,都是初学者,都是小菜鸟,我发布博文只是希望加深学习印象并与大家讨论. 2. 我不确定的地方用了"应该"二字首先,通俗说一下,CNN ...
python/numpy/tensorflow中，对矩阵行列操作，下标是怎么回事儿？
Python中的list/tuple,numpy中的ndarrray与tensorflow中的tensor. 用python中list/tuple理解,仅仅是从内存角度理解一个序列数据,而非数学中标量 ...
[翻译] Tensorflow中name scope和variable scope的区别是什么
翻译自:https://stackoverflow.com/questions/35919020/whats-the-difference-of-name-scope-and-a-variable-s ...
SSD：TensorFlow中的单次多重检测器
SSD:TensorFlow中的单次多重检测器 SSD Notebook 包含 SSD TensorFlow 的最小示例. 很快,就检测出了两个主要步骤:在图像上运行SSD网络,并使用通用算法(top ...
在 TensorFlow 中实现文本分类的卷积神经网络
在TensorFlow中实现文本分类的卷积神经网络 Github提供了完整的代码: https://github.com/dennybritz/cnn-text-classification-tf 在 ...
[开发技巧]·TensorFlow中numpy与tensor数据相互转化
[开发技巧]·TensorFlow中numpy与tensor数据相互转化个人主页–> https://xiaosongshine.github.io/ - 问题描述在我们使用TensorFl ...
TensorFlow中的变量和常量
1.TensorFlow中的变量和常量介绍 TensorFlow中的变量: import tensorflow as tf state = tf.Variable(0,name='counter') ...
TensorFlow中的通信机制——Rendezvous（二）gRPC传输
背景 [作者:DeepLearningStack,阿里巴巴算法工程师,开源TensorFlow Contributor] 本篇是TensorFlow通信机制系列的第二篇文章,主要梳理使用gRPC网络传 ...

随机推荐

程序员心髓：移动应用API设计10大技巧
移动App与基于Web/云服务发生对话是很常见的事情,最简单的可能仅仅只是检索数据,但也可能包含发送数据.用户授权和管理.而这也就验证了为移动应用建立API的重要性,为此,我们特总结了10大移动API ...
配置Nginx和Apache允许指定域名CORS跨域访问
前后端分离开发,导致前端项目需要跨域请求后端接口,解决方法有很多,本文只介绍两个: 1. 修改后端程序代码实现允许跨域请求 2. 修改服务器配置文件实现允许跨域请求正文: 方法1:修改后端程序代码实 ...
ACM ICPC 2011-2012 Northeastern European Regional Contest（NEERC）A ASCII Area
A: 给你一个矩阵求'/' 和 '\' 围成的图形,简单签到题,有一些细节要考虑. 题解:一行一行的跑,遇到'/'和'\' 就加0.5, 在面积里面的'.' 就加1.用一个flag来判断是否在围住的图 ...
MAC截图工具
截图快捷键 ctrl+shift+A
sqlalchemy 中 desc 的使用
是这样: items = Item.query.order_by(Item.date.desc()).all() 而不是这样: items = Item.query.order_by(desc(Ite ...
阶段3 1.Mybatis_01.Mybatis课程介绍及环境搭建_05.mybatis环境搭建-前期准备
视频中右侧没有勾选直接finish 用下面的sql里面的一些表来实现今天的功能只需要用到里面的user表. 这是之前已经建好的数据库把表都删除掉,用sql语句去创建表和表内的记录,最终的结果: ...
把自己活成AI
干啥都失败,所以从0重新开始. 把自己活成AI 准则1:一件事的对错,只代表这件事本身.多一点的解释都是错误. 准则2:大多数人默认遵守的就是规则和法律.大多数人默认承认的就是道德. 然后取其和法律的 ...
中国MOOC_零基础学Java语言_第7周函数_2完数
2 完数(5分) 题目内容: 一个正整数的因子是所有可以整除它的正整数.而一个数如果恰好等于除它本身外的因子之和,这个数就称为完数.例如6=1+2+3(6的因子是1,2,3). 现在,你要写一个程序, ...
【Airtest】由于Airtest中long_click无法实现长按，教你如何在Airtest中实现长按的方法
Airtest中我们想要实现长按操作,poco中有一个方法long_click,但是实际使用了一下,发现并没有卵用,仍然是单击操作,如下图那我们要如何进行长按操作呢?其实可以利用swipe实现,以长 ...
【MM系列】SAP MM物料账在制品承担差异功能及配置
公众号:SAP Technical 本文作者:matinal 原文出处:http://www.cnblogs.com/SAPmatinal/ 原文链接:[MM系列]SAP MM物料账在制品承担差异功能 ...

tensorflow 中 inter_op 和 intra_op

tensorflow 中 inter_op 和 intra_op的更多相关文章

随机推荐

热门专题