HLS后端示例
HLS后端示例
TVM支持带有SDAccel的Xilinx FPGA板。这是有关如何将TVM部署到AWS F1 FPGA实例的文档。
此功能仍处于试验阶段。暂时无法使用SDAccel部署端到端神经网络。
本文使用两个python脚本。
- build.py-用于合成FPGA位流的脚本。
- import tvm
- from tvm import te
- tgt_host="llvm"
- tgt="sdaccel"
- n = te.var("n")
- A = te.placeholder((n,), name='A')
- B = te.placeholder((n,), name='B')
- C = te.compute(A.shape, lambda i: A[i] + B[i], name="C")
- s = te.create_schedule(C.op)
- px, x = s[C].split(C.op.axis[0], nparts=1)
- s[C].bind(px, tvm.te.thread_axis("pipeline"))
- fadd = tvm.build(s, [A, B, C], tgt, target_host=tgt_host, name="myadd")
- fadd.save("myadd.o")
- fadd.imported_modules[0].save("myadd.xclbin")
- tvm.contrib.cc.create_shared("myadd.so", ["myadd.o"])
- run.py-使用FPGA作为加速器的脚本。
- import tvm
- import numpy as np
- import os
- tgt="sdaccel"
- fadd = tvm.runtime.load_module("myadd.so")
- if os.environ.get("XCL_EMULATION_MODE"):
- fadd_dev = tvm.runtime.load_module("myadd.xclbin")
- else:
- fadd_dev = tvm.runtime.load_module("myadd.awsxclbin")
- fadd.import_module(fadd_dev)
- ctx = tvm.context(tgt, 0)
- n = 1024
- a = tvm.nd.array(np.random.uniform(size=n).astype("float32"), ctx)
- b = tvm.nd.array(np.random.uniform(size=n).astype("float32"), ctx)
- c = tvm.nd.array(np.zeros(n, dtype="float32"), ctx)
- fadd(a, b, c)
- tvm.testing.assert_allclose(c.asnumpy(), a.asnumpy() + b.asnumpy())
设定
- 使用FPGA Developer AMI启动实例。不需要F1实例进行仿真和综合,因此建议使用成本较低的实例。
- 设置AWS FPGA开发套件工具。
- git clone https://github.com/aws/aws-fpga.git
- cd aws-fpga
- source sdaccel_setup.sh
- source ${XILINX_SDX}/settings64.sh
- 在启用OpenCL的情况下设置TVM。
仿真
- 创建emconfig.json进行仿真。
- emconfigutil --platform ${AWS_PLATFORM} --nd 1
- 将emconfig.json复制到python二进制目录。当前的Xilinx工具包假定主机二进制文件和emconfig.json文件都在同一路径中。
- cp emconfig.json $(dirname $(which python))
- 运行软件仿真
- export XCL_EMULATION_MODE=1
- export XCL_TARGET=sw_emu
- python build.py
- python run.py
- 运行硬件仿真
- export XCL_EMULATION_MODE=1
- export XCL_TARGET=hw_emu
- python build.py
- python run.py
Synthesis
- 使用以下脚本运行综合。
- unset XCL_EMULATION_MODE
- export XCL_TARGET=hw
- python build.py
- 创建AWS FPGA映像并将其上传到AWS S3。
- ${SDACCEL_DIR}/tools/create_sdaccel_afi.sh \
- -xclbin=myadd.xclbin -o=myadd \
- -s3_bucket=<bucket-name> -s3_dcp_key=<dcp-folder-name> \
- -s3_logs_key=<logs-folder-name>
生成awsxclbin文件,对于在F1实例上使用AWS FPGA映像是必需的。
运行
- 启动Amazon EC2 F1实例。
- 将myadd.so,myadd.awsxclbin和run.py复制到F1实例。
- 设置AWS FPGA开发套件。
- git clone https://github.com/aws/aws-fpga.git
- cd aws-fpga
- source sdaccel_setup.sh
- 在启用OpenCL的情况下设置TVM。
- 设置root和setup环境变量。
- sudo sh
- source ${INSTALL_ROOT}/setup.sh
- 运行
python run.py
https://tvm.apache.org/docs/deploy/hls.html
HLS后端示例的更多相关文章
- iView学习笔记(一):Table基本操作(包含前后端示例代码)
iView表格操作 1.前端准备工作 首先新建一个项目,然后引入iView插件,配置好router npm安装iView npm install iview --save cnpm install i ...
- HLS playlist典型示例
[时间:2018-06] [状态:Open] [关键词:流媒体,HLS,m3u8,playlist,variant, alternate] 0 引言 本文主要是对apple官网上的echnical N ...
- Sentry 开发者贡献指南 - 后端服务(Python/Go/Rust/NodeJS)
内容整理自官方开发文档 系列 1 分钟快速使用 Docker 上手最新版 Sentry-CLI - 创建版本 快速使用 Docker 上手 Sentry-CLI - 30 秒上手 Source Map ...
- 视频直播点播nginx-rtmp开发手册中文版
2016年8月18日12:42:35 参照官方文档https://github.com/arut/nginx-rtmp-module/wiki/Directives 请注意这个是粗翻译版,仅供参考,不 ...
- 使用Visual Studio 2012 开发 Html5 应用
Visual Studio 一直以来是开发微软旗下应用的利器,只要是开发微软相关的应用无论是Windows程序,WPF,Asp.Net,WinRT Surface,WindowsPhone 等微软旗下 ...
- C#微信公众号学习 - (一)测试账号申请
主要分为两部分: 1.创建C#的项目,并发布, 2.微信填写发布的地址进行开发者验证. 一. VS环境为VS2017,创建项目时,自带的一些东西发布会导致各种错误,无奈,创建了空项目aspx窗体,如下 ...
- ABP入门教程14 - 更新多语言
点这里进入ABP入门教程目录 设置语种 新增语种 数据库操作 打开多语言表AbpLanguages,添加一条记录. 程序操作 在基础设施层(即JD.CRS.EntityFrameworkCore)的\ ...
- Flask-wtf导入Regexp规则库验证手机号码合法性(测试通过)
手机号码在项目有着很重要的地位,保证用户输入的号码准确无误就显得很关键. 废话不多说,现在页面中引入Regexp规则库: from wtforms.validators import Regexp 验 ...
- OpenWrt Web 开发 LuCI框架 lua语言
LuCI作为“FFLuCI”诞生于2008年3月份,目的是为OpenWrt固件从 Whiterussian 到 Kamikaze实现快速配置接口.Lua是一个小巧的脚本语言,很容易嵌入其它语言.轻量级 ...
随机推荐
- Docker Swarm删除节点
节点上的主机如果想离开的话,可以自己直接执行docker swarm leave 然后你可以发现,原本跑在自己上面的容器被转移到别的容器上了.此时如果在manager节点上docker node ls ...
- Linux-鸟菜-5-目录配置-FHS
Linux-鸟菜-5-目录配置-FHS 这节内容比较休闲,主要就是介绍Linux的目录配置,也就是那些目录通常是干啥的,这个比较重要,需要我们去了解.但是我觉得通常看一遍记不住啥,也就记个大概,主要还 ...
- vue-axios的总结及项目中的常见封装方法。
前言 我们知道 vue 2.0版本开始推荐使用 axios 来完成前端 ajax 请求,axios 是一个基于Promise 的 http 库,可以用在浏览器和 node.js 中,axios 成为v ...
- maven 中setting.xml
<mirror> <id>alimaven</id> <name>aliyun maven</name> <url>http:/ ...
- IP包头部格式解析
IPv4首部一般是20字节长.在以太网帧中,IPv4包首部紧跟着以太网帧首部,同时以太网帧首部中的协议类型值设置为080016. IPv4提供不同,大部分是很少用的选项,使得IPv4包首部最长可扩展到 ...
- OOP第三章博客
OO第三单元博客 • (1)梳理JML语言的理论基础.应用工具链情况: 理论基础: 网络资料上面介绍JML有两种主要的用法: 开展规格化设计.这样交给代码实现人员的将不是可能带有内在模糊性.二义性的自 ...
- JAVA并发(1)-AQS(亿点细节)
AQS(AbstractQueuedSynchronizer), 可以说的夸张点,并发包中的几乎所有类都是基于AQS的. 一起揭开AQS的面纱 1. 介绍 为依赖 FIFO阻塞队列 的阻塞锁和相关同步 ...
- 虚拟机快速下载安装配置aarch64-linux-gnu-gcc工具链
方式一:软件仓库安装 此方法不用自己去配置交叉编译工具链 1.查看本地仓库有支持哪些版本哪些 输入命令: apt-cache search aarch64 2.下载安装 gcc-8-aarch64-l ...
- SpringCloud-OAuth2(一):基础篇
关于Oauth2 的详细介绍官网地址:https://developer.okta.com/blog/2017/06/21/what-the-heck-is-oauth 1:什么是OAuth2 首先, ...
- Nacos服务发现
基础配置初始化 NacosDiscoveryClientConfiguration NacosDiscoveryProperties 初始化Nacos基础配置信息的bean,主要指yaml中配置Nac ...