NVIDIA Jetson TX2作为一个嵌入式平台的深度学习端,具备不错的GPU性能,可以发现TX2的GPU的计算能力是6.2。这意味着TX2对半精度运算有着良好的支持,因此,完全可以在桌面端训练好模型,然后移植到TX2上利用半精度运行进行推理,这样可以达到生产落地的效果。

各种情况的硬件:

https://developer.nvidia.com/embedded/develop/hardware

高性能低功耗NVIDIA®Jetson™系统可在边缘端提供用户最需要的实时人工智能(AI)性能,可以在机载小型节能设备上完成复杂数据的处理,因此,可以在网络受限的环境中能够快速和准确地进行推理。

NVIDIA Jetson TX2 开发套件和模块与NVIDIA JetPack SDK一起,提供了使用一个统一的软件体系结构为多种用例开发和部署应用程序所需的一切,显著地降低了软件开发成本,并为自动机提供了可扩展的AI策略。边缘端的AI释放了从医疗保健到制造业再到农业等所有领域的巨大潜力。

技术指标:

JetPack 4.2.2 for Jetson AGX Xavier, Jetson TX2 and Jetson Nano is available now。

Jetson TX2 Module

https://developer.nvidia.com/embedded/jetson-tx2

Jetson TX2是一款人工智能超级计算机模块并采用NVIDIA Pascal™架构。Jetson TX2是最快,最节能的嵌入式AI计算设备。这台7.5瓦超级计算机将真正的AI计算带到了边缘端。它基于NVIDIA Pascal™系列GPU构建,并集成8GB内存和59.7GB / s的内存带宽。它集成多种标准硬件接口,可轻松将其集成到各种产品中。

技术指标:

GPU

256-core NVIDIA Pascal™ GPU with 256 NVIDIA CUDA cores 一块有256个CUDA核心的GPU

CPU

Dual-Core NVIDIA Denver 2 64-Bit CPU 双核丹佛2 64位CPU集群(提高单线程性能)

Quad-Core ARM® Cortex®-A57 MPCore 四核心ARM CortexA57集群(适合于多线程应用程序)

Memory

8GB 128-bit LPDDR4 Memory  8G 128位内存控制器,提供高带宽LPDDR4支持

1866 MHx - 59.7 GB/s 内存带宽

Storage

32GB eMMC 5.1闪存

Power

7.5W / 15W

WI-FI

Wifi和蓝牙

为了让开发者快速上手,Jetson TX2 预先搭载了 JetPack 3.0。开发者可以在云端、数据中心或是个人计算机上使用最新的 NVIDIA DIGITS™ 5.0 接口训练深度学习模型,然后运用 JetPack 最新版本搭载的高性能推理引擎 TensorRT™ 1.0 将训练完成的模型部署到 Jetson TX2。

Jetson TX2提供两种运行模态:一种是MAX Q,能效比能达到最高,是上一代的TX1的2倍,功耗在7.5W以下;另一种是MAX P,性能可以做到最高,能效比同样可以做到前一代的2倍,功耗则在15W以下。

和TX1的对比:

自带的软件包配置JetPack 3.0

这款功能强大的开发者套件能够使主板的硬件功能和接口充分发挥效用,预装 Linux 开发环境。同时,它还支持 NVIDIA Jetpack SDK,包括 BSP、深度学习库、计算机视觉、GPU 计算、多媒体处理等众多功能。

JetsonDevelopment Pack(JetPack) 是一个按需提供的一体化软件包,捆绑并安装了适用于 NVIDIA Jetson 嵌入式平台的所有开发用软件工具。NVIDIA JetPack SDK是构建AI应用程序的最全面的解决方案。它捆绑了所有Jetson平台软件,包括TensorRT,cuDNN,CUDA工具包,VisionWorks,Streamer和OpenCV,这些都是基于LTS Linux内核的L4T。

JetPack 包括:

深度学习: TensorRT、cuDNN、NVIDIADIGITS™ 工作流程;

计算机视觉: NVIDIA VisionWorks、OpenCV;

GPU 计算: NVIDIA CUDA、CUDA 库;

多媒体: ISP 支持、摄像头图像、视频 CODEC;

同时,它还包括 ROS 兼容性、OpenGL、高级开发者工具等等。

VisionWorks:

VisionWorks是用于计算机视觉(CV)和图像处理的软件开发包。VisionWorks™实现并扩展了Khronos OpenVX标准,并针对具有CUDA功能的GPU和SOC进行了优化,使开发人员能够在可扩展的灵活平台上实现CV应用程序。它包括VPI(视觉编程接口),这是CUDA开发人员使用的一组优化的CV原语。NVX库允许直接访问VPI,OVX库允许通过OpenVX框架间接访问VPI。VisionWorks的核心功能是针对以下方面的解决方案而设计的:机器人和无人机,自动驾驶,智能视频分析,增强现实。

OpenCV:

OpenCV是计算机视觉,图像处理和机器学习领域的领先开源库,现在提供GPU加速以实现实时操作。OpenCV被广泛的应用,包括:街景图像拼接,自动检查和监视,机器人和无人驾驶的汽车导航和控制,医学图像分析,视频/图像搜索和检索,电影–3D,交互艺术设备。

其他有用的超级连接如此下:

https://developer.nvidia.com/embedded/learn/getting-started-jetson

https://developer.nvidia.com/embedded/learn/tutorials

https://developer.nvidia.com/embedded/faq

Jetson TX2的更多相关文章

  1. Jetson TX2安装固态硬盘(原创)

    SSD on Jetson TX2 注意事项:在断电情况下,将固态硬盘的接线与Jetson TX2进行连接 步骤: 一.jetson tx2开机,打开搜索栏中的Disks 二.Disks显示画面 三. ...

  2. Jetson TX2安装tensorflow(原创)

    Jetson TX2安装tensorflow 大致分为两步: 一.划分虚拟内存 原因:Jetson TX2自带8G内存这个内存空间在安装tensorflow编译过程中会出现内存溢出引发的安装进程奔溃 ...

  3. Jetson TX2刷机教程(原创)

    Jetson TX2刷机教程 一,硬件准备 1台host主机(linux系统,最好是ubuntu64位) 1台Jetson TX2的平台 二,软件包 JetPack(Jetson SDK) 下载地址: ...

  4. Jetson TX2上的demo(原创)

    Jetson TX2上的demo 一.快速傅里叶-海动图 sample The CUDA samples directory is copied to the home directory on th ...

  5. Jetson TX2火力全开

    Jetson Tegra系统的应用涵盖越来越广,相应用户对性能和功耗的要求也呈现多样化.为此NVIDIA提供一种新的命令行工具,可以方便地让用户配置CPU状态,以最大限度地提高不同场景下的性能和能耗. ...

  6. 【ARM-Linux开发】【CUDA开发】NVIDIA Jetson TX2 进阶:Nsight Eclipse Edition

    嵌入式平台:NVIDIA Jetson TX2 嵌入式系统:Ubuntu16.04 虚拟机系统:Ubuntu14.04 一.NSight简介 Jetpack开发工具为人工智能提供了一整套软件架构,包括 ...

  7. 【ARM-Linux开发】【CUDA开发】【深度学习与神经网络】Jetson Tx2安装相关之三

    JetPack(Jetson SDK)是一个按需的一体化软件包,捆绑了NVIDIA®Jetson嵌入式平台的开发人员软件.JetPack 3.0包括对Jetson TX2 , Jetson TX1和J ...

  8. nvidia jetson tx2 刷机遇到的问题解决

    一.主要信息 使用的开发板:nvidia jetson tx2(内存8g有wifi的版本) 使用的JetPack版本: 4.2.2 二.遇到的问题及解决 1. 刷好jetson os 后,开发板一直在 ...

  9. Jetson TX2介绍

    Jetson TX2是NIVDIA瞄准人工智能在Jetson TK1和TX1推出后的升级 TX2的GPU和CPU都进行了升级,内存增加到了8GB.存储增加到了32GB,支持Wifi和蓝牙,编解码支持H ...

随机推荐

  1. [BZOJ 5127][Lydsy1712月赛]数据校验

    Description 题库链接 给你一个长度为 \(n\) 的序列.\(m\) 次询问,每次询问序列的一个区间 \([l,r]\).对于 \([l,r]\) 内的所有子区间,询问值域是否连续.若存在 ...

  2. C++内存分配/分布——堆栈存储区

    FROM: C++内存分配方式详解——堆.栈.自由存储区.全局/静态存储区和常量存储区 栈,就是那些由编译器在需要的时候分配,在不需要的时候自动清除的变量的存储区.里面的变量通常是局部变量.函数参数等 ...

  3. 六.深浅copy

    先问问大家,什么是拷贝?拷贝是音译的词,其实他是从copy这个英文单词音译过来的,那什么是copy? copy其实就是复制一份,也就是所谓的抄一份.深浅copy其实就是完全复制一份,和部分复制一份的意 ...

  4. junit4的进一步探讨

    上次只是大概记录了下junit4几个常见标签的用法. 在这篇文章中,我们来进一步分析junit4的用法. 1.断言 junit4中一个很常见的用法就是断言.说到断言,大家再熟悉不过了.不过也许有的朋友 ...

  5. learning scala akka ask_pattern

    package com.example import akka.actor._ import akka.util.Timeout object Tutorial_03_Ask_Pattern exte ...

  6. WinDbg常用命令系列---反汇编u*

    u, ub, uu (Unassemble) u*命令显示内存中指定程序代码的汇编转换.不要将此命令与~u(解冻线程)命令混淆. u[u|b] Range u[u|b] Address u[u|b] ...

  7. Debian 9 安装 libsodium

    到这里查看最新的版本号.如现在最新的版本号为1.0.18.下面均以该版本为例. 下载.编译和安装: wget https://download.libsodium.org/libsodium/rele ...

  8. CSS3之碰撞反弹动画无限运动

    示例代码如下: <!DOCTYPE html> <html lang="en"> <head> <meta charset="U ...

  9. javascript之命名空间方法封装

    详细代码如下: Object.prototype.namespace= function(name){ var parts = name.split('.'); var current = this; ...

  10. 原创:logistic regression实战(一):SGD Without lasso

    logistic regression是分类算法中非常重要的算法,也是非常基础的算法.logistic regression从整体上考虑样本预测的精度,用判别学习模型的条件似然进行参数估计,假设样本遵 ...