AI芯片体系结构目标图形处理

AI chip architecture targets graph processing

可编程图形流处理器(GSP)能够执行“直接图形处理、片上任务图管理和执行以及任务并行性”。设计GSP是为了满足人工智能处理的需求,而这些需求以前是GPU、CPU或DSP无法满足的。

GSP体系结构由一系列图形流处理器、专用数学处理器、硬件控制和各种类型的数据缓存组成。GSP可以提供:“真正的任务级并行,最小限度地使用片外存储器,深度优先的硬件图形调度,完全可编程的体系结构。”

图形计算

虽然人工智能有许多不同类型的神经网络,所有的神经网络都是基于图形的,这允许开发人员利用图形原生结构在单个架构上构建多个神经网络和整个工作流。

然而,在图形计算领域,人工智能处理中需要“数据流图的优化和编译”。

GSP声称在三个方面与其他基于图形的数据流处理器有所不同。

首先,“完全可编程的”,能够执行“广泛的任务”。

其次,它是“动态可编程的……在一个时钟周期内”

第三,“提供流媒体的集成”,这使得最小化延迟成为可能。这种巨大的效率倍增器是通过“数据流机制”实现的,在这种机制中,非计算性数据移动被最小化或消除。

GSP体系结构的图形本机特性可以最小化数据在外部DRAM之间的来回移动。外部只需要第一个输入和最终输出,而中间的其他数据只是临时的中间数据。这将大大减少内存带宽和功耗。

在芯片、板和系统级别上尽可能降低延迟、减少内存需求和能源需求。

试点项目的经验教训

通过尽早推出GSP嵌入式桌面设备,“我们获得了进入真正客户及其工作负载需求的入场券。”

通过这些试点,基于GSP的平台有更多的应用程序和细分市场。其普惠制解决的市场范围从汽车和智能视觉(监视)到企业计算。

GSP可以满足从云中的数据中心到收集数据的边缘的所有地方施加的较低的能量限制。

GSP的驱动力正在迅速改变深度学习技术,包括新的拓扑、神经网络和算法。如此快节奏的技术进步常常促使客户希望芯片能做XYZ。这就是完全可编程的GSP架构发挥作用的地方。

例如,在汽车领域,GSP将应用于智能远程信息处理、ADAS、驾驶员监控和乘客评估。关键是许多汽车应用的单一GSP体系结构。

例如,单芯片可以结合激光雷达传感器输入和点云进行ISP处理、语义分割和传感器融合。这是通过视频目标检测和激光测距两个并行执行的数据流图来实现的。

由于GSP的主要市场是汽车(汽车客户总是要求确定性),GSP架构是“确定性的”。

最终开发了一个名为“Blaize NetDeploy”的工具。许多客户已经花了数周时间在优化GPU上经过训练的人工智能模型,并将其转换为在推理机上部署。一个软件工具,可以加速量化、修剪和压缩神经网络的过程。

AI芯片体系结构目标图形处理的更多相关文章

  1. AI芯片结构目标图形处理

    AI芯片结构目标图形处理 AI chip architecture targets graph processing 东京--AI处理器设计师Blaize,原名ThinCI(发音为"Thin ...

  2. AI芯片:高性能卷积计算中的数据复用

    随着深度学习的飞速发展,对处理器的性能要求也变得越来越高,随之涌现出了很多针对神经网络加速设计的AI芯片.卷积计算是神经网络中最重要的一类计算,本文分析了高性能卷积计算中的数据复用,这是AI芯片设计中 ...

  3. 十大热门AI芯片

    资料来源:头条<人工智能影响力报告>中的人工智能十大热门芯片 iPhone X内部搭载了一颗全新定制的处理器——A11 Boinic,用来承担人脸识别和移动支付的工作负荷.双核心A11芯片 ...

  4. 深度 | AI芯片终极之战

    深度 | AI芯片终极之战 https://mp.weixin.qq.com/s?__biz=MzA4MTQ4NjQzMw==&mid=2652712307&idx=1&sn= ...

  5. 人工智能AI芯片与Maker创意接轨(下)

    继「人工智能AI芯片与Maker创意接轨」的(上)篇中,认识了人工智能.深度学习,以及深度学习技术的应用,以及(中)篇对市面上AI芯片的类型及解决方案现况做了完整剖析后,系列文到了最后一篇,将带领各位 ...

  6. 深度 | AI芯片之智能边缘计算的崛起——实时语言翻译、图像识别、AI视频监控、无人车这些都需要终端具有较强的计算能力,从而AI芯片发展起来是必然,同时5G网络也是必然

    from:https://36kr.com/p/5103044.html 到2020年,大多数先进的ML袖珍电脑(你仍称之为手机)将有能力执行一整套任务.个人助理将变的更加智能,它是打造这种功能的切入 ...

  7. 一文看懂AI芯片竞争五大维度

    下一波大趋势和大红利从互联网+让位于人工智能+,已成业界共识.在AI的数据.算法和芯片之三剑客中,考虑到AI算法开源的发展趋势,数据与芯片将占据越来越重要的地位,而作为AI发展支柱的芯片更是AI业的竞 ...

  8. 一文解读AI芯片之间的战争 (转)

    2015年的秋天,北京的雨水比往年要多些,温度却不算太冷.这一年里,年仅23岁的姚颂刚刚拿到清华大学的毕业证书;32岁的陈天石博士毕业后已在中科院计算所待了整整8年;而在芯片界摸爬滚打了14年的老将何 ...

  9. 比特大陆发布终端 AI 芯片 端云联手聚焦安防

    雷帝网 乐天 10月17日报道 比特大陆今日正式发布终端人工智能芯片BM1880,一同发布的还有基于云端人工智能芯片 BM1682 的算丰智能服务器 SA3.嵌入式AI迷你机 SE3.3D 人脸识别智 ...

随机推荐

  1. 『动善时』JMeter基础 — 6、使用JMeter发送一个最基础的请求

    目录 步骤1:创建一个测试计划 步骤2:创建线程组 步骤3:创建取样器 步骤4:创建监听器 步骤5:完善信息 步骤6:保存测试计划 步骤7:查看结果 总结:JMeter测试计划要素 当我们第一次打开J ...

  2. hdu4771 水搜索(状态压缩+bfs)

    题意:      给你一个n*m的地图,问你从起点出发,吧所有的宝藏都捡完用的最少时间. 思路:k <= 4,水题,直接开一个数组mark[now][x][y];now代表的是当前检宝藏的二进制 ...

  3. Caddy-基于go的微型serve用来做反向代理和Gateway

    1.简单配置 2.go实现,直接一个二进制包,没依赖. 3.默认全站https 常用 反向代理,封装多端口gateway 使用:启动直接执行二进制文件 caddy 就行 根据输出信息 直接https: ...

  4. Android adb不是内部或外部命令 问题解决

    就是没有配置环境变量, 这个只需要将android安装:例如C:\Program File\android-sdk-windows\tools加入到系统变量Path中,需要注意的是Path中会配置的有 ...

  5. 【python】Leetcode每日一题-直方图的水量(接雨水)

    [python]Leetcode每日一题-直方图的水量(接雨水) [题目描述] 给定一个直方图(也称柱状图),假设有人从上面源源不断地倒水,最后直方图能存多少水量?直方图的宽度为 1. 上面是由数组 ...

  6. VMware-viclient-all

    VMware-viclient-all https://my.vmware.com/web/vmware/details?productId=491&downloadGroup=ESXI60U ...

  7. 【Bootstrap5】精细学习记录

    [Bootstrap5]精细学习记录 Bootstrap模板 <!DOCTYPE html> <html> <head> <title>Bootstra ...

  8. raft协议

    一.Raft一致性算法 Eureka:Peer To Peer,每个节点的地位都是均等的,每个节点都可以接收写入请求,每个节点接收请求之后,进行请求打包处理,异步化延迟一点时间,将数据同步给 Eure ...

  9. Windows反调试技术(下)

    OD的DBGHELP模块 检测DBGHELP模块,此模块是用来加载调试符号的,所以一般加载此模块的进程的进程就是调试器.绕过方法也很简单,将DBGHELP.DLL改名. #include <Wi ...

  10. C++ primer plus读书笔记——第1章 预备知识

    第1章 预备知识 1. Ritchie希望有一种语言能将低级语言的效率.硬件访问能力和高级语言的通用性.可移植性融合在一起,于是他在旧语言的基础上开发了C语言. 2. 在C++获得一定程度的成功后,S ...