编者按:这是微软亚洲研究院和中国科学院共同进行的一个合作项目,希望通过使用Kinect来帮助提升手语的识别率,从而为听力受损的残障人士(以下简称听障人士)架起一座与外界沟通的桥梁。

文章译自:Digital
Assistance for Sign-Language Users

对于听障人士来说,手语是他们与外界沟通最主要的语言。然而,不是每个人都懂得手语,即使是人工手语翻译也是可遇不可求。通过计算机来识别手语,然后进行翻译,听上去是一个很好的想法,但这个想法到今天为止却还未真正得以实现。正因如此,近些年来研究人员花费了大量时间攻克手语识别领域所存在挑战。他们曾研究过诸如数据手套或特殊摄像头这样的输入传感器潜在的发展空间。虽然前者在识别方面表现很好,但因为难以穿戴和过于昂贵很难投入广泛使用。而网络摄像头或立体摄像头虽然能够保证追踪手部运动的精度和速度,却很难处理好复杂背景和光照。

然后,一种叫做Kinect的设备进入人们视野。微软亚洲研究院的研究员与中国科学院计算技术研究所的同僚展开合作,对Kinect的肢体追踪功能如何应用于手语识别进行了研究。结果让人欣慰!这项技术让以手语为主要沟通手段的听障人士像使用语音识别一样,与电脑进行更为自然和流畅的互动。

“在我们看来,这个项目最显著的贡献是它向我们展示了通过3-D和2-D传感器构建手语识别的可能。”中国科学院陈熙霖教授表示。

微软研究院学术合作部的帮助和支持下,这项成果被总结成为论文《基于Kinect的手语识别和翻译》,联合作者为中国科学院柴秀娟、李广、陈熙霖等研究员,以及微软亚洲研究院首席研究员周明

正因为Kinect能够同时提供深度信息和色彩数据,它让准确、快速追踪手部和肢体动作变得更加容易。

近日,微软研究院第14届教育高峰会(Faculty
Summit 2013
)在微软总部举行,其中的展示环节Demo
Fest
与超过400名学术研究者们分享了具有深远影响力的研究,其中就包括该手语识别项目。这是一个3-D运动轨迹校准并将手语和单词逐一对应的过程。当一个手语词汇被分析时,这些词语先通过Kinect
for Windows SDK
的手部动作轨迹生成,然后规范化,继而计算匹配分数,最后识别出最相关的候选。

反过来,3-D轨迹匹配的算法又为构建一个手语识别和翻译的系统创建了基础。这一系统包括两个模式。第一是翻译模式,将手语翻译成文本或者语音,包括对单词或单句的识别。第二是交流模式,通过使用虚拟形象使正常人和听障人士的沟通变成可能。以键盘输入的文本为引导,虚拟形象可以表现出相应的手语。而听障人士通过手语进行回应,系统会将其转换为文本进行回答。

Kinect手语识别项目真实场景演示片段

这样有效吗?出乎意料地有效!

“这个项目一个独特的贡献是联合了计算机研究员和听障人士的共同努力,”周明说,“一群来自特殊学院的教师和学生加入了这个项目,使得我们的算法数据来源于真实的世界”。

这刚好与项目的目标相契合。该研究在视觉信息处理领域颇具价值,与此同时,也为那些极需此类援助的人群提供了帮助。

“自从Kinect问世以来,我们已经不止一次惊喜地看到它被研究人员进行‘再创造’”,微软研究院学术合作部,负责自然用户界面相关学术研究合作的主管Stewart
Tansley
表示,“该项目是学术界与微软研究院紧密合作的一个范例,也证明了科技的潜力——跨越语言和文化的界限,潜移默化地改善我们的生活,最终让我们彼此之间联系得更为紧密。”

这项研究在视觉信息处理领域具有巨大的价值,同时它也旨在为那些主要依赖手语进行交流的人们提供实际援助。

“我们相信IT应该被用来提升所有人的日常生活质量,”微软亚洲研究院研究项目经理吴国斌说,“希望这项成果在不久的将来能够为听障人士提供一个日常互动工具,在他们和拥有正常听力的人之间架起一座桥梁。”

微软教育高峰会对Kinect手语识别项目进行访谈
____________________________________________________________________________

相关阅读:

Kinect for Windows带着创新与机遇登陆中国

Kinect掀起外科手术的革命

创新改变生活

欢迎关注

微软亚洲研究院官方微博:http://e.weibo.com/msra/profile

微软亚洲研究院人人主页:http://www.renren.com/600674137

用Kinect为听障人士架一座沟通的桥梁的更多相关文章

  1. 探索Kinect的更多可能——亲历第十九届机器人世界杯RoboCup

    作者:微软亚洲研究院资深项目经理 吴国斌 2015年7月19日,第十九届RoboCup机器人世界杯足球赛,在中国合肥隆重开幕.来自全球七十六个国家和地区的一百余支代表队参加了决赛,他们优秀的作品给观众 ...

  2. “冰桶挑战”之外:微软科技助力ALS患者

    编者按:"直到ALS出现治疗方法,科技就是我的解药."ALS患者,前美国橄榄球联盟(NFL)球员Steve Gleason如是说.最近,一支微软首届黑客马拉松(Hackathon) ...

  3. 雅虎UED--无障碍网页设计

    转自:http://www.sharetk.com/html/ued/Interactive-Design/1394.html 随着web使用量的增加和人们网络意识的增强,一些特殊用户开始被我们所关注 ...

  4. HTML入门3

    HTML主要工作在于编辑文本结构和文本内容,也称语义(semantics)以便能够再浏览器正确地显示,下面开始介绍在文本中添加标题,段落,强调语句,创建列表等等 基础:标题和段落 内容结构化会使得阅读 ...

  5. Python猫荐书系列之七:Python入门书籍有哪些?

    本文原创并首发于公众号[Python猫],未经授权,请勿转载. 原文地址:https://mp.weixin.qq.com/s/ArN-6mLPzPT8Zoq0Na_tsg 最近,猫哥的 Python ...

  6. Insights直播回顾——手语服务,助力沟通无障碍

    HMS Core Insights第九期直播–手语服务,助力沟通无障碍,已于12月29日圆满结束,本期直播与小伙伴们一同了解了HMS Core手语服务的亮点特性.底层技术以及演进规划,下面我们一起来回 ...

  7. HMS Core新闻行业解决方案:让技术加上人文的温度

    开发者们,你希望用户如何获取新闻? 有的人靠手机弹窗知天下事,有的人则在新闻应用中尽览每一篇文章:有的人一目十行,有的人则喜欢细细咀嚼:有的人主动探索,有的人则想要应用投其所好. 科技在不断刷新着用户 ...

  8. 华为HMS Core携手超图为三维GIS注入新动能

    6月30日,在2022(第五届)GIS软件技术大会GIS基础软件新技术板块论坛上,华为联合超图推出了基于HMS Core 3D Engine开发的高保真三维GIS插件,通过3D渲染技术助力三维GIS实 ...

  9. 【毕业设计】基于Android的家校互动平台开发(内含完整代码和所有文档)——爱吖校推(你关注的,我们才推)

    ☆ 写在前面 之前答应大家的毕业答辩之后把所有文档贡献出来,现在答辩已过,LZ信守承诺,把所有文档开源到了GitHub(这个地址包含所有的代码和文档以及PPT,外层为简单的代码).还望喜欢的朋友们,不 ...

随机推荐

  1. 【Linux】linux用户系统管理

    Linux系统是一个多用户多任务的分时操作系统,任何一个要使用系统资源的用户,都必须拥有一个账号,然后以这个账号的身份进入系统. 用户:使用linux系统的人. 用户组:具有相同权限的一组用户. li ...

  2. 洛谷 P2196 挖地雷

    题目传送门 解题思路: 记忆化搜索,题目比较坑的地方在于,这是个有向图,给的边是单向边!!!!!!!! AC代码: #include<iostream> #include<cstdi ...

  3. Redis 在NETCore中的应用

    Redis 在NETCore中的应用 Redis 在netFramework中的应用  也一样 新建.NETCORE(webapi)项目 安装NuGet //查询NuGet语句 Find-Packag ...

  4. MySQL-TPS,QPS到底是什么

    计算TPS,QPS的方式 qps,tps是衡量数据库性能的关键指标,网上普遍有两种计算方式 TPS,QPS相关概念 QPS:Queries Per Second         查询量/秒,是一台服务 ...

  5. CMake常用变量

    CMake变量 CMake共用七种变量,如下所示: 目录: ()提供信息的变量. ()控制变量. ()描述系统的变量. ()控制构建过程的变量. ()语言变量. ()CTest变量. (7)CPack ...

  6. 下面介绍mysql中模糊查询的四种用法:

    下面介绍mysql中模糊查询的四种用法: 1,%:表示任意0个或多个字符.可匹配任意类型和长度的字符,有些情况下若是中文,请使用两个百分号(%%)表示. 比如 SELECT * FROM [user] ...

  7. UVA-10074 最大子矩阵 DP

    求出大矩阵里面全为0的最大子矩阵 我自己用的个挫DP写的,感觉写的不是很好,其实可以再优化,DP想法就是以 0 0 到当前 i j 为整体矩阵考虑,当前 i j就是从 i-1 j或者 i,j-1那里最 ...

  8. 吴裕雄--天生自然 PHP开发学习:MySQL子句

    <?php $con=mysqli_connect("localhost","username","password","d ...

  9. 微信小程序使用第三方FontIcon库的部分字体图标

    一.提取部分图标重新制作TTF字库 我没有使用网上大多数文章写的淘宝提供的fonticon,而只使用了Ionicons的几个图标,所以打开Ionicons的官网点击右上角的Designer pack下 ...

  10. dht算法原理描述

    dht原理 dht是P2P网络(结构化P2P)核心路由算法,主要是利用一致性hash,把节点和资源都表示成一个hash值,放入到这个大的hash环中,每个节点负责路由靠近它的资源. 一.重要概念:  ...