三菱电机研发场景感知交互技术 可给驾驶员提供自然直观的指导
2020-7-27 来源:- 作者:-
为让机器与人类更加直观、自然地互动,三菱电机研发了一种场景感知交互技术。
据外媒报道,近日,日本三菱电机(Mitsubishi Electric Corporation)公司宣布其研发了全球首款能够与人类进行高度自然其直观互动的技术,该技术基于场景感知能力,能够将多模态感知信息翻译成自然语言。该款新技术名为场景感知交互(Scene-Aware Interaction),整合了三菱电机的专有Maisart紧凑型AI技术,可以分析多模态感知信息,通过依赖于上下文情境生成的自然语言与人类实现高度自然且直观的交互。

(图片来源:三菱电机)
该技术基于多模态感知信息,如摄像头捕捉的图像和视频、麦克风录下的音频信息以及激光雷达测量的定位信息,以识别情境中的物体。为了对这些不同类别的信息进行优先排序,三菱电机研发了注意力多模态融合技术(Attentional Multimodal Fusion),能够自动加权突出的单模态信息,为准确描述场景而选择适当词汇。在采用通用测试集的基准测试中,注意力多模态融合技术采用音频和视觉信息来取得基于共识的图像描述评价(CIDEr)得分,发现比仅使用视觉信息的得分高出29%。三菱电机将注意力多模态融合与场景理解技术和基于情境的自然语言生成技术相结合,实现了强大的端到端场景感知交互系统,在不同场景下,都可以与用户实现高度直观的交互。

(图片来源:三菱电机)
场景感知交互技术可用于汽车导航应用,为驾驶员提供直观的路线导航。例如,系统不再指示驾驶员“在50米内右转”,而是提供场景感知型指导,如“在邮箱前右转”或“跟着灰色的车向右转”。此外,该系统还会在预测到附近有物体的行进路径与车辆的行进路径相交时,生成语音警报,如“有行人正在过马路”。为了实现这一功能,该系统会分析场景,识别出场景中隐藏的视觉路标以及动态元素,然后利用此类东西识别物体和事件,为导航生成直观的句子指导。

(图片来源:三菱电机)
利用深度神经网络进行物体识别、视频描述、自然语言生成和口语对话等技术最近取得了很多进展,可以让机器能够更好地理解周围的环境,并更自然、更直观地与人类互动。场景感知交互技术预计具有广泛的适用性,包括用于车载信息娱乐系统的人机接口、在建筑物中与机器人交互以及工厂自动化系统、监控人类健康状况的系统、为人类解释复杂场景的监测系统、鼓励保持社交距离的系统、在公共场所支持无触摸操作设备的系统等等。
投稿箱:
如果您有机床行业、企业相关新闻稿件发表,或进行资讯合作,欢迎联系本网编辑部, 邮箱:skjcsc@vip.sina.com
如果您有机床行业、企业相关新闻稿件发表,或进行资讯合作,欢迎联系本网编辑部, 邮箱:skjcsc@vip.sina.com
更多相关信息
- target=_blank> 渭南高新区与中联重科土方机械公司签订战略合作协议
- target=_blank>首进榜单,徐工广联位列全球高空作业机械租赁22强
- target=_blank>白鹤滩世界首台长短叶片百万千瓦机组转轮安装就位
- target=_blank>舍弗勒获批省地方标准立项
- target=_blank>“天问”奔火星,洛轴助一力
新闻资讯
| 更多
- target=_blank>MB2120B型数控内圆磨床电主轴变频器的改造
- target=_blank>【雷尼绍】RESOLUTE™与MELSERVO-J5强强组合,实现更快速、精确、可靠的运动控制
- target=_blank>NSK开发低摩擦轮毂单元轴承 可增加电动汽车续航里程
- target=_blank>T68卧式镗床进给系统的数字化改造
- target=_blank>AGV+协作机器人在零件数控机床加工上下料中的应用
- target=_blank>2020年7月高端装备制造业、工业机器人,行业运行简述
- target=_blank>浅谈线切割机床中走丝与慢走丝
- target=_blank>ANCA整体PCD铣刀 —— 提高生产效率带来新的发展机遇
- target=_blank>伊斯卡,不止专注于金属加工
- target=_blank>EMAG成功收购Scherer Feinbau(舍勒公司),极大扩展了公司产品范围以及客户群体