![]()
【网易智能讯 10月22日动静】计较机视觉正正在成为科技公司的一大,可以或许让机械加快运转,并完成迄今为止只能由人类完成的。
几个月前,eBay发布将要添加新的功能,能够让用户利用现有照片来寻找雷同商品,同时线上服拆零售商ASOS则正在时髦范畴涉脚此项。Shutterstock上周发布了一项全新的测试功能,用户能够按照本人的结构来股票照片。过了几天,谷歌照片使用发布了新的宠物图像识别功能。
简而言之,正在计较机视觉范畴,成长越来越冲动,同时也能够看到人们对人工智能范畴的大量投资行之有效。
目前,大大都计较机视觉手艺的前进次要发生正在静态图像范畴,但我们也起头正在视频中看到计较机视觉手艺的功效。例如,俄罗斯正在全国的及时收集中使用了面部识别手艺。Pornhub也正在做雷同的工作,从动对“文娱”视频进行分类,包罗锻炼系统识别特定的性姿态。此外,还有兴旺成长的从动驾驶汽车行业,正在很大程度上依赖于机械对现实世界行为理解的能力。
正在如许的布景下,谷歌推出了一个新的视频数据库,但愿可以或许鞭策计较机视觉识别影像中行为的研究。“原子视觉行为”的英文缩写“AVA”是一个由多个标签构成的数据库,用户能够正在视频序列中进行操做。
视频中动做识此外坚苦次要正在于视频中各类复杂的场景交错正在一,多个动做也正在统一时间由分歧的人发出。

谷歌软件工程师顾春晖和大卫罗斯正在一篇博客文章中注释道:“机械去识别影像中的人类行为是成长计较机视觉的一大根基难题,可是对于小我视频和发觉、体育阐发和手势界面等使用至关主要。”“虽然过去几年正在图像分类和寻找物体方面取得了冲动的冲破,但识别人类行为仍然是一个庞大的挑和。”
![]()
素质上,AVA就是一堆被80个原子动做标注的YouTube网址,并延长到了近5.8万个视频片段,涉及到良多日常,好比握手、踢腿、拥抱、接吻、喝酒、玩乐器、散步等等。
通过对外数据库,谷歌但愿能够改良机械的“社交视觉智能”,如许他们就能理解人类正在做什么,并预测他们下一步会做什么。
该公司暗示:“我们但愿,AVA的发布将有帮于改良人类行为识别系统的开辟,并无机会基于时空间隔标签对复杂的进行建模。”
(选自:VentureBeat 翻译:网易见外翻译机械人 审校:秦昕)
关心网易智能公家号(smartman163),获取人工智能行业最新。
