2019年數(shù)字生態(tài)大會于5月21日—23日在昆明舉行,在AI分論壇上,騰訊優(yōu)圖實驗室聯(lián)合負責(zé)人、杰出科學(xué)家賈佳亞分享了優(yōu)圖近期在AI手語識別上取得的突破——推出基于自研算法的“優(yōu)圖AI手語翻譯機”。
據(jù)賈佳亞介紹,AI手語翻譯機以普通攝像頭作為手語采集裝置,依托高性能計算機進行后臺運算,用戶只要正對攝像頭完成手語表達,翻譯機就能快速運算出結(jié)果并把手語翻譯成為文字。未來有望在機場、民政窗口等公共場所部署和落地,助力信息無障礙城市建設(shè)。
(騰訊優(yōu)圖實驗室聯(lián)合負責(zé)人、騰訊杰出科學(xué)家 賈佳亞)
AI手語翻譯機:自研算法,實現(xiàn)手語識別“黑科技”
手語識別(SLR),就是指通過計算機算法,自動區(qū)分手語表達中的各類手勢、動作以及這些手勢和動作之間的切換,最后將表達的手語翻譯成文字。不過相比于其他AI視覺識別技術(shù)的研究,手語識別的研發(fā)卻存在更大的困難和挑戰(zhàn)。手語表達所特有的地域性、復(fù)雜性和多樣性極大地增加了數(shù)據(jù)采集與清洗的難度和成本,而受限于數(shù)據(jù)量的大小和人工設(shè)計特征的缺陷,很多傳統(tǒng)研究的研究方法在適應(yīng)性、泛化性及魯棒性上都十分有限。
(優(yōu)圖AI手語翻譯機界面)
據(jù)賈佳亞介紹,此次騰訊優(yōu)圖推出的AI手語翻譯機,結(jié)合聽障人士手語表達的習(xí)慣采集手語數(shù)據(jù),參考先進的手勢識別、動作識別和序列翻譯等技術(shù),通過自研算法實現(xiàn)了對復(fù)雜手語表達的識別技術(shù)突破。相較于其他方法,優(yōu)圖AI手語翻譯機的數(shù)據(jù)集覆蓋了近千句日常表達,900個常用詞匯,同時對數(shù)據(jù)進行進一步的分析和歸納,擁有目前最大的中文手語識別數(shù)據(jù)集,并支持整句手語表達的識別,可直接判斷用戶是否結(jié)束并完成實時翻譯。
應(yīng)用探索:視覺AI,助力信息無障礙建設(shè)
據(jù)北京聽力協(xié)會2017年公開數(shù)據(jù),估計中國殘疾性聽力障礙人士已達7200萬,相當(dāng)于北京市常住人口(約2200萬,2015年數(shù)據(jù))的3倍多。盡管我國在信息無障礙領(lǐng)域的投入逐漸增加,但目前國內(nèi)的聽障人群需求依然得不到滿足。優(yōu)圖AI手語翻譯機的推出將一定程度地緩解聽障人士的交流障礙。
在演講中,賈佳亞表示,“未來,我們希望通過與聾啞人士或手語使用者的深入接觸,嘗試在公共事物場所為聽障者提供更好的服務(wù),更好地助力信息無障礙的建設(shè)。”下一步,優(yōu)圖實驗室將對AI手語翻譯機展開優(yōu)化和升級,嘗試在日常服務(wù)窗口、手語教育等場景中落地,為聽障人士帶來實實在在的便利。
目前,優(yōu)圖實驗室已經(jīng)和深圳市信息無障礙研究會成立AI手語識別聯(lián)合項目組,就手語數(shù)據(jù)采集、產(chǎn)品算法優(yōu)化等方面展開長期深度合作,并通過與聽障者或手語使用者進一步接觸,擴充數(shù)據(jù)容量,完善數(shù)據(jù)規(guī)范,致力于推動后續(xù)的產(chǎn)品和服務(wù)部署,推動信息無障礙建設(shè)。
(優(yōu)圖和深圳信息無障礙研究會AI聽障無障礙聯(lián)合項目組)
此次的數(shù)字生態(tài)大會展示的優(yōu)圖AI手語翻譯機,并不是騰訊在信息無障礙建設(shè)上的首次嘗試。早在2009年騰訊便開始了信息無障礙方面的探索,截至目前,旗下QQ、QQ空間、微信、騰訊網(wǎng)、騰訊新聞、應(yīng)用寶、企鵝FM等大部分產(chǎn)品已針對障礙用戶實現(xiàn)專門優(yōu)化,致力于為障礙人士構(gòu)建信息友好社會。2013年,騰訊優(yōu)圖團隊和手機QQ一起打磨了OCR引擎技術(shù),基于計算機視覺算法及自然語言處理能力,可將圖片上的文字直接轉(zhuǎn)換為可編輯的結(jié)構(gòu)化文本,幫助視障群體實現(xiàn)信息溝通無障礙化。
與本次亮相數(shù)字生態(tài)大會AI分論壇的跨年齡人臉識別技術(shù)一樣,優(yōu)圖AI手語翻譯機同樣是騰訊踐行“科技向善”的重要體現(xiàn)。而優(yōu)圖實驗室也將繼續(xù)秉承“科技向善”這一理念,推動前沿技術(shù)在社會場景中的應(yīng)用,切實讓更多的實際問題得以解決。做有溫度的AI,讓科技產(chǎn)生更大的社會價值。
- 蜜度索驥:以跨模態(tài)檢索技術(shù)助力“企宣”向上生長
- 新能源車技術(shù)升級搶先看,ChatGPT崩了引熱議:未來科技如何破局?
- 自動駕駛行業(yè)大洗牌即將結(jié)束,小馬智行引領(lǐng)千臺車隊新篇章
- 微軟反壟斷風(fēng)暴:Office捆綁銷售引質(zhì)疑,云服務(wù)策略遭調(diào)查,巨頭陷困境
- 顯卡漲價風(fēng)暴來襲!NVIDIA/AMD緊急應(yīng)對,全力加速生產(chǎn)運回本土
- 微軟新目標(biāo):用1000億美元打造實用通用AI,未來可期但需謹(jǐn)慎
- 亞馬遜云科技陳曉建預(yù)測:未來三年內(nèi),生成式AI將引發(fā)云市場新革命
- 林肯中國辟謠:財務(wù)調(diào)整非合并,業(yè)務(wù)不變穩(wěn)如泰山
- 字節(jié)跳動研發(fā)大手筆:2024年投入接近BAT之和,能否引領(lǐng)中國OpenAI新潮流?
- 跨境匯款平臺新舉措:螞蟻集團開發(fā)者服務(wù)限每日10萬美元,助力全球交易更便捷
- 我國充電樁建設(shè)提速,50%增長背后的高速服務(wù)區(qū)充電新篇章
免責(zé)聲明:本網(wǎng)站內(nèi)容主要來自原創(chuàng)、合作伙伴供稿和第三方自媒體作者投稿,凡在本網(wǎng)站出現(xiàn)的信息,均僅供參考。本網(wǎng)站將盡力確保所提供信息的準(zhǔn)確性及可靠性,但不保證有關(guān)資料的準(zhǔn)確性及可靠性,讀者在使用前請進一步核實,并對任何自主決定的行為負責(zé)。本網(wǎng)站對有關(guān)資料所引致的錯誤、不確或遺漏,概不負任何法律責(zé)任。任何單位或個人認為本網(wǎng)站中的網(wǎng)頁或鏈接內(nèi)容可能涉嫌侵犯其知識產(chǎn)權(quán)或存在不實內(nèi)容時,應(yīng)及時向本網(wǎng)站提出書面權(quán)利通知或不實情況說明,并提供身份證明、權(quán)屬證明及詳細侵權(quán)或不實情況證明。本網(wǎng)站在收到上述法律文件后,將會依法盡快聯(lián)系相關(guān)文章源頭核實,溝通刪除相關(guān)內(nèi)容或斷開相關(guān)鏈接。