2019年數(shù)字生態(tài)大會于5月21日—23日在昆明舉行,在AI分論壇上,騰訊優(yōu)圖實驗室聯(lián)合負責人、杰出科學家賈佳亞分享了優(yōu)圖近期在AI手語識別上取得的突破——推出基于自研算法的“優(yōu)圖AI手語翻譯機”。
據(jù)賈佳亞介紹,AI手語翻譯機以普通攝像頭作為手語采集裝置,依托高性能計算機進行后臺運算,用戶只要正對攝像頭完成手語表達,翻譯機就能快速運算出結(jié)果并把手語翻譯成為文字。未來有望在機場、民政窗口等公共場所部署和落地,助力信息無障礙城市建設。
(騰訊優(yōu)圖實驗室聯(lián)合負責人、騰訊杰出科學家 賈佳亞)
AI手語翻譯機:自研算法,實現(xiàn)手語識別“黑科技”
手語識別(SLR),就是指通過計算機算法,自動區(qū)分手語表達中的各類手勢、動作以及這些手勢和動作之間的切換,最后將表達的手語翻譯成文字。不過相比于其他AI視覺識別技術的研究,手語識別的研發(fā)卻存在更大的困難和挑戰(zhàn)。手語表達所特有的地域性、復雜性和多樣性極大地增加了數(shù)據(jù)采集與清洗的難度和成本,而受限于數(shù)據(jù)量的大小和人工設計特征的缺陷,很多傳統(tǒng)研究的研究方法在適應性、泛化性及魯棒性上都十分有限。
(優(yōu)圖AI手語翻譯機界面)
據(jù)賈佳亞介紹,此次騰訊優(yōu)圖推出的AI手語翻譯機,結(jié)合聽障人士手語表達的習慣采集手語數(shù)據(jù),參考先進的手勢識別、動作識別和序列翻譯等技術,通過自研算法實現(xiàn)了對復雜手語表達的識別技術突破。相較于其他方法,優(yōu)圖AI手語翻譯機的數(shù)據(jù)集覆蓋了近千句日常表達,900個常用詞匯,同時對數(shù)據(jù)進行進一步的分析和歸納,擁有目前最大的中文手語識別數(shù)據(jù)集,并支持整句手語表達的識別,可直接判斷用戶是否結(jié)束并完成實時翻譯。
應用探索:視覺AI,助力信息無障礙建設
據(jù)北京聽力協(xié)會2017年公開數(shù)據(jù),估計中國殘疾性聽力障礙人士已達7200萬,相當于北京市常住人口(約2200萬,2015年數(shù)據(jù))的3倍多。盡管我國在信息無障礙領域的投入逐漸增加,但目前國內(nèi)的聽障人群需求依然得不到滿足。優(yōu)圖AI手語翻譯機的推出將一定程度地緩解聽障人士的交流障礙。
在演講中,賈佳亞表示,“未來,我們希望通過與聾啞人士或手語使用者的深入接觸,嘗試在公共事物場所為聽障者提供更好的服務,更好地助力信息無障礙的建設。”下一步,優(yōu)圖實驗室將對AI手語翻譯機展開優(yōu)化和升級,嘗試在日常服務窗口、手語教育等場景中落地,為聽障人士帶來實實在在的便利。
目前,優(yōu)圖實驗室已經(jīng)和深圳市信息無障礙研究會成立AI手語識別聯(lián)合項目組,就手語數(shù)據(jù)采集、產(chǎn)品算法優(yōu)化等方面展開長期深度合作,并通過與聽障者或手語使用者進一步接觸,擴充數(shù)據(jù)容量,完善數(shù)據(jù)規(guī)范,致力于推動后續(xù)的產(chǎn)品和服務部署,推動信息無障礙建設。
(優(yōu)圖和深圳信息無障礙研究會AI聽障無障礙聯(lián)合項目組)
此次的數(shù)字生態(tài)大會展示的優(yōu)圖AI手語翻譯機,并不是騰訊在信息無障礙建設上的首次嘗試。早在2009年騰訊便開始了信息無障礙方面的探索,截至目前,旗下QQ、QQ空間、微信、騰訊網(wǎng)、騰訊新聞、應用寶、企鵝FM等大部分產(chǎn)品已針對障礙用戶實現(xiàn)專門優(yōu)化,致力于為障礙人士構(gòu)建信息友好社會。2013年,騰訊優(yōu)圖團隊和手機QQ一起打磨了OCR引擎技術,基于計算機視覺算法及自然語言處理能力,可將圖片上的文字直接轉(zhuǎn)換為可編輯的結(jié)構(gòu)化文本,幫助視障群體實現(xiàn)信息溝通無障礙化。
與本次亮相數(shù)字生態(tài)大會AI分論壇的跨年齡人臉識別技術一樣,優(yōu)圖AI手語翻譯機同樣是騰訊踐行“科技向善”的重要體現(xiàn)。而優(yōu)圖實驗室也將繼續(xù)秉承“科技向善”這一理念,推動前沿技術在社會場景中的應用,切實讓更多的實際問題得以解決。做有溫度的AI,讓科技產(chǎn)生更大的社會價值。
申請創(chuàng)業(yè)報道,分享創(chuàng)業(yè)好點子。點擊此處,共同探討創(chuàng)業(yè)新機遇!
2023年7月6日,第六屆世界人工智能大會(WAIC2023)在上海開幕,“人工智能大模型”是本屆大會的備受矚目的話題,據(jù)悉,在昇騰AI大模型的創(chuàng)新研發(fā)中,華為聯(lián)手26家行業(yè)領軍企業(yè),組建了一支協(xié)同創(chuàng)新的“AI明星隊”,云天勵飛作為中國人工智能企業(yè)的杰出代表,和互聯(lián)網(wǎng)大廠、運營商、科研院所等優(yōu)秀團隊
這幾個月來,以ChatGPT為代表的生成式AI展現(xiàn)出的能力令世界驚嘆。自從2016年AlphaGo戰(zhàn)勝李世石掀起了一波AI浪潮后,AI仿佛已經(jīng)沉寂了很久,ChatGPT的橫空出世就如同一束耀眼的光芒,讓AI這個名詞重回C位。過去在AI1.0時代,主要通過訓練模型來實現(xiàn)圖像識別、聲音識別、語言處理等特
文:互聯(lián)網(wǎng)江湖作者:志剛2023年的IoT需要一個新故事。6月29日,涂鴉智能在開發(fā)者大會上,發(fā)布了企業(yè)級戰(zhàn)略PaaS2.0,希望通過一個平臺+四大開發(fā)服務,建立起IoT生態(tài)。對于這場發(fā)布會,市場的態(tài)度是積極的。美東時間6月29日收盤,涂鴉智能美股股價上漲5.6%,來到1.87美元/股。近日股價穩(wěn)定
美團曾經(jīng)的二號人物王慧文對標OpenAI的創(chuàng)業(yè)項目光年之外,以20億賣給美團,再度引發(fā)市場對大模型的熱議。
2020年底,王慧文在朋友圈寫下這句話時,外界本以為這位伴隨中國互聯(lián)網(wǎng)發(fā)展而持續(xù)創(chuàng)業(yè)20年的人物即將告別創(chuàng)業(yè)舞臺。但是,一個曾經(jīng)多次創(chuàng)業(yè),正值壯年的互聯(lián)網(wǎng)老將心中的創(chuàng)業(yè)熱情是難以熄滅的。
四個月前邀請碼炒至10萬元,如今官網(wǎng)變灰、社交賬號清空,這家AI新貴的閃電遷移折射中國科技企業(yè)出海潮涌。7月11日,打開Manus官網(wǎng)的用戶發(fā)現(xiàn)一則突兀提示:“Manus在你所在的地區(qū)不可用”。而就在不久前,這個位置還顯示著“Manus中文版本正在開發(fā)中”的樂觀聲明。同時,Manus官方微博和小紅書
文/十界來源/節(jié)點財經(jīng)一場圍繞算力自主的競賽,正在科創(chuàng)板上演。近日,國產(chǎn)全功能GPU廠商摩爾線程遞交科創(chuàng)板招股書,擬募資約80億人民幣,成為今年上半年科創(chuàng)板擬募資規(guī)模最大的沖刺者,也打響了“國產(chǎn)英偉達”上市的第一槍。據(jù)招股書顯示,摩爾線程自2020年成立以來,主營全功能GPU芯片的研發(fā)與銷售,以自主
“AI大模型六小虎”百川智能危機重重。這是前搜狗CEO王小川創(chuàng)辦的AI公司。昨天就爆出新聞,百川智能的聯(lián)合創(chuàng)始人離職,這是王小川入局AI的第一道大坎。接下的成敗非常關鍵:(1)拿下河北(2)學習科大訊飛百川智能離職高端概覽:(1)2025年7月10日,百川智能技術聯(lián)合創(chuàng)始人謝劍將離職。他是百川只能的
百度AI團隊今日正式推出PaddleOCR3.1版本,以突破性的多語言組合識別(MultilingualCompositionPerception,MCP)技術為核心,徹底重構(gòu)復雜文檔處理邊界。此次升級標志著OCR領域首次實現(xiàn)對同一文檔內(nèi)任意混合語言文本的精準識別,為全球化企業(yè)、跨境業(yè)務及多元文化場
“宇樹已形成硬件、算法、場景聯(lián)動的業(yè)務飛輪,自研率超95%的技術壁壘讓其成為全球機器人賽道不可忽視的中國力量?!笔壮藤Y本管理合伙人朱方文在追加投資時如是評價。7月7日,據(jù)每日經(jīng)濟新聞從宇樹科技投資方處獲悉,國內(nèi)人形機器人領軍企業(yè)宇樹科技(UnitreeRobotics)已明確計劃于科創(chuàng)板IPO,預計
推理與多模態(tài)的終極融合,將徹底終結(jié)用戶在不同模型間切換的煩惱。7月7日,OpenAI正式確認將在今年夏季推出新一代人工智能模型GPT-5。這一突破性產(chǎn)品將整合現(xiàn)有的多個強大模型,特別是融合專注推理能力的“O系列”與具備多模態(tài)功能的“GPT系列”,為用戶提供前所未有的統(tǒng)一體驗。OpenAI開發(fā)者體驗負
高考一結(jié)束,忙壞了海內(nèi)外一眾大模型。豆包、DeepSeek、ChatGPT、元寶、文心一言、通義千問……掀起了一波“AI趕考”大戰(zhàn)。據(jù)悉,去年高考期間,大模型的成績才勉強過一本線,今年集體晉升985。據(jù)悉,豆包甚至過了清北的錄取線。頭部大模型在高考“考場”上玩得不亦樂乎,中小AI創(chuàng)企的處境卻日益尷尬
文/二風來源/節(jié)點財經(jīng)每年高考成績放榜后,數(shù)千萬考生和家長將迎來另一場硬仗——填報志愿。今年,這一領域迎來了AI的全面介入,多家互聯(lián)網(wǎng)大廠和教育公司紛紛推出智能志愿填報產(chǎn)品,為考生提供院校和專業(yè)選擇建議。據(jù)艾媒咨詢數(shù)據(jù),2023年中國高考志愿填報市場付費規(guī)模約9.5億元,近九成考生愿意借助志愿填報服
蘋果還沒從WWDC25的“群嘲”中走出,又迎來了一次新的痛擊。據(jù)路透社報道,21日,蘋果公司遭到股東集體起訴,被指在信息披露中低估了將先進生成式AI整合進語音助手Siri所需的時間,導致iPhone銷量受影響、股價下滑,構(gòu)成證券欺詐。在這份訴訟中,庫克、首席財務官凱文·帕雷克及前首席財務官盧卡·馬埃
華為的盤古大模型終于推出新版本了。6月20日華為云計算CEO張平安宣布基于CloudMatrix384超節(jié)點的新一代昇騰AI云服務全面上線,盤古大模型5.5同步發(fā)布。不過,當前國內(nèi)的AI大模型競爭可謂是相當激烈,華為的盤古大模型在眾多大模型中并不是十分出眾。華為云此次重磅推出的盤古大模型5.5能否從