1. 創(chuàng)業(yè)頭條
  2. 前沿領(lǐng)域
  3. 人工智能
  4. 正文

搜狗-清華天工研究院提出ChoreoNet模型:讓數(shù)字人聞聲起舞

 2020-08-22 08:42  來(lái)源:A5專欄  我來(lái)投稿 撤稿糾錯(cuò)

  阿里云優(yōu)惠券 先領(lǐng)券再下單

近日,搜狗分身技術(shù)團(tuán)隊(duì)聯(lián)合清華大學(xué)天工智能計(jì)算研究院賈珈老師團(tuán)隊(duì)共同發(fā)表的數(shù)字人技術(shù)論文《ChoreoNet:基于舞蹈動(dòng)作單元的音樂(lè)-舞蹈合成框架》被2020國(guó)際頂級(jí)盛會(huì)ACM Multimedia錄用為長(zhǎng)文。

(截圖來(lái)源:ACM Multimedia官網(wǎng)https://2020.acmmm.org)

ACM Multimedia專注于推進(jìn)多種媒體的研究與應(yīng)用,涉及人工智能、計(jì)算視覺(jué)、數(shù)據(jù)科學(xué)、深度學(xué)習(xí)、人機(jī)交互等多個(gè)新興領(lǐng)域,是中國(guó)計(jì)算機(jī)學(xué)會(huì)推薦的多媒體領(lǐng)域唯一A類國(guó)際學(xué)術(shù)會(huì)議,被認(rèn)為是多媒體技術(shù)領(lǐng)域奧運(yùn)級(jí)別的盛會(huì)。雖然鼓勵(lì)來(lái)自全球的各類機(jī)構(gòu)分享、交流最新研究成果,但該會(huì)議論文接受率很低,只有對(duì)日常生活和技術(shù)突破具有巨大影響潛力的研究項(xiàng)目才會(huì)被通過(guò)。

“攻克難關(guān)”備受認(rèn)可

音樂(lè)和舞蹈是與人們生活密不可分且高度相關(guān)的兩種藝術(shù)形式,近年來(lái),“樂(lè)舞合成”也是業(yè)內(nèi)高度關(guān)注的領(lǐng)域。不過(guò),早期合成基于相似度檢索進(jìn)行,合成結(jié)果的多樣性有限,而目前通行的方法是利用神經(jīng)網(wǎng)絡(luò)模型,將音樂(lè)特征映射到人體骨骼關(guān)鍵點(diǎn),但由于人類骨架關(guān)鍵點(diǎn)的高度冗余和帶噪特性,逐幀關(guān)鍵點(diǎn)預(yù)測(cè)非常困難,導(dǎo)致合成質(zhì)量有限,成為困擾業(yè)內(nèi)人士的一大“難關(guān)”。

搜狗分身技術(shù)團(tuán)隊(duì)與清華天工研究院賈珈老師團(tuán)隊(duì)在論文中提出了一個(gè)極具創(chuàng)造性的解決方案,該方案將人類編舞知識(shí)融合到樂(lè)舞合成框架中,設(shè)計(jì)多個(gè)舞蹈單元(CAU),并使用CAU序列預(yù)測(cè)模型,開發(fā)了一個(gè)像人類一樣根據(jù)音樂(lè)編排舞蹈動(dòng)作的舞蹈合成框架——ChoreoNet。通過(guò)實(shí)驗(yàn)驗(yàn)證和數(shù)據(jù)對(duì)比,相較于基線法,ChoreoNet性能更好,合成動(dòng)作也更加自然逼真,無(wú)論是音樂(lè)匹配度、動(dòng)作自然度還是其他方面,表現(xiàn)都更加優(yōu)秀。

(截圖來(lái)源:ChoreoNet論文)

此次,該論文被ACM Multimedia認(rèn)可并錄取為長(zhǎng)文,不僅代表了搜狗AI分身技術(shù)在身體動(dòng)作及姿態(tài)生成方面的突破,也從側(cè)面印證了搜狗強(qiáng)大的AI技術(shù)實(shí)力和能夠?qū)崿F(xiàn)持續(xù)輸出的創(chuàng)新能力。值得注意的是,搜狗是在業(yè)內(nèi)率先選擇通過(guò)音頻來(lái)驅(qū)動(dòng)身體動(dòng)作作為研究課題的先行者。

“死磕技術(shù)”引領(lǐng)方向

在搜狗的AI戰(zhàn)略版圖中,“自然交互+知識(shí)計(jì)算”是核心方向,技術(shù)研究和推動(dòng)技術(shù)向產(chǎn)品的快速轉(zhuǎn)化均以此為基礎(chǔ)和方向,而搜狗“分身”是其中關(guān)鍵和重要一環(huán)。

在2018年發(fā)布全球首個(gè)AI合成主播之后,搜狗分身持續(xù)研究并打造更加逼真自然的數(shù)字人能力,在2D/3D數(shù)字人領(lǐng)域構(gòu)建了音畫同步、逼真的面部表情唇動(dòng)生成及驅(qū)動(dòng)能力。此外,如何能夠讓數(shù)字人更加自然并且富有表現(xiàn)力也是搜狗分身的重點(diǎn)研究方向,其中身體動(dòng)作以及姿態(tài)的表達(dá)至關(guān)重要。搜狗在首代AI合成主播問(wèn)世后不到3個(gè)月的時(shí)間,便成功推出與“坐播”截然不同的“站播”合成主播,今年5月推出的3D AI合成主播不止面部細(xì)節(jié)經(jīng)得起高清鏡頭考驗(yàn),更是實(shí)現(xiàn)了自如行走。本次與清華大學(xué)天工智能計(jì)算研究院的工作選擇了音樂(lè)場(chǎng)景,重點(diǎn)研究如何提升身體動(dòng)作生成及驅(qū)動(dòng)的表現(xiàn)力和自然度,為AI數(shù)字人的技術(shù)探索開啟了新方向。

“未來(lái)應(yīng)用”前景廣闊

人工智能是未來(lái)科技的風(fēng)向標(biāo),而5G時(shí)代的到來(lái)又大大加速了這一進(jìn)程。自2018年搜狗推出全球首個(gè)AI合成主播之后,能夠與普通人的生活深度交融并廣泛運(yùn)用于各行各業(yè)的“AI分身”便深受關(guān)注,不少科技企業(yè)躬身入局。

從上文可以看出,搜狗從未停下突破的步伐,從2D到3D、“坐播”到“站播”、從支持單一語(yǔ)種到支持多語(yǔ)種、再到支持互動(dòng)。目前搜狗分身技術(shù)已經(jīng)在司法、傳媒、會(huì)展、藝術(shù)、金融客服等多個(gè)場(chǎng)地落地,為新華社、央視、平安惠普、北京互聯(lián)網(wǎng)法院等打造了多個(gè)AI合成主播、AI合成客服、AI虛擬法官等,也創(chuàng)造了雅妮、新小微、新小浩、新小萌等多個(gè)經(jīng)典AI數(shù)字人形象。

由音頻驅(qū)動(dòng)的數(shù)字人或數(shù)字舞蹈演員,擁有巨大的想象空間和市場(chǎng)化應(yīng)用前景。特別是與搜狗現(xiàn)有3D數(shù)字人的技術(shù)相結(jié)合后,使用場(chǎng)景可以從目前集中的傳媒、金融、法律等領(lǐng)域向影視、娛樂(lè)領(lǐng)域進(jìn)軍,攪動(dòng)萬(wàn)億規(guī)模的市場(chǎng)。

AI為人賦能,這是搜狗人工智能的發(fā)展理念,也是搜狗分身技術(shù)的愿景。作為一項(xiàng)既能解決行業(yè)痛點(diǎn),又能為用戶創(chuàng)造價(jià)值,既能給社會(huì)帶來(lái)變革、又能對(duì)科技產(chǎn)生影響,同時(shí)還能持續(xù)突破和進(jìn)步的前沿技術(shù),搜狗分身的未來(lái),無(wú)疑具備更多的可能性、極大的想象空間。

申請(qǐng)創(chuàng)業(yè)報(bào)道,分享創(chuàng)業(yè)好點(diǎn)子。點(diǎn)擊此處,共同探討創(chuàng)業(yè)新機(jī)遇!

相關(guān)標(biāo)簽
人工智能
ai技術(shù)

相關(guān)文章

  • IoT開發(fā)者為王,涂鴉智能硬核“靠邊站”

    IoT盛宴:涂鴉向下,產(chǎn)品向上

    標(biāo)簽:
    人工智能
  • IPO觀察丨黑芝麻智能遞表港交所,車芯行業(yè)已邁向量產(chǎn)決戰(zhàn)期?

    雖然我國(guó)汽車芯片行業(yè)還處在發(fā)展初期,但已經(jīng)迸發(fā)出無(wú)限潛力。一方面,智能汽車的發(fā)展不斷帶動(dòng)需求增長(zhǎng);另一方面,政策引導(dǎo)下,汽車芯片企業(yè)持續(xù)搶占高地。對(duì)此,在7月5日-7日舉辦的2023年中國(guó)汽車論壇上,中國(guó)汽車工業(yè)協(xié)會(huì)副秘書長(zhǎng)李邵華就做出表示,“中國(guó)將成為未來(lái)汽車芯片發(fā)展的集聚地”。車規(guī)芯片行業(yè)近日的

    標(biāo)簽:
    人工智能
  • 匯聚中國(guó)AI頂尖力量 云天勵(lì)飛參與華為AI大模型聯(lián)合創(chuàng)新

    2023年7月6日,第六屆世界人工智能大會(huì)(WAIC2023)在上海開幕,“人工智能大模型”是本屆大會(huì)的備受矚目的話題,據(jù)悉,在昇騰AI大模型的創(chuàng)新研發(fā)中,華為聯(lián)手26家行業(yè)領(lǐng)軍企業(yè),組建了一支協(xié)同創(chuàng)新的“AI明星隊(duì)”,云天勵(lì)飛作為中國(guó)人工智能企業(yè)的杰出代表,和互聯(lián)網(wǎng)大廠、運(yùn)營(yíng)商、科研院所等優(yōu)秀團(tuán)隊(duì)

    標(biāo)簽:
    ai技術(shù)
  • 用友大易:邁入AI招聘2.0時(shí)代,讓人力資源回歸本質(zhì)

    這幾個(gè)月來(lái),以ChatGPT為代表的生成式AI展現(xiàn)出的能力令世界驚嘆。自從2016年AlphaGo戰(zhàn)勝李世石掀起了一波AI浪潮后,AI仿佛已經(jīng)沉寂了很久,ChatGPT的橫空出世就如同一束耀眼的光芒,讓AI這個(gè)名詞重回C位。過(guò)去在AI1.0時(shí)代,主要通過(guò)訓(xùn)練模型來(lái)實(shí)現(xiàn)圖像識(shí)別、聲音識(shí)別、語(yǔ)言處理等特

    標(biāo)簽:
    ai技術(shù)
  • 新發(fā)布的PaaS2.0,能否助力涂鴉智能再起飛?

    文:互聯(lián)網(wǎng)江湖作者:志剛2023年的IoT需要一個(gè)新故事。6月29日,涂鴉智能在開發(fā)者大會(huì)上,發(fā)布了企業(yè)級(jí)戰(zhàn)略PaaS2.0,希望通過(guò)一個(gè)平臺(tái)+四大開發(fā)服務(wù),建立起IoT生態(tài)。對(duì)于這場(chǎng)發(fā)布會(huì),市場(chǎng)的態(tài)度是積極的。美東時(shí)間6月29日收盤,涂鴉智能美股股價(jià)上漲5.6%,來(lái)到1.87美元/股。近日股價(jià)穩(wěn)定

    標(biāo)簽:
    ai技術(shù)
  • 全球AI巨頭正在賭:誰(shuí)搞定MCP,誰(shuí)就是未來(lái)老大

    我不是危言聳聽,現(xiàn)在全球的AI巨頭都在做MCP,毫不夸張的說(shuō):誰(shuí)能把MCP做起來(lái),誰(shuí)就擁有AI生態(tài)控制權(quán),誰(shuí)就是AI圈的老大。你們有沒(méi)有發(fā)現(xiàn),MCP在2025年初開始特別火爆,互聯(lián)網(wǎng)技術(shù)大廠都在強(qiáng)推MCP。(1)阿里云百煉搞了個(gè)MCP平臺(tái),提供50+預(yù)置MCP服務(wù)。不過(guò)大都只面向阿里系產(chǎn)品。(2)騰

    標(biāo)簽:
    ai智能
  • 對(duì)話李軍:人工智能是“第五范式革命”

    2025國(guó)際人工智能程序設(shè)計(jì)精英挑戰(zhàn)賽(IAEPC)在香港中文大學(xué)成功舉辦。作為主辦方之一,歐美同學(xué)基金會(huì)理事長(zhǎng)李軍接受了大賽主持人艾誠(chéng)采訪。在采訪中,李軍認(rèn)為IAEPC不僅是一場(chǎng)“冠軍中的冠軍”對(duì)決,更是一次全球AI人才的線下交流盛會(huì)。大賽“史無(wú)前例”的吸引了全球青年科技精英匯聚香港,更加推動(dòng)和普

  • 對(duì)話施韓原與杜瑜皓:與參賽選手一起改變世界

    2025國(guó)際人工智能程序設(shè)計(jì)精英挑戰(zhàn)賽(IAEPC)在香港中文大學(xué)成功舉辦。作為大賽發(fā)起人方之一及裁判委員會(huì)負(fù)責(zé)人,施韓原與杜瑜皓接受了大賽主持人艾誠(chéng)采訪。裁判委員會(huì)主席施韓原分享了此次大賽的亮點(diǎn),IAEPC首次引入創(chuàng)新賽道,探索選手如何與AI合作進(jìn)行答題。裁判委員會(huì)副主席杜瑜皓認(rèn)為,選手最終目標(biāo)并

  • 吳林林專訪IAEPC冠軍:與全球參賽者交流是最重要的一課

    2025國(guó)際人工智能程序設(shè)計(jì)精英挑戰(zhàn)賽(IAEPC)在香港中文大學(xué)成功舉辦。來(lái)自深圳的學(xué)生吳林林作為主辦方記者團(tuán)成員,采訪了大賽冠軍選手之一。在吳林林的采訪中,選手認(rèn)為與來(lái)自全球的參賽者交流是自己學(xué)到的最重要的一課。在科技與AI之前,選手們可以平等、開放、友好的交流。以下是采訪實(shí)錄(有刪節(jié)):吳林林

  • 吳林林專訪黃錦輝:年輕人要像懂中文一樣懂A

    2025國(guó)際人工智能程序設(shè)計(jì)精英挑戰(zhàn)賽(IAEPC)在香港中文大學(xué)成功舉辦。來(lái)自深圳的學(xué)生吳林林作為主辦方記者團(tuán)成員,采訪了大會(huì)嘉賓:全國(guó)政協(xié)委員、香港特別行政區(qū)立法會(huì)議員、香港中文大學(xué)工程學(xué)院副院長(zhǎng)、IAEPC聯(lián)合發(fā)起人黃錦輝先生。在吳林林的采訪中,黃錦輝教授勉勵(lì)年輕人要像懂中文和英語(yǔ)一樣懂AI,

  • 本以為DeepSeek天下無(wú)敵了,沒(méi)想到Manus更猛

    昨天新出了一個(gè)AI,據(jù)說(shuō)比DeepSeek還牛,而截止到今早,已經(jīng)有10萬(wàn)人在排隊(duì)申請(qǐng)Manus邀請(qǐng)碼了,而且它邀請(qǐng)碼已經(jīng)炒到10萬(wàn)了。這是北京的一家人工智能公司蝴蝶科技,創(chuàng)始人是一名來(lái)自華中科技大學(xué)的90后畢業(yè)生肖弘,突然向全球宣布:世界上第一款真正的人工智能、通用智能體產(chǎn)品出現(xiàn)了,名叫Manus

    標(biāo)簽:
    ai智能

編輯推薦