1. 創(chuàng)業(yè)頭條
  2. 前沿領(lǐng)域
  3. 人工智能
  4. 正文

搜狗推“個(gè)性化語音識(shí)別”,將顛覆與改變未來人機(jī)交互模式

 2019-08-15 18:08  來源:A5專欄  我來投稿 撤稿糾錯(cuò)

  阿里云優(yōu)惠券 先領(lǐng)券再下單

專業(yè)機(jī)構(gòu)發(fā)布《2019年語音技術(shù)》報(bào)告稱,語音將成為未來十年決定性主題之一,與人工智能一起從根本上改變?nèi)伺c機(jī)器的關(guān)系。近日,搜狗輸入法在語音輸入領(lǐng)域率先推出“個(gè)性化語音識(shí)別”功能,突破語音識(shí)別技術(shù)瓶頸,大幅優(yōu)化個(gè)人詞匯錄入的直接準(zhǔn)確性,在語音輸入領(lǐng)域?qū)崿F(xiàn)“更懂用戶”。

搜狗“個(gè)性化語音識(shí)別”打造用戶專屬輸入法

在日常交流中,個(gè)人口頭禪、慣用語經(jīng)常會(huì)干擾雙方的信息傳達(dá),這一問題在人機(jī)語音交互中尤為凸顯。在語音輸入時(shí),往往用戶只是想錄入一個(gè)名稱,輸入結(jié)果卻顯示的是音同意不同的另一項(xiàng)結(jié)果。比如,當(dāng)用戶希望輸入法顯示人名“憑遠(yuǎn)”時(shí),通用的語音識(shí)別往往將大眾常用的“平原、品源”列在前列的候選詞匯,用戶的個(gè)性化內(nèi)容并不在其中。除此之外,用戶習(xí)慣使用的個(gè)人詞匯,以及一些多音字、讀音差錯(cuò)也會(huì)對(duì)語音識(shí)別結(jié)果造成影響。

基于以上原因,搜狗語音率先對(duì)語音識(shí)別技術(shù)進(jìn)行了革新優(yōu)化,推出“個(gè)性化語音識(shí)別”服務(wù)。經(jīng)過本輪更新,用戶只需在搜狗輸入法App選擇一鍵登錄個(gè)人賬戶,即可體驗(yàn)此項(xiàng)服務(wù)。成功開啟后,“個(gè)性化語音識(shí)別”會(huì)通過強(qiáng)化學(xué)習(xí)用戶習(xí)慣使用的個(gè)人詞匯,為每個(gè)用戶建立定制化語音輸入法。此后,在用戶需要進(jìn)行語音輸入時(shí),輸入法會(huì)根據(jù)語言環(huán)境,結(jié)合上下段落語句進(jìn)行分析,快速輸出符合用戶心意的文本內(nèi)容,有效減少用戶手動(dòng)進(jìn)行二次更改的頻率。

搜狗語音又誕生“黑科技”語音識(shí)別更精準(zhǔn)

搜狗“個(gè)性化語音識(shí)別”不僅可有效提升用戶個(gè)性化詞句的識(shí)別準(zhǔn)確率,同時(shí)全自動(dòng)詞庫(kù)學(xué)習(xí)這一特色極大保證了系統(tǒng)的處理及反饋速度,實(shí)現(xiàn)整個(gè)學(xué)習(xí)個(gè)性化特征的過程在“毫秒級(jí)別”就可以全部自動(dòng)完成。

通過DTSS(Deep Transformer-based Sequence to Sequence model)的端到端聲學(xué)模型、神經(jīng)網(wǎng)絡(luò)語言模型和智能標(biāo)點(diǎn)預(yù)測(cè)等技術(shù),搜狗輸入法引入前沿深度學(xué)習(xí)技術(shù),對(duì)語音識(shí)別進(jìn)行仿真模擬和訓(xùn)練,有效提高語音錄入在通用場(chǎng)景下的識(shí)別準(zhǔn)確性,精準(zhǔn)度已達(dá)到領(lǐng)先業(yè)內(nèi)。“個(gè)性化語音識(shí)別”可基于用戶數(shù)據(jù)分析,對(duì)用戶習(xí)慣使用的個(gè)性化詞組進(jìn)行掃描記錄,在語音輸入時(shí),優(yōu)先選擇用戶習(xí)慣用語進(jìn)行文本輸出。通過此項(xiàng)技術(shù)革新,在保障通用識(shí)別準(zhǔn)確性的前提下,使用戶常用語的字詞錯(cuò)誤率下降40%,攻克語音識(shí)別精準(zhǔn)化的技術(shù)難關(guān)。

掌控AI從個(gè)性化語音識(shí)別開始

手和舌頭是人類最靈活的兩個(gè)部分,從移動(dòng)智能設(shè)備發(fā)展以來,各種觸控交互無不依賴于手的操作。而當(dāng)語音技術(shù)和人工智能同時(shí)走向成熟時(shí),或許就像《2019語音技術(shù)報(bào)告》中所描述的那樣:語音交互扭轉(zhuǎn)了以往人機(jī)交互的存在形態(tài),用戶與設(shè)備間基于語音交互的全新關(guān)系開始搭建,與之前互聯(lián)網(wǎng)向移動(dòng)互聯(lián)網(wǎng)過渡一樣,其對(duì)底層平臺(tái)的全新需求也在醞釀當(dāng)中。

新時(shí)代即將來臨,為應(yīng)對(duì)人工智能、虛擬現(xiàn)實(shí)等技術(shù)的革新以及不同維度、多場(chǎng)景使用的需要,用戶輸入法的使用習(xí)慣逐漸向語音輸入轉(zhuǎn)移。同時(shí),與文本輸入相比,語音輸入注定成為最主要的人機(jī)互動(dòng)接口。優(yōu)化語音識(shí)別技術(shù),為用戶提供更自然、更便利、更高效的語音錄入服務(wù),是智慧輸入法的發(fā)展趨勢(shì)。

隨著語音識(shí)別技術(shù)的不斷成熟,以及用戶個(gè)性化詞庫(kù)的不斷豐富,搜狗將聚合用戶級(jí)語音個(gè)性化資源,實(shí)現(xiàn)“定制化語音輸入法”。使每個(gè)用戶基于“定制版”、“更懂自己”的搜狗語音識(shí)別的支持,在日常生活以及醫(yī)療、法律等專業(yè)領(lǐng)域,有效提高線上交流和人機(jī)溝通的效率及準(zhǔn)確度,或?qū)⒊蔀槿斯ぶ悄軙r(shí)代輸入端的全局掌控者。

申請(qǐng)創(chuàng)業(yè)報(bào)道,分享創(chuàng)業(yè)好點(diǎn)子。點(diǎn)擊此處,共同探討創(chuàng)業(yè)新機(jī)遇!

相關(guān)標(biāo)簽
ai技術(shù)
智能語音
搜狗輸入法

相關(guān)文章

  • 匯聚中國(guó)AI頂尖力量 云天勵(lì)飛參與華為AI大模型聯(lián)合創(chuàng)新

    2023年7月6日,第六屆世界人工智能大會(huì)(WAIC2023)在上海開幕,“人工智能大模型”是本屆大會(huì)的備受矚目的話題,據(jù)悉,在昇騰AI大模型的創(chuàng)新研發(fā)中,華為聯(lián)手26家行業(yè)領(lǐng)軍企業(yè),組建了一支協(xié)同創(chuàng)新的“AI明星隊(duì)”,云天勵(lì)飛作為中國(guó)人工智能企業(yè)的杰出代表,和互聯(lián)網(wǎng)大廠、運(yùn)營(yíng)商、科研院所等優(yōu)秀團(tuán)隊(duì)

    標(biāo)簽:
    ai技術(shù)
  • 用友大易:邁入AI招聘2.0時(shí)代,讓人力資源回歸本質(zhì)

    這幾個(gè)月來,以ChatGPT為代表的生成式AI展現(xiàn)出的能力令世界驚嘆。自從2016年AlphaGo戰(zhàn)勝李世石掀起了一波AI浪潮后,AI仿佛已經(jīng)沉寂了很久,ChatGPT的橫空出世就如同一束耀眼的光芒,讓AI這個(gè)名詞重回C位。過去在AI1.0時(shí)代,主要通過訓(xùn)練模型來實(shí)現(xiàn)圖像識(shí)別、聲音識(shí)別、語言處理等特

    標(biāo)簽:
    ai技術(shù)
  • 新發(fā)布的PaaS2.0,能否助力涂鴉智能再起飛?

    文:互聯(lián)網(wǎng)江湖作者:志剛2023年的IoT需要一個(gè)新故事。6月29日,涂鴉智能在開發(fā)者大會(huì)上,發(fā)布了企業(yè)級(jí)戰(zhàn)略PaaS2.0,希望通過一個(gè)平臺(tái)+四大開發(fā)服務(wù),建立起IoT生態(tài)。對(duì)于這場(chǎng)發(fā)布會(huì),市場(chǎng)的態(tài)度是積極的。美東時(shí)間6月29日收盤,涂鴉智能美股股價(jià)上漲5.6%,來到1.87美元/股。近日股價(jià)穩(wěn)定

    標(biāo)簽:
    ai技術(shù)
  • 大模型難掩AI制藥的悲傷:越過山丘,無人等候

    美團(tuán)曾經(jīng)的二號(hào)人物王慧文對(duì)標(biāo)OpenAI的創(chuàng)業(yè)項(xiàng)目光年之外,以20億賣給美團(tuán),再度引發(fā)市場(chǎng)對(duì)大模型的熱議。

    標(biāo)簽:
    ai技術(shù)
  • 拾起王慧文的AI夢(mèng),美團(tuán)沖向“光年之外”?

    2020年底,王慧文在朋友圈寫下這句話時(shí),外界本以為這位伴隨中國(guó)互聯(lián)網(wǎng)發(fā)展而持續(xù)創(chuàng)業(yè)20年的人物即將告別創(chuàng)業(yè)舞臺(tái)。但是,一個(gè)曾經(jīng)多次創(chuàng)業(yè),正值壯年的互聯(lián)網(wǎng)老將心中的創(chuàng)業(yè)熱情是難以熄滅的。

    標(biāo)簽:
    ai技術(shù)
  • Figma股價(jià)熱情僅存1天,AI焦慮成關(guān)鍵隱憂?

    文/道哥美國(guó)設(shè)計(jì)軟件公司Figma近期在紐約證券交易所掛牌上市,首日即上演“狂飆”行情——發(fā)行價(jià)定每股33美元,開盤報(bào)價(jià)85美元,較發(fā)行價(jià)翻倍。首日收?qǐng)?bào)115.50美元,較發(fā)行價(jià)大漲約250%,市值飆升至近670億美元,創(chuàng)下近30年來同等規(guī)模美股IPO的最大單日漲幅紀(jì)錄。然而,隨著短線資金獲利了結(jié),

    標(biāo)簽:
    ai智能
  • 人類首屆機(jī)器人運(yùn)動(dòng)會(huì):跑歪了+撞人了+打哆嗦,但我卻看到了中國(guó)智造的未來

    8月16日,盧松松非常榮幸的成為了一名《2025世界人形機(jī)器人運(yùn)動(dòng)會(huì)》的觀眾。這是一場(chǎng)超酷的機(jī)器人運(yùn)動(dòng)會(huì),也是人類給機(jī)器人辦的第一屆奧運(yùn)會(huì),來自16個(gè)國(guó)家的280支隊(duì)伍會(huì)參加500多個(gè)比賽項(xiàng)目??戳艘惶斓谋荣?,晚上就回來寫文章,編輯短視頻。先說感悟:(1)這是人類首次給機(jī)器人辦的第一屆運(yùn)動(dòng)會(huì),史無前

    標(biāo)簽:
    智能機(jī)器人
  • AI「帶飛」騰訊業(yè)績(jī)

    文/一燈來源/節(jié)點(diǎn)財(cái)經(jīng)在當(dāng)前無人敢缺席的AI軍備競(jìng)賽中,巨頭們一面為巨額的資本支出焦慮,一面又向市場(chǎng)勾勒著未來的宏偉藍(lán)圖。在各家動(dòng)輒千億級(jí)投入的背景下,市場(chǎng)迫切需要一份關(guān)于AI回報(bào)價(jià)值的有力證明。而騰訊,率先給出了答卷。8月13日,騰訊控股發(fā)布2025年第二季度財(cái)報(bào)。盡管資本開支同比劇增119%,達(dá)

    標(biāo)簽:
    ai智能
    騰訊
  • Meta用億元薪酬發(fā)起「人才狙擊」能否買來一個(gè)AI未來?

    文/二風(fēng)來源/節(jié)點(diǎn)財(cái)經(jīng)2025年的硅谷,一場(chǎng)沒有硝煙的戰(zhàn)爭(zhēng)正以前所未有的烈度上演。這場(chǎng)戰(zhàn)爭(zhēng)的核心武器不是代碼或芯片,而是人——那些全球僅有數(shù)千名、能夠構(gòu)建未來人工智能基礎(chǔ)模型的頂尖大腦。在這場(chǎng)激烈的人才爭(zhēng)奪戰(zhàn)中,Meta及其首席執(zhí)行官馬克·扎克伯格(MarkZuckerberg)正扮演著最具侵略性的

    標(biāo)簽:
    ai智能
  • 騰訊AI夢(mèng):克制的雄心

    關(guān)乎14億用戶的深刻變化

    標(biāo)簽:
    ai智能
  • 阿里媽媽、巨量引擎、騰訊廣告,誰是當(dāng)代“AI印鈔機(jī)”?

    阿里媽媽、巨量引擎、騰訊廣告,誰是當(dāng)代“AI印鈔機(jī)”?

熱門排行

編輯推薦