1. 創(chuàng)業(yè)頭條
  2. 前沿領(lǐng)域
  3. AI智能
  4. 正文

搜狗擊敗訊飛阿里,獲IWSLT國(guó)際口語(yǔ)機(jī)器翻譯評(píng)測(cè)大賽冠軍

 2018-10-31 10:40  來(lái)源:互聯(lián)網(wǎng)  我來(lái)投稿 撤稿糾錯(cuò)

  一鍵部署OpenClaw

近日,在剛剛落幕的IWSLT(International Workshop on Spoken Language Translation)國(guó)際頂級(jí)口語(yǔ)機(jī)器翻譯評(píng)測(cè)大賽上,搜狗擊敗訊飛、阿里巴巴, APPTEK(美國(guó)應(yīng)用科技公司)、AFRL(美國(guó)空軍研究實(shí)驗(yàn)室)以及KIT(德國(guó)卡爾斯魯厄理工學(xué)院)等國(guó)際國(guó)內(nèi)多個(gè)強(qiáng)勁對(duì)手,一舉奪得了2018年IWSLT大賽Baseline Model(基線模型)賽道冠軍,代表中國(guó)向世界彰顯了AI領(lǐng)域的技術(shù)硬實(shí)力!

表1 IWSLT大賽Baseline Model賽道最終結(jié)果

--取自IWSLT官方公布結(jié):https://workshop2018.iwslt.org/downloads/Proceedings_IWSLT_2018.pdf

這是搜狗繼WMT 2017機(jī)器翻譯頂級(jí)評(píng)測(cè)大賽奪冠之后,所摘得的又一翻譯領(lǐng)域的技術(shù)桂冠。短期內(nèi)連續(xù)登頂世界第一的位置,充分證明了搜狗在翻譯行業(yè)特別是口語(yǔ)翻譯領(lǐng)域已位居領(lǐng)先地位。

IWSLT是什么比賽?

IWSLT是國(guó)際最具影響力的口語(yǔ)機(jī)器翻譯評(píng)測(cè)比賽,從2004年開(kāi)始已經(jīng)舉辦了15屆。每屆比賽都吸引了世界各地機(jī)器翻譯領(lǐng)域的知名企業(yè)和研究機(jī)構(gòu)參與,本屆比賽吸引了訊飛、阿里巴巴等國(guó)內(nèi)公司,愛(ài)爾蘭ADAPT中心,美國(guó)約翰霍普金斯大學(xué),德國(guó)卡爾斯魯厄理工學(xué)院,芬蘭赫爾辛基大學(xué),英國(guó)愛(ài)丁堡大學(xué),美國(guó)AppTek公司等多家國(guó)際知名大學(xué)、研究機(jī)構(gòu)和公司參加。

表2 IWSLT2018大賽參賽情況

--取自IWSLT官方公布結(jié)果:

:https://workshop2018.iwslt.org/downloads/Proceedings_IWSLT_2018.pdf

本屆IWSLT 2018的口語(yǔ)機(jī)器翻譯任務(wù)主要評(píng)測(cè)基于指定數(shù)據(jù)集從英語(yǔ)到德語(yǔ)的語(yǔ)音翻譯能力,共分為Baseline Model(基線模型賽道)和End-to-End(端到端賽道)兩個(gè)賽道,其中Baseline Model賽道主要評(píng)測(cè)語(yǔ)音翻譯的流水線方案,輸入語(yǔ)音先通過(guò)語(yǔ)音識(shí)別系統(tǒng)得到語(yǔ)音識(shí)別結(jié)果,之后將結(jié)果送入機(jī)器翻譯系統(tǒng)獲得譯文,這也是業(yè)內(nèi)最主流、效果最好的語(yǔ)音翻譯解決方案,市場(chǎng)上商用機(jī)器同傳、翻譯機(jī)等語(yǔ)音翻譯類產(chǎn)品幾乎都采用了類似的方法;End-to-End則是本次評(píng)測(cè)新增設(shè)的賽道,主要鼓勵(lì)參賽方探索基于神經(jīng)網(wǎng)絡(luò)的端到端語(yǔ)音翻譯解決方案,希望能夠輸入語(yǔ)音,基于深度神經(jīng)網(wǎng)絡(luò)模型直接輸出譯文,這種方法目前仍處于早期研究階段,受制于語(yǔ)音-文本平行語(yǔ)料難以大規(guī)模采集、算法研究不成熟等因素的限制,距離商用仍存在較大距離。本次評(píng)測(cè)中,在訓(xùn)練集、測(cè)試集相同的情況下,Baseline Model賽道最好的系統(tǒng)取得了28.09的BLEU(機(jī)器翻譯質(zhì)量評(píng)價(jià)指標(biāo),值越大代表翻譯質(zhì)量越好),而End-to-End賽道最好的系統(tǒng)僅取得了19.4的BLEU,較Baseline Model賽道相差8.69個(gè)BLEU,差距非常明顯,也證明了Baseline Model賽道評(píng)測(cè)的算法仍是目前最可行和實(shí)用的解決方案。

搜狗本次參加的是Baseline Model賽道的評(píng)測(cè),并取得了第一名的好成績(jī)。評(píng)測(cè)任務(wù)面向TED演講和大會(huì)學(xué)術(shù)報(bào)告場(chǎng)景,測(cè)試集包括來(lái)自英國(guó)、歐洲、印度等各個(gè)國(guó)家的英語(yǔ)演講者,存在噪聲、口音、自由表達(dá)等復(fù)雜語(yǔ)音現(xiàn)象,同時(shí)語(yǔ)言中存在大量領(lǐng)域?qū)S忻~和口語(yǔ)化的表達(dá)(如:大量語(yǔ)氣詞、錯(cuò)誤語(yǔ)法表達(dá)等),具有極強(qiáng)的實(shí)戰(zhàn)意義和挑戰(zhàn)性。最終,搜狗提交的系統(tǒng)BLEU值達(dá)到28.09,領(lǐng)先排名第二的科大訊飛1.6個(gè)BLEU,證明了搜狗在口語(yǔ)機(jī)器翻譯領(lǐng)域強(qiáng)大的實(shí)力。

AI賽道中持續(xù)發(fā)力,搜狗領(lǐng)跑語(yǔ)音翻譯行業(yè)

搜狗的AI戰(zhàn)略藍(lán)圖之中,語(yǔ)言是最核心的重頭戲。一直以來(lái),搜狗都堅(jiān)持著“自然交互+知識(shí)計(jì)算”的人工智能核心方向,并持續(xù)深耕技術(shù),推動(dòng)技術(shù)向產(chǎn)品的快速轉(zhuǎn)化,2016年,搜狗發(fā)布了自有人機(jī)交互解決方案-知音引擎。擁有充足真實(shí)語(yǔ)料數(shù)據(jù)優(yōu)勢(shì)的搜狗,將語(yǔ)音識(shí)別與機(jī)器翻譯技術(shù)相結(jié)合,并在2016年推出了全球首款商用AI同傳系統(tǒng)-搜狗同傳,引領(lǐng)了語(yǔ)音翻譯技術(shù)的普及與應(yīng)用。通過(guò)數(shù)百場(chǎng)的國(guó)際會(huì)議“實(shí)戰(zhàn)”,搜狗同傳獲得了無(wú)數(shù)媒體和觀眾的好評(píng),成為當(dāng)下炙手可熱的“AI字幕君”。

與此同時(shí),搜狗也推出了一系列的智能硬件,將語(yǔ)音翻譯技術(shù)應(yīng)用到了更廣闊的場(chǎng)景之中,幫助用戶打破了跨國(guó)交流時(shí)的語(yǔ)言困境。2018年3月,搜狗推出了搜狗旅行翻譯寶,具備離線翻譯功能與拍照翻譯功能,讓馬化騰都為之心動(dòng),在朋友圈里大打廣告。作為首款智能翻譯硬件,它支持42種語(yǔ)言對(duì)話翻譯,解決了旅游場(chǎng)景中用戶聽(tīng)不懂、看不懂、不會(huì)說(shuō)等真實(shí)痛點(diǎn)。該項(xiàng)產(chǎn)品在京東平臺(tái)首發(fā)當(dāng)日即告售罄,首日銷售額破千萬(wàn)。與此同時(shí),搜狗還推出了錄音翻譯筆,提供錄音轉(zhuǎn)寫、對(duì)話翻譯、同聲傳譯等功能,把AI同傳落地到了消費(fèi)級(jí)產(chǎn)品之中,開(kāi)拓了語(yǔ)音翻譯的新航道。

眾所周知,人工智能是未來(lái)科技的風(fēng)向標(biāo)。通過(guò)這次在IWSLT比賽中的優(yōu)秀成績(jī),可以看到以搜狗為代表的國(guó)產(chǎn)科技巨頭企業(yè),已表現(xiàn)出了引領(lǐng)行業(yè)的技術(shù)硬實(shí)力。

申請(qǐng)創(chuàng)業(yè)報(bào)道,分享創(chuàng)業(yè)好點(diǎn)子。點(diǎn)擊此處,共同探討創(chuàng)業(yè)新機(jī)遇!

相關(guān)標(biāo)簽
搜狗翻譯
ai技術(shù)

相關(guān)文章

  • 甌江論道:AI賦能綠色發(fā)展

    2025年10月25日,2025世界青年科學(xué)家峰會(huì)之人工智能(AI)融合創(chuàng)新發(fā)展論壇在浙江溫州成功舉辦。本次論壇由國(guó)際院士科創(chuàng)中心主辦,中國(guó)投資協(xié)會(huì)能源投資專業(yè)委員會(huì)、溫港院士科創(chuàng)中心承辦,中國(guó)電工技術(shù)學(xué)會(huì)、中科先進(jìn)技術(shù)溫州研究院與溫州市電力工程學(xué)會(huì)提供支持,以“甌江論道-AI賦能綠色發(fā)展”為主題,

    標(biāo)簽:
    ai技術(shù)
  • 王通:未來(lái)個(gè)人創(chuàng)業(yè)的十個(gè)機(jī)會(huì)

    個(gè)人創(chuàng)業(yè)需要啟動(dòng)成本低、無(wú)需龐大團(tuán)隊(duì)、可快速驗(yàn)證、能利用個(gè)人技能或資源。這里分享適合個(gè)人創(chuàng)業(yè)的十個(gè)機(jī)會(huì)一.AI內(nèi)容優(yōu)化與本地化服務(wù)·做什么:幫助企業(yè)或個(gè)人利用AI工具(如GPT-4,Midjourney)優(yōu)化內(nèi)容生產(chǎn)流程。例如,為跨境電商撰寫多語(yǔ)言產(chǎn)品描述,為小紅書博主生成爆款文案,為小公司制作營(yíng)銷

  • 百度智能云PaddleOCR 3.1正式發(fā)布:關(guān)鍵能力支持MCP

    百度AI團(tuán)隊(duì)今日正式推出PaddleOCR3.1版本,以突破性的多語(yǔ)言組合識(shí)別(MultilingualCompositionPerception,MCP)技術(shù)為核心,徹底重構(gòu)復(fù)雜文檔處理邊界。此次升級(jí)標(biāo)志著OCR領(lǐng)域首次實(shí)現(xiàn)對(duì)同一文檔內(nèi)任意混合語(yǔ)言文本的精準(zhǔn)識(shí)別,為全球化企業(yè)、跨境業(yè)務(wù)及多元文化場(chǎng)

    標(biāo)簽:
    ai智能
    ai技術(shù)
  • AI工具導(dǎo)航網(wǎng)站,未來(lái)的發(fā)展前景怎么樣?

    導(dǎo)航網(wǎng)站的崛起:從信息過(guò)載到精準(zhǔn)觸達(dá)隨著全球AI工具數(shù)量爆發(fā)式增長(zhǎng)(2025年已超數(shù)萬(wàn)款),用戶面臨前所未有的選擇困境。傳統(tǒng)搜索引擎的“關(guān)鍵詞-鏈接”模式難以應(yīng)對(duì)工具篩選的場(chǎng)景需求,垂直化、場(chǎng)景化的AI導(dǎo)航網(wǎng)站應(yīng)運(yùn)而生。這類平臺(tái)通過(guò)聚合、評(píng)測(cè)、分類與推薦四重機(jī)制,將分散的工具資源整合為結(jié)構(gòu)化入口。例

  • 微信AI搜索被指“強(qiáng)行開(kāi)盒”:名字成了數(shù)據(jù)入口,騰訊回應(yīng)“僅用公開(kāi)信息”

    當(dāng)微信公眾號(hào)文章中出現(xiàn)一個(gè)人的名字,它會(huì)自動(dòng)變成藍(lán)色鏈接,點(diǎn)擊即可查看AI生成的“個(gè)人簡(jiǎn)歷”——這一微信新功能讓不少用戶感到被“扒光”在互聯(lián)網(wǎng)上。近日,微信新上線的“AI搜索”功能陷入隱私泄露爭(zhēng)議漩渦。多位網(wǎng)友在社交平臺(tái)反映,當(dāng)微信公眾號(hào)推文中出現(xiàn)本人姓名時(shí),名字會(huì)自動(dòng)變?yōu)樗{(lán)色超鏈接,點(diǎn)擊即可瀏覽由

    標(biāo)簽:
    ai技術(shù)
    ai搜索
  • 養(yǎng)openclaw小龍蝦,每月要花多少錢才能養(yǎng)好?

    “養(yǎng)龍蝦”到底要花多少錢?這個(gè)問(wèn)題可能是大家最關(guān)心的。我們把成本拆成三部分:服務(wù)器租用費(fèi)+大模型API調(diào)用費(fèi)+雜項(xiàng)開(kāi)銷。第一部分:服務(wù)器租用費(fèi)。最省錢的方案當(dāng)然是本地舊電腦自托管——零新增成本,電費(fèi)忽略不計(jì)。但如前所述,你需要接受“不是7×24小時(shí)在線”的局限性。如果選擇云服務(wù)器,成本差異就很大了。

  • 養(yǎng)小龍蝦用個(gè)人電腦還是云服務(wù)器?先搞清楚OpenClaw到底是什么

    不少朋友第一次接觸OpenClaw時(shí),都會(huì)有一個(gè)相同的困惑:這玩意兒到底該裝在哪里?OpenClaw(社區(qū)戲稱“養(yǎng)龍蝦”,因Logo為龍蝦鉗)不是普通的聊天機(jī)器人,而是一款本地優(yōu)先、可自主執(zhí)行、支持多Agent分工協(xié)作的AI執(zhí)行網(wǎng)關(guān)。說(shuō)白了,它讓大模型從“只會(huì)說(shuō)話”變成“會(huì)動(dòng)手做事”——幫你管理文件

  • AI龍蝦養(yǎng)了這么久,這8個(gè)建議你一定要聽(tīng)

    01別相信“一鍵養(yǎng)蝦,躺平賺錢”的鬼話打開(kāi)社交媒體,你可能會(huì)看到這樣的標(biāo)題:“養(yǎng)只龍蝦自動(dòng)炒股,零代碼養(yǎng)出數(shù)字巴菲特!”信了,你就輸了。真實(shí)情況是:一個(gè)做跨境電商的小哥花了200元租服務(wù)器、訂閱API,指望龍蝦幫他炒股暴富。結(jié)果龍蝦開(kāi)始幾天還像模像樣,后來(lái)直接擺爛,生成個(gè)干癟的大綱就敷衍了事。AI是

  • “養(yǎng)龍蝦”火了,可你養(yǎng)的“蝦”要是闖了禍,責(zé)任到底算誰(shuí)的?

    一張證書引發(fā)的討論4月7日,北京嫣然天使兒童醫(yī)院給陳光標(biāo)發(fā)了一張感謝證書,感謝他捐贈(zèng)1000萬(wàn)元。這事說(shuō)起來(lái)挺曲折的。此前陳光標(biāo)高調(diào)說(shuō)要贈(zèng)給張雪一臺(tái)價(jià)值1300萬(wàn)元的勞斯萊斯,張雪回應(yīng)“收了,八折賣掉捐給嫣然”,一番拉扯之后,陳光標(biāo)把車變現(xiàn),1000萬(wàn)元直接打到了嫣然醫(yī)院賬上。醫(yī)院發(fā)證書感謝,本來(lái)是

  • 國(guó)家安全部發(fā)布Token安全警示:需高度警惕數(shù)據(jù)泄露與金融詐騙風(fēng)險(xiǎn)

    2026年4月7日,國(guó)家安全部就AI核心術(shù)語(yǔ)“詞元”(Token)發(fā)布安全警示,強(qiáng)調(diào)在日均調(diào)用量突破140萬(wàn)億規(guī)模的市場(chǎng)背景下,需高度警惕由此引發(fā)的數(shù)據(jù)泄露與金融詐騙風(fēng)險(xiǎn)。據(jù)統(tǒng)計(jì),截至今年3月,我國(guó)日均詞元調(diào)用量已超過(guò)140萬(wàn)億,較2024年初增長(zhǎng)1000多倍。詞元作為大模型處理信息的最小單元,兼具

  • 中國(guó)AI大模型連續(xù)五周領(lǐng)跑全球,調(diào)用量大幅增長(zhǎng)

    如今出門,如果你還沒(méi)用過(guò)AI智能助手,可能真有點(diǎn)跟不上節(jié)奏了。無(wú)論是寫作文、查資料,還是規(guī)劃出行路線,越來(lái)越多的人已經(jīng)習(xí)慣隨手打開(kāi)AI問(wèn)一句。這股熱潮背后,中國(guó)AI大模型用實(shí)打?qū)嵉臄?shù)據(jù)交出了一份亮眼的成績(jī)單。根據(jù)全球知名AI模型聚合平臺(tái)OpenRouter的最新數(shù)據(jù),在3月30日至4月5日這一周,中

    標(biāo)簽:
    大模型
  • 小白養(yǎng)龍蝦的5條保命建議,值得收藏!

    01別在主電腦上養(yǎng)!這是最最重要的一條“保命”建議。很多小白心血來(lái)潮,直接在自己存著畢業(yè)論文、工作文件、銀行卡信息的主力電腦上部署OpenClaw。然后悲劇發(fā)生了:讓龍蝦幫忙整理一下桌面文件,結(jié)果它把整臺(tái)電腦的文件全刪了。這不是段子,是真事。OpenClaw一旦被授予高權(quán)限,就能執(zhí)行刪除、修改等不可

  • 養(yǎng)一只OpenClaw小龍蝦1個(gè)月到底要花多少錢,快來(lái)算一算適不適合你?

    01免費(fèi)領(lǐng)養(yǎng),但飼料要錢很多人第一次聽(tīng)說(shuō)OpenClaw時(shí),腦子里冒出的第一個(gè)念頭是:開(kāi)源軟件,那不免費(fèi)嗎?沒(méi)錯(cuò),OpenClaw本身確實(shí)是開(kāi)源的,下載安裝一分錢不收。但你很快就會(huì)發(fā)現(xiàn),真正的開(kāi)銷根本不在這里。養(yǎng)一只“龍蝦”,就像領(lǐng)養(yǎng)了一只寵物——領(lǐng)養(yǎng)免費(fèi),但“蝦缸”“蝦糧”“蝦保姆”都得自己掏錢。

  • “養(yǎng)龍蝦”為什么突然火了?OpenClaw很強(qiáng),但普通人真的適合嗎?

    一只“龍蝦”,火遍全網(wǎng)“今天你養(yǎng)龍蝦了嗎?”這句話在2026年初,迅速取代“吃了嗎”成為社交媒體上的新晉暗號(hào)。別誤會(huì),這不是什么水產(chǎn)養(yǎng)殖新風(fēng)口。這里說(shuō)的“龍蝦”,是一款名為OpenClaw的開(kāi)源AI智能體。因?yàn)樗膱D標(biāo)是一只紅色龍蝦,網(wǎng)友們便把部署、配置和使用它的過(guò)程,戲稱為“養(yǎng)龍蝦”。一個(gè)開(kāi)源軟件

  • 一秒當(dāng)導(dǎo)演:小云雀上線短劇Agent,10萬(wàn)字劇本一鍵生成60集

    凌晨?jī)牲c(diǎn),小王合上筆記本,揉了揉酸脹的眼睛?;艘粋€(gè)月寫出來(lái)的10萬(wàn)字短劇劇本躺在硬盤里,要真正把它拍成劇,得找演員、租場(chǎng)地、請(qǐng)攝像、做后期……粗算下來(lái)少說(shuō)要幾十萬(wàn),他只能把劇本繼續(xù)鎖在抽屜里。不過(guò),現(xiàn)在小王的劇本可以“見(jiàn)光”了。2026年3月19日,字節(jié)跳動(dòng)旗下的小云雀AI正式上線了短劇Agent

    標(biāo)簽:
    大模型

熱門排行

編輯推薦