99re6这里有精品热视频,久久综合九色欧美综合狠狠,国产精品久久久久久无毒不卡,av免费无插件在线观看,欧美放荡办公室videos

  1. 創(chuàng)業(yè)頭條
  2. 前沿領(lǐng)域
  3. 人工智能
  4. 正文

真假難辨?獵戶星空10段話克隆你的聲音!

 2018-11-06 12:02  來源:互聯(lián)網(wǎng)  我來投稿 撤稿糾錯

  阿里云優(yōu)惠券 先領(lǐng)券再下單

今日,獵豹移動董事長兼CEO傅盛在自己的抖音號上發(fā)布了一條視頻。作為一名“科技樂觀主義者”,傅盛和世界上的另一個“自己”進(jìn)行了一場隔空對話。短短幾十秒里,機(jī)器人“傅盛”的對答、繞口令樣樣精通。即使是仔細(xì)辨別,你也很難確認(rèn)哪一個才是真正的傅盛。

能夠達(dá)到如此驚艷的效果,其實要歸功于獵豹移動旗下人工智能公司獵戶星空研發(fā)的語音合成技術(shù)。只要聽十段你的話,就可以克隆你的聲音,聽起來是不是很炫酷?

在人機(jī)交互的過程中,與用戶體驗感直接相關(guān)的,就是語音合成技術(shù)。這項技術(shù)是將文字轉(zhuǎn)化為聲音,可以簡單地理解為人類的嘴巴。大家在各種智能語音助手中聽到的聲音,都是由TTS來生成的。所以,讓TTS合成的語音能夠“以假亂真”,正是TTS領(lǐng)域長期以來不斷探索的主題。

傳統(tǒng)的TTS都是怎么做的?

在看獵戶星空如何實現(xiàn)“以小取大”的效果時,我們可以先看看以往的TTS是如何實現(xiàn)的。

傳統(tǒng)的TTS系統(tǒng)通常包括前端、后端兩個模塊。前端模塊主要負(fù)責(zé)對輸入文本進(jìn)行分析,提取語言學(xué)信息,如果是中文還涉及文本正則化、分詞、詞性預(yù)測、多音字消歧、韻律預(yù)測等,后端模塊根據(jù)前端的分析結(jié)果,通過一定的方法生成語音波形。

后端系統(tǒng)的主流技術(shù)有兩種,一種是基于統(tǒng)計參數(shù)建模的語音合成,或者叫做參數(shù)合成、參數(shù)法,優(yōu)點是所需語料庫少,幾千句即可,訓(xùn)練與合成過程也都可以由程序自動完成,但缺點是語音質(zhì)量不高,情感韻律平淡。

現(xiàn)在大家地圖導(dǎo)航軟件中的聽到的明星音,針對導(dǎo)航場景錄制了幾千句的語料,不僅聲音生澀感強(qiáng),而且需要的成本和周期較長,在其他領(lǐng)域的聲音效果不是很好。如果用戶預(yù)期不苛刻,這樣一種方式也未嘗不可。

另一種是基于單元挑選和波形拼接的語音合成,或者叫做拼接合成、拼接法,與參數(shù)法相反,優(yōu)點是合成語音自然度很好,缺點就是數(shù)據(jù)要求太大,至少萬句語料才能滿足商用需求,一些廠商會請聲優(yōu)為其智能產(chǎn)品錄制語料庫,前后時間長達(dá)數(shù)月,花費動輒幾百萬。

獵戶星空:十段話合成人聲

魚和熊掌不可兼得,傳統(tǒng)的TTS存在著或多或少的問題。所以這個領(lǐng)域的核心,在于如何降低訓(xùn)練成本,用更少的語料合成高質(zhì)量的聲音。

隨著人工智能、深度學(xué)習(xí)的應(yīng)用,TTS也迎來了新的變革。2017年3月,Google 提出了一種新的端到端的語音合成系統(tǒng):Tacotron。它可將接收的輸入字符,輸出成相應(yīng)的原始頻譜圖,然后提供給Griffin-Lim重建算法生成語音。2017年底,Tacotron 2結(jié)合了WaveNet和Tacotron的優(yōu)勢,不需要任何語法知識即可直接輸出文本對應(yīng)的語音。

在已有的技術(shù)創(chuàng)新鋪墊下,獵戶星空TTS團(tuán)隊在Tactron的基礎(chǔ)上,訓(xùn)練了大語料庫的語音庫作為基礎(chǔ)模型,目標(biāo)發(fā)音人只需要錄制10段話,通過Adapt自適應(yīng)模型,提取出目標(biāo)發(fā)音人的特征,再通過World聲碼器,即可合成出目標(biāo)發(fā)音人音色相同的語音。

所以,這項技術(shù)真正落地商用后,將為明星語音、個性化語音的合成帶來重大突破,尤其是很大程度上減少明星音合成的成本、縮短應(yīng)用研發(fā)的周期。

想象一下,以后你的語音助手中住著你喜歡的明星或心愛的人,每天都可以和TA互動聊天,仿佛TA就是你的私人小秘書,是不是有點小激動呢?

除此之外,獵戶星空已掌握麥克風(fēng)陣列、語音喚醒、語音識別、語義理解和語音合成等全套遠(yuǎn)場語音技術(shù),語音交互更快更準(zhǔn),垂直領(lǐng)域深度語義理解正確率96%,還首創(chuàng)了喚醒后人聲回應(yīng)。

獵戶語音OS成為行業(yè)標(biāo)配

在上文提到技術(shù)能力支撐之下,獵戶星空打造了獵戶tts——這個星球最溫暖的AI聲音。目前獵戶語音OS技術(shù)已經(jīng)應(yīng)用到了小米小愛同學(xué)、美的小美AI音箱、喜馬拉雅小雅音箱、獵豹移動小豹AI音箱、華為智能AI音箱等多家合作伙伴產(chǎn)品中,已經(jīng)成為行業(yè)標(biāo)配。

截至目前,搭載獵戶語音合成技術(shù)的智能音箱產(chǎn)品在國內(nèi)份額已超30%,每天都超過2000萬次語音服務(wù)請求,比如小米AI助理小愛同學(xué)月活躍設(shè)備超過3000萬臺,累計喚醒超50億次。

10月15日,中國人工智能產(chǎn)業(yè)發(fā)展聯(lián)盟(AIIA)在人工智能開發(fā)者大會公布了國內(nèi)智能音箱智能化評級結(jié)果,包括獵豹移動、小米、喜馬拉雅、百度、京東在內(nèi)的五家主流廠商攜其智能音箱產(chǎn)品參與了首批測試評估。獵戶語音OS占據(jù)了獲評產(chǎn)品前五強(qiáng)中的三席,支撐起了智能音箱市場的大半壁江山。

結(jié)合自身人機(jī)交互的產(chǎn)品基因和獵戶星空擁有的行業(yè)唯一的全鏈條AI技術(shù),獵豹移動也在不同行業(yè)推動人工智能產(chǎn)品的場景化落地。未來,獵豹移動與旗下獵戶星空還會將自主研發(fā)的視覺、導(dǎo)航、語音、機(jī)械臂技術(shù)等核心能力逐步對外開放,與合作伙伴一起,讓機(jī)器人產(chǎn)品走進(jìn)大眾生活。

申請創(chuàng)業(yè)報道,分享創(chuàng)業(yè)好點子。點擊此處,共同探討創(chuàng)業(yè)新機(jī)遇!

相關(guān)標(biāo)簽
ai技術(shù)
智能音箱
手機(jī)克隆

相關(guān)文章

  • 匯聚中國AI頂尖力量 云天勵飛參與華為AI大模型聯(lián)合創(chuàng)新

    2023年7月6日,第六屆世界人工智能大會(WAIC2023)在上海開幕,“人工智能大模型”是本屆大會的備受矚目的話題,據(jù)悉,在昇騰AI大模型的創(chuàng)新研發(fā)中,華為聯(lián)手26家行業(yè)領(lǐng)軍企業(yè),組建了一支協(xié)同創(chuàng)新的“AI明星隊”,云天勵飛作為中國人工智能企業(yè)的杰出代表,和互聯(lián)網(wǎng)大廠、運營商、科研院所等優(yōu)秀團(tuán)隊

    標(biāo)簽:
    ai技術(shù)
  • 用友大易:邁入AI招聘2.0時代,讓人力資源回歸本質(zhì)

    這幾個月來,以ChatGPT為代表的生成式AI展現(xiàn)出的能力令世界驚嘆。自從2016年AlphaGo戰(zhàn)勝李世石掀起了一波AI浪潮后,AI仿佛已經(jīng)沉寂了很久,ChatGPT的橫空出世就如同一束耀眼的光芒,讓AI這個名詞重回C位。過去在AI1.0時代,主要通過訓(xùn)練模型來實現(xiàn)圖像識別、聲音識別、語言處理等特

    標(biāo)簽:
    ai技術(shù)
  • 新發(fā)布的PaaS2.0,能否助力涂鴉智能再起飛?

    文:互聯(lián)網(wǎng)江湖作者:志剛2023年的IoT需要一個新故事。6月29日,涂鴉智能在開發(fā)者大會上,發(fā)布了企業(yè)級戰(zhàn)略PaaS2.0,希望通過一個平臺+四大開發(fā)服務(wù),建立起IoT生態(tài)。對于這場發(fā)布會,市場的態(tài)度是積極的。美東時間6月29日收盤,涂鴉智能美股股價上漲5.6%,來到1.87美元/股。近日股價穩(wěn)定

    標(biāo)簽:
    ai技術(shù)
  • 大模型難掩AI制藥的悲傷:越過山丘,無人等候

    美團(tuán)曾經(jīng)的二號人物王慧文對標(biāo)OpenAI的創(chuàng)業(yè)項目光年之外,以20億賣給美團(tuán),再度引發(fā)市場對大模型的熱議。

    標(biāo)簽:
    ai技術(shù)
  • 拾起王慧文的AI夢,美團(tuán)沖向“光年之外”?

    2020年底,王慧文在朋友圈寫下這句話時,外界本以為這位伴隨中國互聯(lián)網(wǎng)發(fā)展而持續(xù)創(chuàng)業(yè)20年的人物即將告別創(chuàng)業(yè)舞臺。但是,一個曾經(jīng)多次創(chuàng)業(yè),正值壯年的互聯(lián)網(wǎng)老將心中的創(chuàng)業(yè)熱情是難以熄滅的。

    標(biāo)簽:
    ai技術(shù)
  • 蘋果AI掉隊?現(xiàn)在唱衰或許還為時過早

    蘋果還沒從WWDC25的“群嘲”中走出,又迎來了一次新的痛擊。據(jù)路透社報道,21日,蘋果公司遭到股東集體起訴,被指在信息披露中低估了將先進(jìn)生成式AI整合進(jìn)語音助手Siri所需的時間,導(dǎo)致iPhone銷量受影響、股價下滑,構(gòu)成證券欺詐。在這份訴訟中,庫克、首席財務(wù)官凱文·帕雷克及前首席財務(wù)官盧卡·馬埃

    標(biāo)簽:
    蘋果公司
    ai智能
  • DeepSeek、豆包向左,盤古大模型向右

    華為的盤古大模型終于推出新版本了。6月20日華為云計算CEO張平安宣布基于CloudMatrix384超節(jié)點的新一代昇騰AI云服務(wù)全面上線,盤古大模型5.5同步發(fā)布。不過,當(dāng)前國內(nèi)的AI大模型競爭可謂是相當(dāng)激烈,華為的盤古大模型在眾多大模型中并不是十分出眾。華為云此次重磅推出的盤古大模型5.5能否從

    標(biāo)簽:
    deepseek
    豆包ai
    盤古大模型
  • 數(shù)字人羅永浩一場直播賣了5000萬,數(shù)字人能取代真人主播嗎?

    一場沒有羅永浩的“羅永浩直播”,正在改寫帶貨規(guī)則當(dāng)數(shù)字人羅永浩在百度直播間舉起青島啤酒,以標(biāo)志性幽默回應(yīng)粉絲提問時,彈幕瘋狂刷出“這是真的還是假的?”的疑問。這場持續(xù)近7小時的直播,創(chuàng)下1300萬人次觀看、GMV突破5500萬元的驚人戰(zhàn)績,甚至超過了他本人一個月前真人直播5000萬元的成績。數(shù)字人主

  • 新東方發(fā)布首款原創(chuàng)AI教育產(chǎn)品,開啟一對一智能學(xué)習(xí)時代

    高頻互動、個性化教學(xué)、突破成本壁壘,AI老師讓英語學(xué)習(xí)更普惠。6月24日,新東方正式推出面向消費者的首款原創(chuàng)AI教育產(chǎn)品——“新東方AI1對1”。這款產(chǎn)品標(biāo)志著新東方在教育+AI戰(zhàn)略布局中邁出關(guān)鍵一步,旨在以科技力量推動優(yōu)質(zhì)教育資源的普惠發(fā)展。在發(fā)布會現(xiàn)場,新東方教育科技集團(tuán)CEO周成剛表示:“AI

    標(biāo)簽:
    ai智能
  • AI工作流是什么?coze扣子工作流怎么搭建和使用?

    大家好,我是白楊SEO,專注SEO十年以上,全網(wǎng)SEO流量實戰(zhàn)派,AI搜索優(yōu)化研究者。為什么想分享這個AI工作流及coze扣子這個?因為我們搞流量的如果學(xué)會了用AI給我們生產(chǎn)提效將更有助于我們?nèi)カ@客。目前白楊SEO用得并不是很好,分享僅供參考,希望給你一些啟發(fā)。老規(guī)矩,先說下文章大綱如下:1、AI工

    標(biāo)簽:
    ai智能

編輯推薦