乱码乱a∨中文字幕,在线免费激情视频,亚洲欧美久久夜夜潮,国产在线网址

  1. <sub id="hjl7n"></sub>

    1. <sub id="hjl7n"></sub>

      <legend id="hjl7n"></legend>
      1. 創(chuàng)業(yè)頭條
      2. 前沿領(lǐng)域
      3. 人工智能
      4. 正文

      真假難辨?獵戶星空10段話克隆你的聲音!

       2018-11-06 12:02  來源:互聯(lián)網(wǎng)  我來投稿 撤稿糾錯

        阿里云優(yōu)惠券 先領(lǐng)券再下單

      今日,獵豹移動董事長兼CEO傅盛在自己的抖音號上發(fā)布了一條視頻。作為一名“科技樂觀主義者”,傅盛和世界上的另一個“自己”進行了一場隔空對話。短短幾十秒里,機器人“傅盛”的對答、繞口令樣樣精通。即使是仔細辨別,你也很難確認哪一個才是真正的傅盛。

      能夠達到如此驚艷的效果,其實要歸功于獵豹移動旗下人工智能公司獵戶星空研發(fā)的語音合成技術(shù)。只要聽十段你的話,就可以克隆你的聲音,聽起來是不是很炫酷?

      在人機交互的過程中,與用戶體驗感直接相關(guān)的,就是語音合成技術(shù)。這項技術(shù)是將文字轉(zhuǎn)化為聲音,可以簡單地理解為人類的嘴巴。大家在各種智能語音助手中聽到的聲音,都是由TTS來生成的。所以,讓TTS合成的語音能夠“以假亂真”,正是TTS領(lǐng)域長期以來不斷探索的主題。

      傳統(tǒng)的TTS都是怎么做的?

      在看獵戶星空如何實現(xiàn)“以小取大”的效果時,我們可以先看看以往的TTS是如何實現(xiàn)的。

      傳統(tǒng)的TTS系統(tǒng)通常包括前端、后端兩個模塊。前端模塊主要負責(zé)對輸入文本進行分析,提取語言學(xué)信息,如果是中文還涉及文本正則化、分詞、詞性預(yù)測、多音字消歧、韻律預(yù)測等,后端模塊根據(jù)前端的分析結(jié)果,通過一定的方法生成語音波形。

      后端系統(tǒng)的主流技術(shù)有兩種,一種是基于統(tǒng)計參數(shù)建模的語音合成,或者叫做參數(shù)合成、參數(shù)法,優(yōu)點是所需語料庫少,幾千句即可,訓(xùn)練與合成過程也都可以由程序自動完成,但缺點是語音質(zhì)量不高,情感韻律平淡。

      現(xiàn)在大家地圖導(dǎo)航軟件中的聽到的明星音,針對導(dǎo)航場景錄制了幾千句的語料,不僅聲音生澀感強,而且需要的成本和周期較長,在其他領(lǐng)域的聲音效果不是很好。如果用戶預(yù)期不苛刻,這樣一種方式也未嘗不可。

      另一種是基于單元挑選和波形拼接的語音合成,或者叫做拼接合成、拼接法,與參數(shù)法相反,優(yōu)點是合成語音自然度很好,缺點就是數(shù)據(jù)要求太大,至少萬句語料才能滿足商用需求,一些廠商會請聲優(yōu)為其智能產(chǎn)品錄制語料庫,前后時間長達數(shù)月,花費動輒幾百萬。

      獵戶星空:十段話合成人聲

      魚和熊掌不可兼得,傳統(tǒng)的TTS存在著或多或少的問題。所以這個領(lǐng)域的核心,在于如何降低訓(xùn)練成本,用更少的語料合成高質(zhì)量的聲音。

      隨著人工智能、深度學(xué)習(xí)的應(yīng)用,TTS也迎來了新的變革。2017年3月,Google 提出了一種新的端到端的語音合成系統(tǒng):Tacotron。它可將接收的輸入字符,輸出成相應(yīng)的原始頻譜圖,然后提供給Griffin-Lim重建算法生成語音。2017年底,Tacotron 2結(jié)合了WaveNet和Tacotron的優(yōu)勢,不需要任何語法知識即可直接輸出文本對應(yīng)的語音。

      在已有的技術(shù)創(chuàng)新鋪墊下,獵戶星空TTS團隊在Tactron的基礎(chǔ)上,訓(xùn)練了大語料庫的語音庫作為基礎(chǔ)模型,目標發(fā)音人只需要錄制10段話,通過Adapt自適應(yīng)模型,提取出目標發(fā)音人的特征,再通過World聲碼器,即可合成出目標發(fā)音人音色相同的語音。

      所以,這項技術(shù)真正落地商用后,將為明星語音、個性化語音的合成帶來重大突破,尤其是很大程度上減少明星音合成的成本、縮短應(yīng)用研發(fā)的周期。

      想象一下,以后你的語音助手中住著你喜歡的明星或心愛的人,每天都可以和TA互動聊天,仿佛TA就是你的私人小秘書,是不是有點小激動呢?

      除此之外,獵戶星空已掌握麥克風(fēng)陣列、語音喚醒、語音識別、語義理解和語音合成等全套遠場語音技術(shù),語音交互更快更準,垂直領(lǐng)域深度語義理解正確率96%,還首創(chuàng)了喚醒后人聲回應(yīng)。

      獵戶語音OS成為行業(yè)標配

      在上文提到技術(shù)能力支撐之下,獵戶星空打造了獵戶tts——這個星球最溫暖的AI聲音。目前獵戶語音OS技術(shù)已經(jīng)應(yīng)用到了小米小愛同學(xué)、美的小美AI音箱、喜馬拉雅小雅音箱、獵豹移動小豹AI音箱、華為智能AI音箱等多家合作伙伴產(chǎn)品中,已經(jīng)成為行業(yè)標配。

      截至目前,搭載獵戶語音合成技術(shù)的智能音箱產(chǎn)品在國內(nèi)份額已超30%,每天都超過2000萬次語音服務(wù)請求,比如小米AI助理小愛同學(xué)月活躍設(shè)備超過3000萬臺,累計喚醒超50億次。

      10月15日,中國人工智能產(chǎn)業(yè)發(fā)展聯(lián)盟(AIIA)在人工智能開發(fā)者大會公布了國內(nèi)智能音箱智能化評級結(jié)果,包括獵豹移動、小米、喜馬拉雅、百度、京東在內(nèi)的五家主流廠商攜其智能音箱產(chǎn)品參與了首批測試評估。獵戶語音OS占據(jù)了獲評產(chǎn)品前五強中的三席,支撐起了智能音箱市場的大半壁江山。

      結(jié)合自身人機交互的產(chǎn)品基因和獵戶星空擁有的行業(yè)唯一的全鏈條AI技術(shù),獵豹移動也在不同行業(yè)推動人工智能產(chǎn)品的場景化落地。未來,獵豹移動與旗下獵戶星空還會將自主研發(fā)的視覺、導(dǎo)航、語音、機械臂技術(shù)等核心能力逐步對外開放,與合作伙伴一起,讓機器人產(chǎn)品走進大眾生活。

      申請創(chuàng)業(yè)報道,分享創(chuàng)業(yè)好點子。點擊此處,共同探討創(chuàng)業(yè)新機遇!

      相關(guān)文章

      • 匯聚中國AI頂尖力量 云天勵飛參與華為AI大模型聯(lián)合創(chuàng)新

        2023年7月6日,第六屆世界人工智能大會(WAIC2023)在上海開幕,“人工智能大模型”是本屆大會的備受矚目的話題,據(jù)悉,在昇騰AI大模型的創(chuàng)新研發(fā)中,華為聯(lián)手26家行業(yè)領(lǐng)軍企業(yè),組建了一支協(xié)同創(chuàng)新的“AI明星隊”,云天勵飛作為中國人工智能企業(yè)的杰出代表,和互聯(lián)網(wǎng)大廠、運營商、科研院所等優(yōu)秀團隊

        標簽:
        ai技術(shù)
      • 用友大易:邁入AI招聘2.0時代,讓人力資源回歸本質(zhì)

        這幾個月來,以ChatGPT為代表的生成式AI展現(xiàn)出的能力令世界驚嘆。自從2016年AlphaGo戰(zhàn)勝李世石掀起了一波AI浪潮后,AI仿佛已經(jīng)沉寂了很久,ChatGPT的橫空出世就如同一束耀眼的光芒,讓AI這個名詞重回C位。過去在AI1.0時代,主要通過訓(xùn)練模型來實現(xiàn)圖像識別、聲音識別、語言處理等特

        標簽:
        ai技術(shù)
      • 新發(fā)布的PaaS2.0,能否助力涂鴉智能再起飛?

        文:互聯(lián)網(wǎng)江湖作者:志剛2023年的IoT需要一個新故事。6月29日,涂鴉智能在開發(fā)者大會上,發(fā)布了企業(yè)級戰(zhàn)略PaaS2.0,希望通過一個平臺+四大開發(fā)服務(wù),建立起IoT生態(tài)。對于這場發(fā)布會,市場的態(tài)度是積極的。美東時間6月29日收盤,涂鴉智能美股股價上漲5.6%,來到1.87美元/股。近日股價穩(wěn)定

        標簽:
        ai技術(shù)
      • 大模型難掩AI制藥的悲傷:越過山丘,無人等候

        美團曾經(jīng)的二號人物王慧文對標OpenAI的創(chuàng)業(yè)項目光年之外,以20億賣給美團,再度引發(fā)市場對大模型的熱議。

        標簽:
        ai技術(shù)
      • 拾起王慧文的AI夢,美團沖向“光年之外”?

        2020年底,王慧文在朋友圈寫下這句話時,外界本以為這位伴隨中國互聯(lián)網(wǎng)發(fā)展而持續(xù)創(chuàng)業(yè)20年的人物即將告別創(chuàng)業(yè)舞臺。但是,一個曾經(jīng)多次創(chuàng)業(yè),正值壯年的互聯(lián)網(wǎng)老將心中的創(chuàng)業(yè)熱情是難以熄滅的。

        標簽:
        ai技術(shù)
      • 弈動 Dynamic·數(shù)智躍遷 博弈無界|2025TechWorld智慧安全大會在京召開

        在數(shù)字化與智能化深度交織的時代浪潮中,安全的邊界不斷延展,技術(shù)的演進正引領(lǐng)產(chǎn)業(yè)邁向新一輪變革。10月24日,以“弈動Dynamic·數(shù)智躍遷博弈無界”為主題的2025TechWorld智慧安全大會在北京盛大召開。來自國家部委、院士學(xué)者、高??蒲袡C構(gòu)和企業(yè)的權(quán)威專家與業(yè)界精英齊聚北京,共議AI安全、數(shù)

        標簽:
        弈動
      • 甌江論道:AI賦能綠色發(fā)展

        2025年10月25日,2025世界青年科學(xué)家峰會之人工智能(AI)融合創(chuàng)新發(fā)展論壇在浙江溫州成功舉辦。本次論壇由國際院士科創(chuàng)中心主辦,中國投資協(xié)會能源投資專業(yè)委員會、溫港院士科創(chuàng)中心承辦,中國電工技術(shù)學(xué)會、中科先進技術(shù)溫州研究院與溫州市電力工程學(xué)會提供支持,以“甌江論道-AI賦能綠色發(fā)展”為主題,

        標簽:
        ai技術(shù)
      • AI云“分野”:阿里云們“賣鏟”,火山引擎奇襲“MaaS”

        AI云“分野”:阿里云們“賣鏟”,火山引擎奇襲“MaaS”

        標簽:
        阿里巴巴
      • 未來5年,中國AI的“大洗牌”和“內(nèi)循環(huán)”

        我覺得我們AI的目標是:從芯片設(shè)計到軟件生態(tài),全鏈路自主開發(fā),建立可控的世界級AI體系。所以這是俺對未來5年中國AI圈的展望和判斷。(1)2026年,英偉達造車、國產(chǎn)開車26年國產(chǎn)芯片會在推理和垂直場景上發(fā)力。以DeepSeek為代表,大多數(shù)AI大模型會以軟件彌補硬件不足,所以訓(xùn)練和推理分開,訓(xùn)練就

      • H20芯片開賣即叫停,英偉達如何解圍?

        文/道哥在深陷“后門”風(fēng)波、接受網(wǎng)信辦問詢之后,英偉達的“特供版”H20芯片,又有了新消息。近日,美國科技媒體《TheInformation》援引知情人士消息稱,英偉達已悄然向其關(guān)鍵供應(yīng)商——包括負責(zé)封裝的安靠科技、供應(yīng)高帶寬內(nèi)存的三星電子、以及承擔(dān)后端處理的富士康發(fā)出指令,要求暫停所有與H20AI

        標簽:
        英偉達
      • 真正的「國產(chǎn)英偉達」來了

        文/二風(fēng)來源/節(jié)點財經(jīng)一場關(guān)于“中國芯”的IPO審議,正把投資者們的目光鎖定在上交所。根據(jù)上交所發(fā)布的公告,上市審核委員會已定于9月26日審議摩爾線程的科創(chuàng)板首發(fā)申請。作為中國半導(dǎo)體自主化浪潮中最受矚目的“考生”之一,包括其創(chuàng)始人顯赫的英偉達背景、高達80億元人民幣的募資雄心,以及在國產(chǎn)GPU領(lǐng)域取

        標簽:
        英偉達

      編輯推薦