專業(yè)機構(gòu)發(fā)布《2019年語音技術》報告稱,語音將成為未來十年決定性主題之一,與人工智能一起從根本上改變?nèi)伺c機器的關系。近日,搜狗輸入法在語音輸入領域率先推出“個性化語音識別”功能,突破語音識別技術瓶頸,大幅優(yōu)化個人詞匯錄入的直接準確性,在語音輸入領域?qū)崿F(xiàn)“更懂用戶”。
搜狗“個性化語音識別”打造用戶專屬輸入法
在日常交流中,個人口頭禪、慣用語經(jīng)常會干擾雙方的信息傳達,這一問題在人機語音交互中尤為凸顯。在語音輸入時,往往用戶只是想錄入一個名稱,輸入結(jié)果卻顯示的是音同意不同的另一項結(jié)果。比如,當用戶希望輸入法顯示人名“憑遠”時,通用的語音識別往往將大眾常用的“平原、品源”列在前列的候選詞匯,用戶的個性化內(nèi)容并不在其中。除此之外,用戶習慣使用的個人詞匯,以及一些多音字、讀音差錯也會對語音識別結(jié)果造成影響。
基于以上原因,搜狗語音率先對語音識別技術進行了革新優(yōu)化,推出“個性化語音識別”服務。經(jīng)過本輪更新,用戶只需在搜狗輸入法App選擇一鍵登錄個人賬戶,即可體驗此項服務。成功開啟后,“個性化語音識別”會通過強化學習用戶習慣使用的個人詞匯,為每個用戶建立定制化語音輸入法。此后,在用戶需要進行語音輸入時,輸入法會根據(jù)語言環(huán)境,結(jié)合上下段落語句進行分析,快速輸出符合用戶心意的文本內(nèi)容,有效減少用戶手動進行二次更改的頻率。
搜狗語音又誕生“黑科技”語音識別更精準
搜狗“個性化語音識別”不僅可有效提升用戶個性化詞句的識別準確率,同時全自動詞庫學習這一特色極大保證了系統(tǒng)的處理及反饋速度,實現(xiàn)整個學習個性化特征的過程在“毫秒級別”就可以全部自動完成。
通過DTSS(Deep Transformer-based Sequence to Sequence model)的端到端聲學模型、神經(jīng)網(wǎng)絡語言模型和智能標點預測等技術,搜狗輸入法引入前沿深度學習技術,對語音識別進行仿真模擬和訓練,有效提高語音錄入在通用場景下的識別準確性,精準度已達到領先業(yè)內(nèi)。“個性化語音識別”可基于用戶數(shù)據(jù)分析,對用戶習慣使用的個性化詞組進行掃描記錄,在語音輸入時,優(yōu)先選擇用戶習慣用語進行文本輸出。通過此項技術革新,在保障通用識別準確性的前提下,使用戶常用語的字詞錯誤率下降40%,攻克語音識別精準化的技術難關。
掌控AI從個性化語音識別開始
手和舌頭是人類最靈活的兩個部分,從移動智能設備發(fā)展以來,各種觸控交互無不依賴于手的操作。而當語音技術和人工智能同時走向成熟時,或許就像《2019語音技術報告》中所描述的那樣:語音交互扭轉(zhuǎn)了以往人機交互的存在形態(tài),用戶與設備間基于語音交互的全新關系開始搭建,與之前互聯(lián)網(wǎng)向移動互聯(lián)網(wǎng)過渡一樣,其對底層平臺的全新需求也在醞釀當中。
新時代即將來臨,為應對人工智能、虛擬現(xiàn)實等技術的革新以及不同維度、多場景使用的需要,用戶輸入法的使用習慣逐漸向語音輸入轉(zhuǎn)移。同時,與文本輸入相比,語音輸入注定成為最主要的人機互動接口。優(yōu)化語音識別技術,為用戶提供更自然、更便利、更高效的語音錄入服務,是智慧輸入法的發(fā)展趨勢。
隨著語音識別技術的不斷成熟,以及用戶個性化詞庫的不斷豐富,搜狗將聚合用戶級語音個性化資源,實現(xiàn)“定制化語音輸入法”。使每個用戶基于“定制版”、“更懂自己”的搜狗語音識別的支持,在日常生活以及醫(yī)療、法律等專業(yè)領域,有效提高線上交流和人機溝通的效率及準確度,或?qū)⒊蔀槿斯ぶ悄軙r代輸入端的全局掌控者。
申請創(chuàng)業(yè)報道,分享創(chuàng)業(yè)好點子。點擊此處,共同探討創(chuàng)業(yè)新機遇!
2023年7月6日,第六屆世界人工智能大會(WAIC2023)在上海開幕,“人工智能大模型”是本屆大會的備受矚目的話題,據(jù)悉,在昇騰AI大模型的創(chuàng)新研發(fā)中,華為聯(lián)手26家行業(yè)領軍企業(yè),組建了一支協(xié)同創(chuàng)新的“AI明星隊”,云天勵飛作為中國人工智能企業(yè)的杰出代表,和互聯(lián)網(wǎng)大廠、運營商、科研院所等優(yōu)秀團隊
這幾個月來,以ChatGPT為代表的生成式AI展現(xiàn)出的能力令世界驚嘆。自從2016年AlphaGo戰(zhàn)勝李世石掀起了一波AI浪潮后,AI仿佛已經(jīng)沉寂了很久,ChatGPT的橫空出世就如同一束耀眼的光芒,讓AI這個名詞重回C位。過去在AI1.0時代,主要通過訓練模型來實現(xiàn)圖像識別、聲音識別、語言處理等特
文:互聯(lián)網(wǎng)江湖作者:志剛2023年的IoT需要一個新故事。6月29日,涂鴉智能在開發(fā)者大會上,發(fā)布了企業(yè)級戰(zhàn)略PaaS2.0,希望通過一個平臺+四大開發(fā)服務,建立起IoT生態(tài)。對于這場發(fā)布會,市場的態(tài)度是積極的。美東時間6月29日收盤,涂鴉智能美股股價上漲5.6%,來到1.87美元/股。近日股價穩(wěn)定
美團曾經(jīng)的二號人物王慧文對標OpenAI的創(chuàng)業(yè)項目光年之外,以20億賣給美團,再度引發(fā)市場對大模型的熱議。
2020年底,王慧文在朋友圈寫下這句話時,外界本以為這位伴隨中國互聯(lián)網(wǎng)發(fā)展而持續(xù)創(chuàng)業(yè)20年的人物即將告別創(chuàng)業(yè)舞臺。但是,一個曾經(jīng)多次創(chuàng)業(yè),正值壯年的互聯(lián)網(wǎng)老將心中的創(chuàng)業(yè)熱情是難以熄滅的。
在數(shù)字化與智能化深度交織的時代浪潮中,安全的邊界不斷延展,技術的演進正引領產(chǎn)業(yè)邁向新一輪變革。10月24日,以“弈動Dynamic·數(shù)智躍遷博弈無界”為主題的2025TechWorld智慧安全大會在北京盛大召開。來自國家部委、院士學者、高??蒲袡C構(gòu)和企業(yè)的權威專家與業(yè)界精英齊聚北京,共議AI安全、數(shù)
2025年10月25日,2025世界青年科學家峰會之人工智能(AI)融合創(chuàng)新發(fā)展論壇在浙江溫州成功舉辦。本次論壇由國際院士科創(chuàng)中心主辦,中國投資協(xié)會能源投資專業(yè)委員會、溫港院士科創(chuàng)中心承辦,中國電工技術學會、中科先進技術溫州研究院與溫州市電力工程學會提供支持,以“甌江論道-AI賦能綠色發(fā)展”為主題,
我覺得我們AI的目標是:從芯片設計到軟件生態(tài),全鏈路自主開發(fā),建立可控的世界級AI體系。所以這是俺對未來5年中國AI圈的展望和判斷。(1)2026年,英偉達造車、國產(chǎn)開車26年國產(chǎn)芯片會在推理和垂直場景上發(fā)力。以DeepSeek為代表,大多數(shù)AI大模型會以軟件彌補硬件不足,所以訓練和推理分開,訓練就
文/道哥在深陷“后門”風波、接受網(wǎng)信辦問詢之后,英偉達的“特供版”H20芯片,又有了新消息。近日,美國科技媒體《TheInformation》援引知情人士消息稱,英偉達已悄然向其關鍵供應商——包括負責封裝的安靠科技、供應高帶寬內(nèi)存的三星電子、以及承擔后端處理的富士康發(fā)出指令,要求暫停所有與H20AI
文/二風來源/節(jié)點財經(jīng)一場關于“中國芯”的IPO審議,正把投資者們的目光鎖定在上交所。根據(jù)上交所發(fā)布的公告,上市審核委員會已定于9月26日審議摩爾線程的科創(chuàng)板首發(fā)申請。作為中國半導體自主化浪潮中最受矚目的“考生”之一,包括其創(chuàng)始人顯赫的英偉達背景、高達80億元人民幣的募資雄心,以及在國產(chǎn)GPU領域取
技術的進步永無止境,繼創(chuàng)下TPC-C性能&性價比雙冠之后,阿里云PolarDB云原生數(shù)據(jù)庫再度實現(xiàn)關鍵突破。9月24日杭州云棲大會上,阿里云宣布推出全球首款基于CXL(ComputeExpressLink)2.0Switch技術的PolarDB數(shù)據(jù)庫專用服務器。在原有RDMA網(wǎng)絡的基礎上,Polar
2025年9月24日,在杭州舉辦的云棲大會上,阿里云正式發(fā)布全新一代服務器操作系統(tǒng)AlibabaCloudLinux4(簡稱Alinux4)。Alinux4基于Linux6.6內(nèi)核打造,是首個全面遵循龍蜥社區(qū)“開源生態(tài)合作倡議”規(guī)范的商業(yè)發(fā)行版。它不僅兼容主流開源社區(qū)生態(tài),更針對阿里云最新9代ECS
9月24日,杭州云棲大會技術主論壇上,阿里云重磅發(fā)布AI安全護欄,提供五項核心安全能力,護航AI安全。一方面為客戶提供融入AIAgent開發(fā)全鏈路的原生安全防護,另一方面持續(xù)用AI賦能安全產(chǎn)品智能化升級,打造Agentic-SOC安全運營,提升安全威脅檢測和響應效率。在過去的一年,AIAgent正在