專業(yè)機(jī)構(gòu)發(fā)布《2019年語音技術(shù)》報告稱,語音將成為未來十年決定性主題之一,與人工智能一起從根本上改變?nèi)伺c機(jī)器的關(guān)系。近日,搜狗輸入法在語音輸入領(lǐng)域率先推出“個性化語音識別”功能,突破語音識別技術(shù)瓶頸,大幅優(yōu)化個人詞匯錄入的直接準(zhǔn)確性,在語音輸入領(lǐng)域?qū)崿F(xiàn)“更懂用戶”。
搜狗“個性化語音識別”打造用戶專屬輸入法
在日常交流中,個人口頭禪、慣用語經(jīng)常會干擾雙方的信息傳達(dá),這一問題在人機(jī)語音交互中尤為凸顯。在語音輸入時,往往用戶只是想錄入一個名稱,輸入結(jié)果卻顯示的是音同意不同的另一項結(jié)果。比如,當(dāng)用戶希望輸入法顯示人名“憑遠(yuǎn)”時,通用的語音識別往往將大眾常用的“平原、品源”列在前列的候選詞匯,用戶的個性化內(nèi)容并不在其中。除此之外,用戶習(xí)慣使用的個人詞匯,以及一些多音字、讀音差錯也會對語音識別結(jié)果造成影響。
基于以上原因,搜狗語音率先對語音識別技術(shù)進(jìn)行了革新優(yōu)化,推出“個性化語音識別”服務(wù)。經(jīng)過本輪更新,用戶只需在搜狗輸入法App選擇一鍵登錄個人賬戶,即可體驗此項服務(wù)。成功開啟后,“個性化語音識別”會通過強(qiáng)化學(xué)習(xí)用戶習(xí)慣使用的個人詞匯,為每個用戶建立定制化語音輸入法。此后,在用戶需要進(jìn)行語音輸入時,輸入法會根據(jù)語言環(huán)境,結(jié)合上下段落語句進(jìn)行分析,快速輸出符合用戶心意的文本內(nèi)容,有效減少用戶手動進(jìn)行二次更改的頻率。
搜狗語音又誕生“黑科技”語音識別更精準(zhǔn)
搜狗“個性化語音識別”不僅可有效提升用戶個性化詞句的識別準(zhǔn)確率,同時全自動詞庫學(xué)習(xí)這一特色極大保證了系統(tǒng)的處理及反饋速度,實(shí)現(xiàn)整個學(xué)習(xí)個性化特征的過程在“毫秒級別”就可以全部自動完成。
通過DTSS(Deep Transformer-based Sequence to Sequence model)的端到端聲學(xué)模型、神經(jīng)網(wǎng)絡(luò)語言模型和智能標(biāo)點(diǎn)預(yù)測等技術(shù),搜狗輸入法引入前沿深度學(xué)習(xí)技術(shù),對語音識別進(jìn)行仿真模擬和訓(xùn)練,有效提高語音錄入在通用場景下的識別準(zhǔn)確性,精準(zhǔn)度已達(dá)到領(lǐng)先業(yè)內(nèi)。“個性化語音識別”可基于用戶數(shù)據(jù)分析,對用戶習(xí)慣使用的個性化詞組進(jìn)行掃描記錄,在語音輸入時,優(yōu)先選擇用戶習(xí)慣用語進(jìn)行文本輸出。通過此項技術(shù)革新,在保障通用識別準(zhǔn)確性的前提下,使用戶常用語的字詞錯誤率下降40%,攻克語音識別精準(zhǔn)化的技術(shù)難關(guān)。
掌控AI從個性化語音識別開始
手和舌頭是人類最靈活的兩個部分,從移動智能設(shè)備發(fā)展以來,各種觸控交互無不依賴于手的操作。而當(dāng)語音技術(shù)和人工智能同時走向成熟時,或許就像《2019語音技術(shù)報告》中所描述的那樣:語音交互扭轉(zhuǎn)了以往人機(jī)交互的存在形態(tài),用戶與設(shè)備間基于語音交互的全新關(guān)系開始搭建,與之前互聯(lián)網(wǎng)向移動互聯(lián)網(wǎng)過渡一樣,其對底層平臺的全新需求也在醞釀當(dāng)中。
新時代即將來臨,為應(yīng)對人工智能、虛擬現(xiàn)實(shí)等技術(shù)的革新以及不同維度、多場景使用的需要,用戶輸入法的使用習(xí)慣逐漸向語音輸入轉(zhuǎn)移。同時,與文本輸入相比,語音輸入注定成為最主要的人機(jī)互動接口。優(yōu)化語音識別技術(shù),為用戶提供更自然、更便利、更高效的語音錄入服務(wù),是智慧輸入法的發(fā)展趨勢。
隨著語音識別技術(shù)的不斷成熟,以及用戶個性化詞庫的不斷豐富,搜狗將聚合用戶級語音個性化資源,實(shí)現(xiàn)“定制化語音輸入法”。使每個用戶基于“定制版”、“更懂自己”的搜狗語音識別的支持,在日常生活以及醫(yī)療、法律等專業(yè)領(lǐng)域,有效提高線上交流和人機(jī)溝通的效率及準(zhǔn)確度,或?qū)⒊蔀槿斯ぶ悄軙r代輸入端的全局掌控者。
申請創(chuàng)業(yè)報道,分享創(chuàng)業(yè)好點(diǎn)子。點(diǎn)擊此處,共同探討創(chuàng)業(yè)新機(jī)遇!
2025年10月25日,2025世界青年科學(xué)家峰會之人工智能(AI)融合創(chuàng)新發(fā)展論壇在浙江溫州成功舉辦。本次論壇由國際院士科創(chuàng)中心主辦,中國投資協(xié)會能源投資專業(yè)委員會、溫港院士科創(chuàng)中心承辦,中國電工技術(shù)學(xué)會、中科先進(jìn)技術(shù)溫州研究院與溫州市電力工程學(xué)會提供支持,以“甌江論道-AI賦能綠色發(fā)展”為主題,
個人創(chuàng)業(yè)需要啟動成本低、無需龐大團(tuán)隊、可快速驗證、能利用個人技能或資源。這里分享適合個人創(chuàng)業(yè)的十個機(jī)會一.AI內(nèi)容優(yōu)化與本地化服務(wù)·做什么:幫助企業(yè)或個人利用AI工具(如GPT-4,Midjourney)優(yōu)化內(nèi)容生產(chǎn)流程。例如,為跨境電商撰寫多語言產(chǎn)品描述,為小紅書博主生成爆款文案,為小公司制作營銷
百度AI團(tuán)隊今日正式推出PaddleOCR3.1版本,以突破性的多語言組合識別(MultilingualCompositionPerception,MCP)技術(shù)為核心,徹底重構(gòu)復(fù)雜文檔處理邊界。此次升級標(biāo)志著OCR領(lǐng)域首次實(shí)現(xiàn)對同一文檔內(nèi)任意混合語言文本的精準(zhǔn)識別,為全球化企業(yè)、跨境業(yè)務(wù)及多元文化場
導(dǎo)航網(wǎng)站的崛起:從信息過載到精準(zhǔn)觸達(dá)隨著全球AI工具數(shù)量爆發(fā)式增長(2025年已超數(shù)萬款),用戶面臨前所未有的選擇困境。傳統(tǒng)搜索引擎的“關(guān)鍵詞-鏈接”模式難以應(yīng)對工具篩選的場景需求,垂直化、場景化的AI導(dǎo)航網(wǎng)站應(yīng)運(yùn)而生。這類平臺通過聚合、評測、分類與推薦四重機(jī)制,將分散的工具資源整合為結(jié)構(gòu)化入口。例
當(dāng)微信公眾號文章中出現(xiàn)一個人的名字,它會自動變成藍(lán)色鏈接,點(diǎn)擊即可查看AI生成的“個人簡歷”——這一微信新功能讓不少用戶感到被“扒光”在互聯(lián)網(wǎng)上。近日,微信新上線的“AI搜索”功能陷入隱私泄露爭議漩渦。多位網(wǎng)友在社交平臺反映,當(dāng)微信公眾號推文中出現(xiàn)本人姓名時,名字會自動變?yōu)樗{(lán)色超鏈接,點(diǎn)擊即可瀏覽由
12月12日-14日,2025全球開發(fā)者先鋒大會暨國際具身智能技能大賽(GDPS2025)于上海張江科學(xué)會堂舉行,大會以具身智能競技為核心,融合了技術(shù)比拼、產(chǎn)業(yè)展示與科普體驗,為全球觀眾呈現(xiàn)出具身智能的現(xiàn)在與未來。上海開普勒機(jī)器人有限公司(以下簡稱"開普勒機(jī)器人")攜明星產(chǎn)品K2"大黃蜂"亮相,并參
在數(shù)字化與智能化深度交織的時代浪潮中,安全的邊界不斷延展,技術(shù)的演進(jìn)正引領(lǐng)產(chǎn)業(yè)邁向新一輪變革。10月24日,以“弈動Dynamic·數(shù)智躍遷博弈無界”為主題的2025TechWorld智慧安全大會在北京盛大召開。來自國家部委、院士學(xué)者、高??蒲袡C(jī)構(gòu)和企業(yè)的權(quán)威專家與業(yè)界精英齊聚北京,共議AI安全、數(shù)
2025年10月25日,2025世界青年科學(xué)家峰會之人工智能(AI)融合創(chuàng)新發(fā)展論壇在浙江溫州成功舉辦。本次論壇由國際院士科創(chuàng)中心主辦,中國投資協(xié)會能源投資專業(yè)委員會、溫港院士科創(chuàng)中心承辦,中國電工技術(shù)學(xué)會、中科先進(jìn)技術(shù)溫州研究院與溫州市電力工程學(xué)會提供支持,以“甌江論道-AI賦能綠色發(fā)展”為主題,
我覺得我們AI的目標(biāo)是:從芯片設(shè)計到軟件生態(tài),全鏈路自主開發(fā),建立可控的世界級AI體系。所以這是俺對未來5年中國AI圈的展望和判斷。(1)2026年,英偉達(dá)造車、國產(chǎn)開車26年國產(chǎn)芯片會在推理和垂直場景上發(fā)力。以DeepSeek為代表,大多數(shù)AI大模型會以軟件彌補(bǔ)硬件不足,所以訓(xùn)練和推理分開,訓(xùn)練就
文/道哥在深陷“后門”風(fēng)波、接受網(wǎng)信辦問詢之后,英偉達(dá)的“特供版”H20芯片,又有了新消息。近日,美國科技媒體《TheInformation》援引知情人士消息稱,英偉達(dá)已悄然向其關(guān)鍵供應(yīng)商——包括負(fù)責(zé)封裝的安靠科技、供應(yīng)高帶寬內(nèi)存的三星電子、以及承擔(dān)后端處理的富士康發(fā)出指令,要求暫停所有與H20AI
文/二風(fēng)來源/節(jié)點(diǎn)財經(jīng)一場關(guān)于“中國芯”的IPO審議,正把投資者們的目光鎖定在上交所。根據(jù)上交所發(fā)布的公告,上市審核委員會已定于9月26日審議摩爾線程的科創(chuàng)板首發(fā)申請。作為中國半導(dǎo)體自主化浪潮中最受矚目的“考生”之一,包括其創(chuàng)始人顯赫的英偉達(dá)背景、高達(dá)80億元人民幣的募資雄心,以及在國產(chǎn)GPU領(lǐng)域取
技術(shù)的進(jìn)步永無止境,繼創(chuàng)下TPC-C性能&性價比雙冠之后,阿里云PolarDB云原生數(shù)據(jù)庫再度實(shí)現(xiàn)關(guān)鍵突破。9月24日杭州云棲大會上,阿里云宣布推出全球首款基于CXL(ComputeExpressLink)2.0Switch技術(shù)的PolarDB數(shù)據(jù)庫專用服務(wù)器。在原有RDMA網(wǎng)絡(luò)的基礎(chǔ)上,Polar
2025年9月24日,在杭州舉辦的云棲大會上,阿里云正式發(fā)布全新一代服務(wù)器操作系統(tǒng)AlibabaCloudLinux4(簡稱Alinux4)。Alinux4基于Linux6.6內(nèi)核打造,是首個全面遵循龍蜥社區(qū)“開源生態(tài)合作倡議”規(guī)范的商業(yè)發(fā)行版。它不僅兼容主流開源社區(qū)生態(tài),更針對阿里云最新9代ECS