主頁 >  其他 > 克隆真人語音只要1句話,AI問診超96.4%全科醫生!科大訊飛年度黑科技大秀,余承東都來了...

克隆真人語音只要1句話,AI問診超96.4%全科醫生!科大訊飛年度黑科技大秀,余承東都來了...

2021-10-27 09:01:56 其他

楊凈 蕭簫 發自 凹非寺
量子位 報道 | 公眾號 QbitAI

企業擁有265萬開發者是一種什么體驗?

是在最新財報上已經商業變現,開放平臺營收增速高達131%?

連續5年在合肥振臂一呼,全球就迅速回應?

當然,這還不是全部,

在這一次開發者節上,科大訊飛董事長劉慶峰向全球開發者,攤開過去一年答卷,

  • 科大訊飛AI開放平臺,至今已有441項核心技術;

  • 每個月平均新增9萬開發者團隊,其中工業應用占比達到60%;

  • 醫療AI系統一年給出97萬份修正診療結果……

而像“遇強則強,遇弱則弱”的圍棋機器人、1分鐘定制專屬AI數字人3秒判斷聲音畫像等這些技術成果更是成為展區的爆款!

22c44bbf4359111882f9be844a468700.gif

第五屆全球開發者節究竟有何看頭?現在就帶你一文看盡,

科大訊飛最新技術成績

今年1024開發者節上,最先登場的科大訊飛董事長劉慶峰披露了取得的一系列最新成績,

其一,AI健康咨詢準確率超過絕大部分全科醫生,

在你就診時,健康咨詢AI系統會根據你的相關健康狀況,推薦你去對應醫院找專家就診,據劉慶峰介紹,目前科大訊飛的健康咨詢AI系統,已經超過96.4%的通過國家考試的全科醫生,

其二,醫療AI系統一年給出97萬份修正診療結果,

在過去一年中,科大訊飛的AI輔助診療系統,協助修正了97萬份安徽省基層醫生看病的診療初步結果,依賴于科大訊飛的醫療AI輔助診療系統,安歡訓層醫生合理診斷度已經從70分提升到了80分,整體系統準確率已經達到97%以上,

其三,AI開放平臺核心技術達到441項,

2010 年,科大訊飛開放平臺正式上線,集成了語音合成、語音搜索、自然語言處理和語音聽寫等多項能力,成為當時行業內開放最早的智能語音平臺,如今,科大訊飛已經從最初的3項核心技術,進化到今天具備的441項核心AI能力與方案,

11ae016efdb63ac0028360f8d6fbc992.gif

其四,1句話就能語音合成1個人的聲音,

據劉慶峰介紹,科大訊飛正在不斷的持續打造人工智能的核心技術的領先引擎,包括無監督訓練等技術,讓機器用更小的資料、更少的標注學習更多的知識,現在在語音合成上已經實作一句話就能模仿一個人的音色,

在小語種識別上,科大訊飛提出的統一空間表達的半監督語音識別技術,使得研究人員只用100個小時的有監督語音和無標簽文本資料訓練,就能達到之前10000小時有監督語音資料訓練的效果,

其五,用AI讓學生無效作業時間平均降低50%,

據劉慶峰介紹,科大訊飛在安徽合肥率先用人工智能助力“雙減”,利用AI復雜系統,結合OCR自動評分、語音推理等技術,分析學生的學習情況,對程序性作業考試資料進行評價,精準給予指導,將孩子的無效作業時間平均降低了50%,

40075f99812b53d1cdb414cc48639790.gif

這一系列亮眼的成績之上,劉慶峰公開了科大訊飛AI開放平臺2.0戰略,共包括6大措施:

58aab56394413c5db7ba236df86399b1.png

劉慶峰表示,行業關鍵問題,需要各行業的人共同努力:

開發者可以不了解AI技術,只要有靈感、創意和想象力,就可以加入到AI開放平臺2.0來,

只有生態的繁榮,才能決定AI的未來,

AI開放平臺2.0升級

接下來,基于過去5年的開發者生態積累,科大訊飛總裁吳曉如提出1024計劃5.0——用系統性創新,打造人工智能產業新生態,

當中最重要的部分,就是AI開放平臺2.0的發布,

與過去1.0相比,簡單來說,就是二維到三維的升級,

以往的解決方案,都是單向提供給創業伙伴,但隨著人工智能逐漸向傳統產業落地,需要解決的問題更為復雜,需要系統性架構來解決,

8307cb6c1ed2e60c99fa5532b62b924c.png

既然如此,就需要與行業龍頭打造基線底座模型,再與上下游合作伙伴展開合作,形成完整的行業方案,

智慧農業為例,

訊飛就與中國農業大學展開合作,共同研發預測生產模型、澆水施肥模型等,然后提供給傳感器等上下游供應商,共同將方案提供給業內的合作伙伴,

目前,科大訊飛首次推出18個行業,并表示將每年投入5億研發基金,服務100萬開發者,

既然如此,那該如何推動開放平臺2.0的戰略?有四大維度

1、與高校合作開設人工智能專業,目前已經開發339門課程,培養超60萬開發者,

2、與合作伙伴籌建智能語音創新中心,為每個行業制定標準測驗環境,

3、舉辦頂尖賽事,選出行業標桿,正如此次1024開發者節,就舉辦了兼具行業應用、學術研究、公益等105個賽道賽事,共有兩萬多支隊伍報名,

3、范訓創新企業,提供優質資源,除了中國聲谷之外,訊飛在全國共有十余家雙創基地,

四大技術方向突破

接著,科大訊飛高級副總裁、AI研究院院長胡國平,就分享了四大技術方向的突破,

嗯,實際上就是去年發布的“AI科技樹”,今年已然開出一些果來,

第一項,端到端建模技術,

這項技術將前端多路信號直接同步輸入到后端聲學模塊,來實作更精細的建模,可實作復雜(比如嘈雜環境)場景下的一體化語音識別、語音翻譯等,

3c06abf14856ea714187ca321cffea75.png

在語音識別上,以賣場為例,這項技術成功將只有35%的語音識別準確率,提升到了88%;同時語音喚醒的成功率,也成功從40%提升到了90%,

在語音翻譯上,科大訊飛還成功在IWSLT國際口語機器翻譯大賽的同傳任務上,包攬了三個賽道的冠軍,

第二項,無監督訓練技術,

為了降低對語音合成資料規模的要求,科大訊飛提出了聽感量化編碼,充分借助語音識別資料來合成音庫,成功實作了多人混合模型訓練,

fe50a1b6c406b4e0d935980479bf09bf.png

在小語種識別上,提出的統一空間表達的半監督語音識別技術,使得只用100個小時的有監督語音和無標簽文本資料,就能達到之前10000小時有監督語音資料訓練的效果,

在語音合成上,利用無監督訓練甚至實作了發音內容、情感和音色分別可控的效果,例如1句話合成語音、方言自由切換等等……

注意,不止是普通的四川和合肥話,科大訊飛甚至開放了6種船新的少數民族語種:

1428d9d9df2359755a35e5886e620fb9.png

第三,多模態融合技術,

在人機互動上,現在甚至已經不需要喚醒詞了,機器會看到你的嘴型,從而自動判斷你“是否在對它說話”,并自動做出應答,誤喚醒率降低到0.01%

a49de5559de1a2a05243f4dabef39a8b.png

在復雜檔案(例如試卷)識別上,多模態技識訓結合OCR、手寫數學公式識別等技術,將一張紙上的所有資訊準確識別出來,已經實作教輔作業批改準確率從92%進化到98%的效果,

第四,外部知識融入技術,

我們都知道,做語音互動的AI總是有點“呆”,這是因為它們雖然學習了不少技術知識和新科技,但對人類的一些常識掌握得卻還不夠深,

為了提升AI在這方面的“人情味”,科大訊飛特意將人類的常識和知識整理成一個事理圖譜,

像兒童玩具互動場景中,就包括“搶玩具”“收拾玩具”這樣具體的動作,讓它知道人類平時會做、會說的事情,

這樣,在面對小朋友亂拋玩具時,AI就能從容說出“來收拾一下玩具”這樣的陳述句,而不是只會幫小朋友一遍遍親自收拾玩具,

9796f4da5b724768524a21d1ba3346bc.png

又例如電子病歷場景下,運用外部知識融入技術也能讓AI學習到人類醫生看病的經驗,最終將罕見病診斷率從87%提升到了93%,整體病情判斷準確率從92%提升到了95%

兩大平臺+生態助力產業

最后面向合作伙伴,科大訊飛交出自身探索成果——

兩大平臺+兩大生態

首先是企業數字化平臺的發布和虛擬人互動平臺的開放,

c106c069a54dadd1439fe53bc3212c89.png

簡單來說,這個企業數字化平臺其實是原來的AI開放平臺基礎上,配置了RPA引擎,從而具有智能化、自動化(RPA)、低代碼、流程管理等特性,

以智能招聘為例,這位“虛擬小助理”可以在前期分發資訊、電話通知等重復性作業上替代HR的作業,據稱流程至少提效10倍

除了企業數字化平臺的發布以外,還開放了虛擬人互動平臺,

值得一提的是,在傳統意義上開放給開發者外,還接受聲音、形象提供者提供相應的資料,以應用于各類應用場景,

f1456f5923911aaa5eacfb30e0bb9c7e.gif

實際上,在過去一年里,這個互動平臺已經在400+個企業客戶進行試點,應用在了新聞生產、企業客服、泛娛樂營銷等場景,新增54個形象,匯集了4988份聲音,

接著,就是科大訊飛過去一年中成績最顯著的兩大生態:教育+城市,

在教育生態上,科大訊飛今年提出了三大計劃,包括教育科研基金資助計劃,即在未來三年投入1個億的科研基金,開展前沿的理論與應用的研究;

此外合作伙伴聯合創新計劃,設立創新范訓投資基金,每年投入1億元,技術上提供300人以上的技術和市場領域的專家服務;

還有教學教研聯盟的公益計劃,預計新增建設10個區域聯合教研機構、100所名校聯盟新增合作校,推動內容共創平臺新增骨干教研員1萬名

城市生態上,據科大訊飛高級副總裁張友國表示,科大訊飛預計在2025年的智慧城市中,實作一年銷售收入150億,在“十四五”期間實作約500億收入,其中預計60%(約300億)的收入,科大訊飛都會分享給生態合作伙伴,

人工智能的未來:由表及里的生態

一天發布會下來,聽到最多的一個關鍵詞就是生態,

隨著浪潮向前,人工智能不再像此前那般是一個觸不可及的概念,而是真正貧訓于民、用之于民的全民技術,

“幫助每個人、陪伴每個人、更懂每個人”,這是科大訊飛所描述的AI未來,

而預見未來最好的方式,就是共創未來,

去年這個時候,劉慶峰在演講的最后提到,唯有生態,才能生生不息

今年開發者節上,“生態”的味道更加明晰,從技術、到產業,再到開發者從內到外全面滲透,

作為一家上市13年的老牌企業,正在用這種方式去完成人工智能產業的全面盛放,

7c0e6e38e5112ba38249e17719fac1ad.png

One More Thing

對了,在本次開發者節上,還有其他意想不到的亮點,

比如,安徽人余承東回到家鄉,在父老鄉親面前“帶貨”,(手動狗頭)

5ac4e7d3cd01824329f19516d2c3bb20.png

轉載請註明出處,本文鏈接:https://www.uj5u.com/qita/337587.html

標籤:AI

上一篇:【PyTorch基礎教程16】可視化寶藏visdom(學不會來打我啊)

下一篇:故障診斷期刊文獻分析

標籤雲
其他(157675) Python(38076) JavaScript(25376) Java(17977) C(15215) 區塊鏈(8255) C#(7972) AI(7469) 爪哇(7425) MySQL(7132) html(6777) 基礎類(6313) sql(6102) 熊猫(6058) PHP(5869) 数组(5741) R(5409) Linux(5327) 反应(5209) 腳本語言(PerlPython)(5129) 非技術區(4971) Android(4554) 数据框(4311) css(4259) 节点.js(4032) C語言(3288) json(3245) 列表(3129) 扑(3119) C++語言(3117) 安卓(2998) 打字稿(2995) VBA(2789) Java相關(2746) 疑難問題(2699) 细绳(2522) 單片機工控(2479) iOS(2429) ASP.NET(2402) MongoDB(2323) 麻木的(2285) 正则表达式(2254) 字典(2211) 循环(2198) 迅速(2185) 擅长(2169) 镖(2155) 功能(1967) .NET技术(1958) Web開發(1951) python-3.x(1918) HtmlCss(1915) 弹簧靴(1913) C++(1909) xml(1889) PostgreSQL(1872) .NETCore(1853) 谷歌表格(1846) Unity3D(1843) for循环(1842)

熱門瀏覽
  • 網閘典型架構簡述

    網閘架構一般分為兩種:三主機的三系統架構網閘和雙主機的2+1架構網閘。 三主機架構分別為內端機、外端機和仲裁機。三機無論從軟體和硬體上均各自獨立。首先從硬體上來看,三機都用各自獨立的主板、記憶體及存盤設備。從軟體上來看,三機有各自獨立的作業系統。這樣能達到完全的三機獨立。對于“2+1”系統,“2”分為 ......

    uj5u.com 2020-09-10 02:00:44 more
  • 如何從xshell上傳檔案到centos linux虛擬機里

    如何從xshell上傳檔案到centos linux虛擬機里及:虛擬機CentOs下執行 yum -y install lrzsz命令,出現錯誤:鏡像無法找到軟體包 前言 一、安裝lrzsz步驟 二、上傳檔案 三、遇到的問題及解決方案 總結 前言 提示:其實很簡單,往虛擬機上安裝一個上傳檔案的工具 ......

    uj5u.com 2020-09-10 02:00:47 more
  • 一、SQLMAP入門

    一、SQLMAP入門 1、判斷是否存在注入 sqlmap.py -u 網址/id=1 id=1不可缺少。當注入點后面的引數大于兩個時。需要加雙引號, sqlmap.py -u "網址/id=1&uid=1" 2、判斷文本中的請求是否存在注入 從文本中加載http請求,SQLMAP可以從一個文本檔案中 ......

    uj5u.com 2020-09-10 02:00:50 more
  • Metasploit 簡單使用教程

    metasploit 簡單使用教程 浩先生, 2020-08-28 16:18:25 分類專欄: kail 網路安全 linux 文章標簽: linux資訊安全 編輯 著作權 metasploit 使用教程 前言 一、Metasploit是什么? 二、準備作業 三、具體步驟 前言 Msfconsole ......

    uj5u.com 2020-09-10 02:00:53 more
  • 游戲逆向之驅動層與用戶層通訊

    驅動層代碼: #pragma once #include <ntifs.h> #define add_code CTL_CODE(FILE_DEVICE_UNKNOWN,0x800,METHOD_BUFFERED,FILE_ANY_ACCESS) /* 更多游戲逆向視頻www.yxfzedu.com ......

    uj5u.com 2020-09-10 02:00:56 more
  • 北斗電力時鐘(北斗授時服務器)讓網路資料更精準

    北斗電力時鐘(北斗授時服務器)讓網路資料更精準 北斗電力時鐘(北斗授時服務器)讓網路資料更精準 京準電子科技官微——ahjzsz 近幾年,資訊技術的得了快速發展,互聯網在逐漸普及,其在人們生活和生產中都得到了廣泛應用,并且取得了不錯的應用效果。計算機網路資訊在電力系統中的應用,一方面使電力系統的運行 ......

    uj5u.com 2020-09-10 02:01:03 more
  • 【CTF】CTFHub 技能樹 彩蛋 writeup

    ?碎碎念 CTFHub:https://www.ctfhub.com/ 筆者入門CTF時時剛開始刷的是bugku的舊平臺,后來才有了CTFHub。 感覺不論是網頁UI設計,還是題目質量,賽事跟蹤,工具軟體都做得很不錯。 而且因為獨到的金幣制度的確讓人有一種想去刷題賺金幣的感覺。 個人還是非常喜歡這個 ......

    uj5u.com 2020-09-10 02:04:05 more
  • 02windows基礎操作

    我學到了一下幾點 Windows系統目錄結構與滲透的作用 常見Windows的服務詳解 Windows埠詳解 常用的Windows注冊表詳解 hacker DOS命令詳解(net user / type /md /rd/ dir /cd /net use copy、批處理 等) 利用dos命令制作 ......

    uj5u.com 2020-09-10 02:04:18 more
  • 03.Linux基礎操作

    我學到了以下幾點 01Linux系統介紹02系統安裝,密碼啊破解03Linux常用命令04LAMP 01LINUX windows: win03 8 12 16 19 配置不繁瑣 Linux:redhat,centos(紅帽社區版),Ubuntu server,suse unix:金融機構,證券,銀 ......

    uj5u.com 2020-09-10 02:04:30 more
  • 05HTML

    01HTML介紹 02頭部標簽講解03基礎標簽講解04表單標簽講解 HTML前段語言 js1.了解代碼2.根據代碼 懂得挖掘漏洞 (POST注入/XSS漏洞上傳)3.黑帽seo 白帽seo 客戶網站被黑帽植入劫持代碼如何處理4.熟悉html表單 <html><head><title>TDK標題,描述 ......

    uj5u.com 2020-09-10 02:04:36 more
最新发布
  • 2023年最新微信小程式抓包教程

    01 開門見山 隔一個月發一篇文章,不過分。 首先回顧一下《微信系結手機號資料庫被脫庫事件》,我也是第一時間得知了這個訊息,然后跟蹤了整件事情的經過。下面是這起事件的相關截圖以及近日流出的一萬條資料樣本: 個人認為這件事也沒什么,還不如關注一下之前45億快遞資料查詢渠道疑似在近日復活的訊息。 訊息是 ......

    uj5u.com 2023-04-20 08:48:24 more
  • web3 產品介紹:metamask 錢包 使用最多的瀏覽器插件錢包

    Metamask錢包是一種基于區塊鏈技術的數字貨幣錢包,它允許用戶在安全、便捷的環境下管理自己的加密資產。Metamask錢包是以太坊生態系統中最流行的錢包之一,它具有易于使用、安全性高和功能強大等優點。 本文將詳細介紹Metamask錢包的功能和使用方法。 一、 Metamask錢包的功能 數字資 ......

    uj5u.com 2023-04-20 08:47:46 more
  • vulnhub_Earth

    前言 靶機地址->>>vulnhub_Earth 攻擊機ip:192.168.20.121 靶機ip:192.168.20.122 參考文章 https://www.cnblogs.com/Jing-X/archive/2022/04/03/16097695.html https://www.cnb ......

    uj5u.com 2023-04-20 07:46:20 more
  • 從4k到42k,軟體測驗工程師的漲薪史,給我看哭了

    清明節一過,盲猜大家已經無心上班,在數著日子準備過五一,但一想到銀行卡里的余額……瞬間心情就不美麗了。最近,2023年高校畢業生就業調查顯示,本科畢業月平均起薪為5825元。調查一出,便有很多同學表示自己又被平均了。看著這一資料,不免讓人想到前不久中國青年報的一項調查:近六成大學生認為畢業10年內會 ......

    uj5u.com 2023-04-20 07:44:00 more
  • 最新版本 Stable Diffusion 開源 AI 繪畫工具之中文自動提詞篇

    🎈 標簽生成器 由于輸入正向提示詞 prompt 和反向提示詞 negative prompt 都是使用英文,所以對學習母語的我們非常不友好 使用網址:https://tinygeeker.github.io/p/ai-prompt-generator 這個網址是為了讓大家在使用 AI 繪畫的時候 ......

    uj5u.com 2023-04-20 07:43:36 more
  • 漫談前端自動化測驗演進之路及測驗工具分析

    隨著前端技術的不斷發展和應用程式的日益復雜,前端自動化測驗也在不斷演進。隨著 Web 應用程式變得越來越復雜,自動化測驗的需求也越來越高。如今,自動化測驗已經成為 Web 應用程式開發程序中不可或缺的一部分,它們可以幫助開發人員更快地發現和修復錯誤,提高應用程式的性能和可靠性。 ......

    uj5u.com 2023-04-20 07:43:16 more
  • CANN開發實踐:4個DVPP記憶體問題的典型案例解讀

    摘要:由于DVPP媒體資料處理功能對存放輸入、輸出資料的記憶體有更高的要求(例如,記憶體首地址128位元組對齊),因此需呼叫專用的記憶體申請介面,那么本期就分享幾個關于DVPP記憶體問題的典型案例,并給出原因分析及解決方法。 本文分享自華為云社區《FAQ_DVPP記憶體問題案例》,作者:昇騰CANN。 DVPP ......

    uj5u.com 2023-04-20 07:43:03 more
  • msf學習

    msf學習 以kali自帶的msf為例 一、msf核心模塊與功能 msf模塊都放在/usr/share/metasploit-framework/modules目錄下 1、auxiliary 輔助模塊,輔助滲透(埠掃描、登錄密碼爆破、漏洞驗證等) 2、encoders 編碼器模塊,主要包含各種編碼 ......

    uj5u.com 2023-04-20 07:42:59 more
  • Halcon軟體安裝與界面簡介

    1. 下載Halcon17版本到到本地 2. 雙擊安裝包后 3. 步驟如下 1.2 Halcon軟體安裝 界面分為四大塊 1. Halcon的五個助手 1) 影像采集助手:與相機連接,設定相機引數,采集影像 2) 標定助手:九點標定或是其它的標定,生成標定檔案及內參外參,可以將像素單位轉換為長度單位 ......

    uj5u.com 2023-04-20 07:42:17 more
  • 在MacOS下使用Unity3D開發游戲

    第一次發博客,先發一下我的游戲開發環境吧。 去年2月份買了一臺MacBookPro2021 M1pro(以下簡稱mbp),這一年來一直在用mbp開發游戲。我大致分享一下我的開發工具以及使用體驗。 1、Unity 官網鏈接: https://unity.cn/releases 我一般使用的Apple ......

    uj5u.com 2023-04-20 07:40:19 more