晶新聞

(左起計算語言學會簡仁宗理事長,臺灣科技大學朱瑾副校長,教育廣播電台謝忠武台長,科技部許有進次長,內政部陳茂春主秘,警察廣播電台宣介慈台長,臺灣科技大學馮輝文老師。 科技部提供)
科技
晶新聞 編輯室 綜合報導
2019-0625
科技部發布訊息,科技部今日於國立臺灣科技大學舉辦「AI語音數據資料集」上線發表會。
首批開放400小時「科技大擂台 與AI對話」競賽所使用的語音試題資料中,除了自行錄製的資料外,更結合內政部的警政署警察廣播電臺及教育部的國立教育廣播電臺提供相關語音資料,並由科技部指導、國家實驗研究院科技政策研究與資訊中心(STPI)拓建加值,成為高品質的數據集(Dataset)。
搭配這個比賽的進行,科技部建立了AI語音數據資料庫,也邀請臺北科技大學的廖元甫副教授協助語音資料的標註。由科技部來提供大家方便取得的資料,加速AI的訓練與精進。
本次釋出約400小時的「AI語音數據資料集」,可以大幅縮短發展語音過程中所需的資料標註人力和時間,降低相關技術的發展門檻。資料集在國家實驗研究院高速網路與計算中心資料集平台上架 https://scidm.nchc.org.tw/dataset/grandchallenge ,期望藉此吸引更多企業、學研機構齊力投入,共同推動我國語音AI技術躍進,協助台灣企業進行數位轉型。
同日,結合2019年語音訊號處理研討會(SPEECH PROCESSING WORKSHOP 2019),共同舉辦「科技大擂台 與AI對話」第二場賽後技術交流會,邀請Google臺灣董事總經理簡立峰分享自然語言處理與AI未來趨勢的看法、Taiwan AI Labs創辦人杜奕瑾、臺灣大學資訊工程學系教授,同時也是臺灣AI獨角獸沛星互動科技(Appier)首席科學家林軒田博士等,發表目前在AI與語音訊號處理的前瞻研究成果。另外,第一屆「與AI對話」的獲獎團隊:臺灣大學電資學院、華碩電腦、中央研究院等代表也應邀出席,和大家分享參賽經歷及比賽中使用的秘技。