AI應用
智慧製造

AI聲音處理 – SONA 音訊處理API平台

建議價格
專案方案 依實際需求提供客製化報價 專案價
產品介紹
迪威的音訊處理API平台,SONA(Sound and Noise Analysis)的優勢在於提供一個集成的AI聲音處理平台,讓客戶可以選用並且大幅縮短AI模型部署時間,從3-5天縮短至3-5小時,讓一般能串接API的使用者均能使用。

提供易於部署使用的模型如下,模型仍持續上線中,目前提供 降噪、人聲樂聲分離、語音轉文字、語者分段等API。

API是什麼?
API是應用程式介面,Application Programming Interface 的簡稱,常聽到「 API串接」,用意就是讓兩套不同的軟體的資料可以互相傳送,減輕開發者的工作。
特色說明
01
降噪 API
提供即時、後處理及雲端、地端等多種服務組合,讓背景噪音不再成為麻煩
02
人聲樂曲分離 API
如同卡拉ok,快速分離歌聲與樂曲,讓樂曲解析與應用有更多可能
03
語者分段 API
直接從音訊內容中辨識出語者,讓長音檔的內容解析能更好地做到後處理
04
人聲轉換 API
將歌聲或對話,進行【人】聲音的轉換或組合,為聲音生成提供更多運用場景
成功應用案例
共 3 則案例
降噪目前也建置為迪威智能的線上服務Noise Eraser,提供影音創作者、製作團隊快速有效的AI降噪服務,不受限於技術、更聚焦在作品上
音訊AI產品化,滿足各式音訊處理情境
樂曲分離也與驊訊電子進一步合作,透過模型只要20秒內即可分離一首歌的人聲與音樂聲,而且不限語言。可以協助提升當前MV伴唱帶的工作流程,加速製作流程約30分鐘。
與驊訊電子合作:樂聲分離不限語言製作
語者分段有效導入API至富邦金控的私有雲環境中,有效分辨出語者人數,並能標記出語者說話區段時間起始點與結束點;進而協助具有人聲語音之影音內容,簡化找出各個區段為哪個語者。此將大幅簡化富邦金控內部會議之語者分段流程,提高後續會議內容知識管理之效率。
AI會議紀錄如何提高金融業知識效率