99久久国产宗和精品1上映,四虎精品成人免费视频

大數(shù)據(jù)

作者：李亞洲

近日，來自 Fraunhofer IDMT、Tampere University of Technology 與蒙特利爾大學(xué)的 Yoshua Bengio 等人在 arXiv 上提交了一篇論文，提出跳過使用泛化維納濾波器進行后處理的步驟，轉(zhuǎn)而使用循環(huán)推斷算法和稀疏變換步驟進行歌唱語音分離，效果優(yōu)于之前基于深度學(xué)習(xí)的方法。這篇論文已經(jīng)提交至 ICASSP 2018。論文：Monaural Singing Voice Separation with Skip-Filtering Connections and Recurrent Inference of Time-Frequency Mask

論文鏈接：https://arxiv.org/abs/1711.01437v1on-line demo 地址：https://js-mim.github.io/mss_pytorch/GitHub 地址：https://github.com/Js-Mim/mss_pytorch

摘要：基于深度學(xué)習(xí)的歌唱語音分離依賴于時頻掩碼（time-frequency masking）。在很多情況中，掩碼過程（masking process）不是一個可學(xué)習(xí)的函數(shù)，也無法封裝進深度學(xué)習(xí)優(yōu)化中。這造成的結(jié)果就是，大部分現(xiàn)有方法依賴于使用泛化維納濾波器（generalized Wiener filtering）進行后處理。我們的研究提出一種方法，在訓(xùn)練過程中學(xué)習(xí)和優(yōu)化源依賴掩碼（source-dependent mask），無需上述后處理步驟。我們引入了一種循環(huán)推斷算法、一種稀疏變換步驟用于改善掩碼生成流程，以及一個學(xué)得的去噪濾波器。實驗結(jié)果證明，與之前單聲道歌唱語音分離的頂尖方法相比，該方法使信號失真比（signal to distortion ratio）提高了 0.49 dB，信號干擾比（signal interference ratio）提高了 0.30 dB。

圖 1：方法圖示。

大數(shù)據(jù)

表 1：幾種方法的中值信號失真比（SDR）和信號干擾比（SIR）（單位為 dB）。下劃線為我們提出的方法。值越高效果越好。

結(jié)論

本論文中，Bengio 等人展示了一種用于歌唱語音分離的方法，無需使用泛化維納濾波器進行后處理。研究人員向跳過濾波的連接 [12] 引入了稀疏變換，效果優(yōu)于使用泛化維納濾波器的方法。此外，實驗證明引入的循環(huán)推斷算法（recurrent inference algorithm）在單聲道語音分離中取得了頂尖的結(jié)果。實驗結(jié)果證明這些擴展優(yōu)于之前用于歌唱語音分離的深度學(xué)習(xí)方法。

免責(zé)聲明：本網(wǎng)站內(nèi)容主要來自原創(chuàng)、合作伙伴供稿和第三方自媒體作者投稿，凡在本網(wǎng)站出現(xiàn)的信息，均僅供參考。本網(wǎng)站將盡力確保所提供信息的準(zhǔn)確性及可靠性，但不保證有關(guān)資料的準(zhǔn)確性及可靠性，讀者在使用前請進一步核實，并對任何自主決定的行為負責(zé)。本網(wǎng)站對有關(guān)資料所引致的錯誤、不確或遺漏，概不負任何法律責(zé)任。任何單位或個人認為本網(wǎng)站中的網(wǎng)頁或鏈接內(nèi)容可能涉嫌侵犯其知識產(chǎn)權(quán)或存在不實內(nèi)容時，應(yīng)及時向本網(wǎng)站提出書面權(quán)利通知或不實情況說明，并提供身份證明、權(quán)屬證明及詳細侵權(quán)或不實情況證明。本網(wǎng)站在收到上述法律文件后，將會依法盡快聯(lián)系相關(guān)文章源頭核實，溝通刪除相關(guān)內(nèi)容或斷開相關(guān)鏈接。

無需進行濾波后處理，利用循環(huán)推斷算法實現(xiàn)歌唱語音分離

結(jié)論

下一篇

無需進行濾波后處理，利用循環(huán)推斷算法實現(xiàn)歌唱語音分離

結(jié)論

下一篇

無需進行濾波后處理，利用循環(huán)推斷算法實現(xiàn)歌唱語音分離