音訊降噪 · 清走錄音入面嘅背景雜音
拖一段人聲錄音入嚟,語音降噪模型會將壓喺人聲下面嘅風扇聲、嘶嘶聲、電流聲同車聲挑走。之後你自己決定留返幾多環境聲,前後對住聽,再匯出 WAV、MP3 或者 M4A。免費、喺瀏覽器行,唔會上傳。
錄音喺你部機度處理,唔會上傳。
將錄音拖入嚟
或者撳一下喺裝置度揀個檔案
MP3、WAV、M4A、AAC、OGG、Opus、FLAC,仲有 MP4、MOV、WebM 影片
入片,出音訊 · 最多 200 MB,或者 60 分鐘
點樣將一段錄音清乾淨
三步,全部喺瀏覽器入面搞掂
放錄音入去
拖 MP3、WAV、M4A、OGG 或者 FLAC 入嚟,MP4、MOV、WebM 都得——片入去,出返嚟係純音訊。最大 200 MB,直接由硬碟讀。
俾模型聽一次
一個喺人聲上面訓練過嘅網絡,以十毫秒做一格逐格掃晒成個檔案,將佢認得出嘅穩定背景聲拎走。進度條會話你知去到邊,隨時可以停。
對比、微調、儲存
喺同一個時間點來回切換原聲同降噪版,拉「降噪強度」滑桿拉到啱聽為止,再匯出 WAV、MP3 或者 M4A。
FAQ
常見問題
穩定、變化唔大嘅背景聲:風扇、冷氣、磁帶嘶嘶聲、電流嗡嗡聲、窗外持續嘅車聲、角落部電腦,仲有講嘢下面嗰啲鍵盤聲。呢啲聲嘅「形狀」模型學得到,所以減得走。一次性嘅聲響就弱好多——閂門、咳、櫈拖地——背景有另一個人講嘢就更加分唔開,因為喺模型眼中嗰啲一樣係人聲。
係。唔使註冊、唔使綁卡、冇每日幾分鐘嘅額度,出嚟嘅檔案亦冇浮水印或者語音提示。模型喺你自己部機行,我哋冇伺服器時間要收你錢。想一次過處理十個檔案都得。
唔會。檔案直接由硬碟讀出嚟,由瀏覽器解碼,再交俾分頁入面嘅 WebAssembly 降噪模型處理。你可以自己驗:開開發者工具轉去 Network,處理一次就見到——第一次會下載模型,而你嘅錄音邊度都冇去過。
唔可以,呢點講白啲好過:模型係喺人聲上面訓練,唔似人聲嘅嘢喺佢眼中全部都係雜音。攞去搞歌,銅鈸會變薄、殘響會被掏空、長音會被啃到毛毛哋。佢啱做訪問、語音備忘、講座、播客、旁白——唔啱你手上嗰首歌。如果素材本身有音樂,只係想淡一淡環境聲,將「降噪強度」拉到 40 至 50 再細心聽。
佢係原聲同降噪版之間嘅混合比例,唔係叫模型再行多次——所以拉起上嚟係即時嘅。拉到 100% 就係模型肯拎走嘅全部,有啲人聲喺嗰度會變得單薄、好似隔住水。「留返少少環境聲」呢個預設停喺 85%,會留返薄薄一層原本嘅房間聲:句同句之間完全死寂反而唔自然,而少少底噪亦可以冚住模型開開合合嘅痕跡。另外仲有個 80 Hz 嘅輕力濾波,壓枱震同低頻轟鳴,預設係熄嘅。
MP3、WAV、M4A、AAC、OGG、Opus、FLAC,另外仲有 MP4、MOV、WebM 影片。收片係故意嘅——手機影嘅講嘢片正正係最多人要降噪嘅素材——但出返嚟淨係音訊。你攞到嘅係一個音訊檔,唔係換咗聲軌嘅片。
最大 200 MB 或者 60 分鐘。真正嘅樽頸係記憶體,唔係檔案大細:所有音訊都會解成 48 kHz 浮點,每聲道每分鐘大約 11 MB,而個工具同時揸住原聲、降噪版同混合結果三份。十分鐘嘅訪問喺手提電腦好輕鬆;過咗十五分鐘就會見到提示,值得先閂咗其他分頁。處理本身比你由頭聽一次快好多。
用得,任何新啲嘅手機瀏覽器都得——模型好細,大約一兆,只下載一次。不過檔案要比電腦上短啲:手機記憶體少好多,一段長嘅立體聲錄音可能頂爆個分頁。如果仲想要 MP3 而唔係 WAV,嗰步會拉一個 31 MB 嘅音訊引擎(只下一次);WAV 就乜都唔使等,降完噪即刻可以儲。