跳至主要內容
Mark Ku's Blog
回到地端作品

AI Podcast Cut

開源

用本機模型辨識語音並協助移除贅字、口吃,保留可逐段試聽的剪輯接縫。

作品封面

AI Podcast Cut作品介紹素材(非操作截圖)
AI Podcast Cut作品介紹素材(非操作截圖)點擊圖片可查看原尺寸

解決的問題

Podcast 清理需要兼顧口語節奏、呼吸與音量,不能只把靜音全部裁掉。

實作方向

  1. 01用 faster-whisper 取得語音辨識結果。
  2. 02整合 demucs 人聲分離、音量處理與 ffmpeg 輸出。
  3. 03在本機檢查剪輯接縫,確認後再輸出。