Wisdom Lab Tech
登入
← 回到產品總覽
WS

Wisdom Singer X

零樣本高品質歌聲合成與轉換 — 本機推論,不必先寫歌詞或 MIDI

開發中音訊 AI

產品介紹

Wisdom Singer X 在本機做歌聲工作:用 Prompt 音色唱 Target 旋律(合成),或做音訊到音訊的零樣本歌聲轉換。可人聲分離、自動變調、把人聲混回伴奏。輕量約 2.8 GB 即可跑轉換;完整模式再加合成與自動轉錄。步數、CFG 與種子可調。繁中/English,一鍵啟動。

適合試聲線、翻唱草稿與後期替換主唱。男女聲或不同調的 demo 可自動靠向目標音高,也可手動指定半音。素材不出機。

建議 GPU。以下按轉換、合成與本機推論說明。

Wisdom Singer X

主要特色

  • 零樣本歌聲轉換:Prompt 音色 + Target 旋律,不必歌詞或 MIDI
  • 完整模式可做歌聲合成與自動轉錄;輕量模式只跑轉換
  • 人聲分離、自動變調、伴奏混合,步數/CFG/種子可調
  • 本機推論約 2.8 GB 起;繁中/English 一鍵啟動

系統需求

  • Python 3.10+、CUDA/MPS GPU(建議)
  • macOS / Windows / Linux

功能一覽

依模組列出此產品的每一項能力。

歌聲轉換

零樣本 SVC

上傳 Prompt 音色與 Target 旋律,不必先寫歌詞或 MIDI,即可做音訊到音訊的歌聲轉換。適合試聲線、翻唱草稿與後期替換主唱。

人聲分離與自動伴奏混合

可對 Prompt 或 Target 做人聲分離,轉換後自動把人聲混回伴奏。少開一輪外部分離軟體。

自動變調

自動把音高靠向目標,也可手動指定半音。男女聲或不同調的 demo 不必先在 DAW 裡對調。

歌聲合成

SVS:音色唱指定旋律

完整模式用 Prompt 音色去唱 Target 旋律,適合還沒錄主唱、但已經有導唱或 MIDI 概念的製作。

自動轉錄

完整模式可自動轉旋律資訊,減少手工對譜。輕量模式略過這段,只跑轉換以節省磁碟與時間。

本機推論

輕量與完整

輕量約 2.8 GB 即可跑 SVC;完整再加 SVS 與轉錄。筆電先轉聲,工作站再開完整能力。

採樣與 CFG

步數、CFG、種子可調,方便重現同一版或提高貼合度。全部在本機跑,人聲素材不必上傳。

雙語工作室

繁中/English 切換,一鍵啟動。建議 CUDA 或 Apple GPU;三平台都可。