解決的問題
現成語音不一定符合需要的音色與中文讀音;訓練完也需要能比較版本、修正發音並串接應用的介面。
實作方向
- 01以 Qwen3-TTS、CosyVoice3 與 LoRA 進行語音微調,保留 adapter 版本供試聽比較。
- 02提供參考音即時克隆與訓練聲音合成,依素材量選擇合適的使用方式。
- 03加入整詞替換與讀音修正,透過 HTTP API、MCP 串接語音生成流程。
在本機 GPU 微調語音模型,將聲音試聽、版本比較與台灣腔發音修正串成可操作的工具。


現成語音不一定符合需要的音色與中文讀音;訓練完也需要能比較版本、修正發音並串接應用的介面。