🖥️ 先認識這個介面
這是 CosyVoice WebUI 主畫面,重點欄位:
- 🔘 選擇推理模式:預訓練音色 / 3s極速復刻 / 跨語種複刻 / 自然語言控制
- 📝 輸入合成文本:你要它念出來的台詞
- 📤 選擇prompt音頻文件:上傳你要複製的聲音
- 📄 輸入prompt文本:參考音檔「實際講了什麼」
- ⚡ 速度調節 / 🎲 隨機推理種子
- ▶️ 生成音頻 按鈕 → 🔊 合成音頻 輸出
手把手教你:置入參考聲線 & 產出不同情緒的語音
非工程師版 — 照著介面一步一步點就會
這是 CosyVoice WebUI 主畫面,重點欄位:
想複製某個人的聲音來念你的台詞,照這 7 步做:
方法 A:用標點 + 速度 + 種子(同一聲線做出不同情緒)
| 情緒 | 合成文本(標點) | 速度 |
|---|---|---|
| 興奮 | Blanka, Bomb! | 1.05 |
| 低沉厚重 | Blanka... Bomb. | 0.88 |
| 誇張 | Blanka!! Bomb!! | 1.10 |
| 驚喜 | Blanka?! Bomb! | 1.0 |
方法 B:用「自然語言控制」直接描述情緒
| 模式 | 用途 | 什麼時候用 |
|---|---|---|
| 預訓練音色 | 用系統內建的現成聲音 | 只要快速產出、用內建聲線 |
| 3s極速復刻 | 上傳一段音檔就複製那個人的聲音 | 要做客製聲線(最常用) |
| 跨語種複刻 | 參考音檔是A語言,生成B語言 | 複製聲音但要換語言(中文參考→念英文) |
| 自然語言控制 | 用文字描述情緒/風格 | 要精細指定表演感 |
保存音色模型 / 輸入新的音色名稱 是做什麼的?
→ 把「複製好的聲線」存成一個音色,下次不用再上傳參考音檔。
存起來:
下次重複用:
置入參考聲線(3s極速復刻)→ 調整情緒(標點/速度/種子 或 自然語言控制)→ 生成 → 試聽 → 下載
掌握這套流程,就能用任何聲線產出各種情緒的遊戲語音 🎙️