ElevenLabs
把文字轉成自然語音,也能複製聲音並支援多語言配音。
🤔 勉強可以
語音能刻,自然度和聲音庫刻不出來
月費(約)
$5
約 NT$160
一年省下
$60/年
自己刻要多久
好幾天
幾個人做得出來
兩個人
分類
🎬 影音
價格為約略值,以官網為準。Starter 個人方案月費 5 美元,以月繳價格估算
護城河
判決理由
文字轉語音、音檔匯出、語速音調控制,接 Piper、XTTS 或其他開源模型,好幾天就能做出自用版。聲音複製也能接現成模型,但自然停頓、情緒表現、多語言穩定度和低延遲體驗會差一截。ElevenLabs 的專有模型、預訓練聲音庫與授權聲音,不是靠刻介面就能複製。
為什麼大家還是付錢
付費買的是接近真人的聲音品質、現成多語言聲音、快速生成和穩定 API。做影片旁白或商業內容時,少修幾次音檔就足以抵掉月費。
建置 prompt
複製下面這段,丟給你的 AI coding 工具,讓它替你刻一個自用版。
目標:做一個本機優先的文字轉語音工具,把文字生成可匯出的旁白音檔。
技術棧建議:Python FastAPI + SQLite + React 或純 HTML/JS;語音引擎採用 Piper,可選接 XTTS-v2,音檔使用 WAV 與 MP3。
需求:
- 提供文字輸入區,支援純文字與 Markdown 檔案匯入
- 列出本機可用語音模型,可依語言與聲線篩選
- 支援語速、音量、音調與句間停頓設定
- 將長文依段落切分,逐段生成並依原順序合併
- 顯示每段生成進度、耗時、錯誤訊息與重試按鈕
- 生成前可預覽單一段落,生成後提供播放、暫停與進度拖曳
- 支援 WAV、MP3 匯出,檔名包含專案名稱與生成日期
- 儲存文字、語音設定、生成音檔路徑與建立時間
- 專案清單支援搜尋、重新生成與刪除
- 可匯入自己的合法語音模型資料夾並建立模型索引
- 提供批次匯出專案 metadata 為 JSON,音檔可一併複製到指定資料夾
- 以本機佇列限制同時生成工作,避免記憶體被大量任務耗盡
明確不做(out of scope):雲端 API、多人帳號、線上聲音市集、未經同意的聲音複製、即時語音轉換、商用授權管理與手機 App。
README 要求:說明安裝與模型下載步驟、支援語音格式、GPU 與 CPU 執行差異、合法聲音使用界線、專案與音檔位置及匯出方式。
「用 Claude Code 開啟」複製的是 claude "<prompt>",貼進終端機即可;
Codex、Cursor、Copilot 等工具直接用左邊的複製鈕貼進對話框。
免費 / 開源替代
- Piper 開源
輕量本機神經語音引擎,離線執行快,適合做自用旁白。 - Coqui TTS 開源
開源文字轉語音工具箱,模型選擇多,也支援語音複製。 - Kokoro 開源
參數較小的高品質開源 TTS 模型,適合本機生成語音。
替代品由 AI 依公開資訊列出,尚未逐一連線驗證(unverified),請自行確認是否仍在維護。
這個判決會隨模型進步翻盤:今天的「勉強可以」很可能半年後變成「可以刻」。
判決依 rubric v1.0.0 於 2026-08-31 生成。