Synthesia
把文字稿變成有 AI 虛擬人物、配音與字幕的教學影片
💸 別刻,付錢
模型和授權才是護城河,付錢比較省事
月費(約)
$29
約 NT$928
一年省下
$348/年
自己刻要多久
好幾週
幾個人做得出來
三人以上
分類
🎬 影音
價格為約略值,以官網為準。個人入門 Basic 方案月繳約 29 美元;年繳通常較低
護城河
判決理由
文字稿編輯、場景切換、字幕和影片匯出都刻得出來,但 Synthesia 的核心是高擬真虛擬人物、口型同步、多語配音與穩定的大量渲染。你可以用自己的照片、Piper 語音合成和開源口型模型做出私人版,卻很難複製商用人物授權、聲音品質和各語言的一致性。
為什麼大家還是付錢
企業付的是不用拍攝、不用找主持人、可直接產出多語教學影片的流程,以及合規的人物與聲音授權。偶爾做幾支片的人,自己組開源工具比較划算。
建置 prompt
複製下面這段,丟給你的 AI coding 工具,讓它替你刻一個自用版。
目標:做一個本機優先的 AI 虛擬人物影片製作工具,把文字稿、聲音和人物影像合成教學短片。
技術棧建議:Python FastAPI + SQLite + FFmpeg;前端使用 React;語音採 Piper,本機人物動畫採 LivePortrait 或其他可替換的開源模型。
需求:
- 建立專案並輸入標題、語言、畫面比例與輸出解析度
- 以區塊方式編輯文字稿,每個區塊可設定停留秒數
- 匯入使用者合法擁有的人物照片或短片作為虛擬人物素材
- 讓每個文字稿區塊選擇人物素材、背景色或背景圖片
- 使用本機 TTS 產生語音,支援調整語速、音高與音量
- 依語音長度自動產生人物口型動畫或簡單嘴型同步片段
- 自動產生字幕,支援 SRT 匯出與字幕樣式設定
- 時間軸可預覽每個場景,支援拖曳排序、複製與刪除
- 使用 FFmpeg 合成影片、語音、背景音樂與字幕
- 支援 MP4 預覽與下載,保留每次輸出的設定檔
- 可匯入與匯出專案 JSON、文字稿、字幕和媒體檔案清單
- 管理本機素材庫,顯示檔案格式、尺寸、時長與使用中的專案
明確不做(out of scope):雲端協作、商用虛擬人物授權、真人聲音仿製、線上模型 API、批次大量渲染、企業權限與品牌管理。
README 要求:說明本機安裝、模型下載、FFmpeg 設定、可支援的音訊與影片格式、人物素材授權責任、專案匯出與備份方式。
「用 Claude Code 開啟」複製的是 claude "<prompt>",貼進終端機即可;
Codex、Cursor、Copilot 等工具直接用左邊的複製鈕貼進對話框。
免費 / 開源替代
- HeyGen 免費增值
同類 AI 虛擬人物影片服務,有免費額度但輸出與功能受限。 - LivePortrait 開源
開源人物肖像動畫模型,可作為本機虛擬人物合成基礎。 - Piper 開源
本機語音合成工具,適合替自製影片產生旁白。
替代品由 AI 依公開資訊列出,尚未逐一連線驗證(unverified),請自行確認是否仍在維護。
這個判決會隨模型進步翻盤:今天的「勉強可以」很可能半年後變成「可以刻」。
判決依 rubric v1.0.0 於 2026-08-31 生成。