Happy Scribe
把音訊或影片轉成逐字稿、字幕,並提供線上編輯與匯出
🔨 可以刻
本機 Whisper 加字幕編輯就夠自己用
月費(約)
未知
一年省下
—
自己刻要多久
一個週末
幾個人做得出來
一個人
分類
📱 生產力
價格為約略值,以官網為準。Happy Scribe 依訂閱方案與逐字稿分鐘數計價,2026 年個人入門月費未能可靠確認;
護城河
判決理由
音檔上傳、語音轉文字、時間軸字幕、逐字稿編輯與 SRT/VTT 匯出,接 Whisper 或 faster-whisper 一個週末就能做出自用版。真正較難的是多語言辨識的穩定度、說話者分離、長檔案佇列、團隊審稿與大量格式整合,但個人處理訪談或影片時可以先放棄這些。
為什麼大家還是付錢
付費買的是免安裝的託管流程、穩定的多語言品質、人工校對選項和團隊協作。若檔案不多、能接受本機跑模型,月費很難回本。
建置 prompt
複製下面這段,丟給你的 AI coding 工具,讓它替你刻一個自用版。
目標:做一個本機優先的影音逐字稿與字幕工具,將合法擁有的音訊或影片轉成可編輯文字並匯出。
技術棧建議:Python FastAPI + faster-whisper + ffmpeg,SQLite 儲存專案資料,前端使用 React 或純 HTML/JS。
需求:
- 支援拖曳上傳 mp3、wav、m4a、mp4、mov、webm 檔案
- 使用 ffmpeg 抽取音訊,讓使用者選擇 Whisper 模型與辨識語言
- 將音訊切成合理長度的片段,顯示轉錄進度與失敗原因
- 產生含開始時間與結束時間的逐字稿片段
- 逐字稿編輯器可修改文字、合併片段、拆分片段與調整時間軸
- 播放器支援播放、暫停、跳到片段、播放速度調整與目前片段跟隨
- 支援自動標點與繁體中文輸出,保留原始辨識結果供比較
- 提供說話者標記欄位,讓使用者手動將片段標成不同說話者
- 匯出純文字、Markdown、SRT、VTT 與 JSON
- 可重新開啟既有專案,原始檔路徑失效時顯示明確提示
- 專案清單顯示檔名、語言、建立時間、處理狀態與字幕片段數
- 提供刪除專案、刪除暫存音訊與匯出完整專案資料的操作
明確不做(out of scope):雲端帳號與同步、多人協作、人工逐字稿服務、即時直播轉錄、付費模型 API、版權內容下載、翻譯與影片燒錄字幕。
README 要求:說明本機安裝、ffmpeg 與模型下載方式、支援格式、硬體需求、專案資料位置、匯出與備份方式。
「用 Claude Code 開啟」複製的是 claude "<prompt>",貼進終端機即可;
Codex、Cursor、Copilot 等工具直接用左邊的複製鈕貼進對話框。
免費 / 開源替代
- Whisper 開源
OpenAI 開源語音辨識模型,可本機轉錄多種語言音訊。 - Subtitle Edit 開源
成熟的字幕編輯器,支援波形、時間軸與多種字幕格式。 - Buzz 開源
以 Whisper 為核心的桌面轉錄工具,支援字幕與文字匯出。
替代品由 AI 依公開資訊列出,尚未逐一連線驗證(unverified),請自行確認是否仍在維護。
這個判決會隨模型進步翻盤:今天的「勉強可以」很可能半年後變成「可以刻」。
判決依 rubric v1.0.0 於 2026-08-31 生成。