雅婷逐字稿
把錄音檔轉成帶時間戳的繁體中文逐字稿,方便搜尋與匯出
🤔 勉強可以
轉錄核心能自己刻,台灣口音再慢慢調
月費(約)
未知
一年省下
—
自己刻要多久
一個週末
幾個人做得出來
一個人
分類
📱 生產力
價格為約略值,以官網為準。官方方案可能依錄音分鐘數或點數計費,未可靠確認固定月費;請以官網現行定價為準
護城河
判決理由
錄音上傳、語音轉文字、時間戳、搜尋、段落編輯與 TXT、SRT、VTT 匯出,都能用 Whisper 或 faster-whisper 在本機刻出自用版。比較難的是台灣口音、多人同時說話、台語與專有名詞的辨識精度,以及服務商已打磨好的錯誤處理和操作流程;但個人可用自己的詞彙表補強。
此筆套用了決定性規則覆寫:
規則說明見 方法。
為什麼大家還是付錢
付錢是為了省安裝與轉檔等待時間,直接把檔案丟上去就拿到結果。若錄音內容敏感,或每月用量不高,本機處理更值得。
建置 prompt
複製下面這段,丟給你的 AI coding 工具,讓它替你刻一個自用版。
目標:做一個本機優先的繁體中文錄音逐字稿工具,將合法取得的音檔轉成可編輯、可搜尋、可匯出的文字。
技術棧建議:Python + faster-whisper + SQLite,後端用 FastAPI,前端用簡單 HTML、CSS、JavaScript;有 NVIDIA 顯示卡時支援 CUDA,沒有時使用 CPU。
需求:
- 支援 MP3、M4A、WAV、MP4、WebM 等常見音訊與影片檔
- 可選 Whisper 模型大小與運算裝置,顯示轉錄進度與預估剩餘時間
- 將音檔轉成繁體中文逐字稿,保留每段的開始與結束時間
- 支援自訂詞彙表,讓人名、公司名、產品名優先採用指定寫法
- 將過於冗長的連續文字依標點符號切成可閱讀段落
- 逐字稿編輯器可直接修改文字,點擊段落可跳到對應音訊位置
- 提供關鍵字搜尋,搜尋結果可跳轉到對應段落與時間戳
- 可選擇啟用或停用基本的說話者分段,並允許手動修改說話者名稱
- 支援產生 TXT、Markdown、SRT、VTT 與 JSON 檔案
- 可匯入既有逐字稿並重新對應音檔時間戳
- SQLite 儲存檔案 metadata、轉錄設定、詞彙表與編輯後內容
- 提供刪除專案與原始音檔的操作,避免敏感錄音長期留在本機
- 將所有專案 metadata 與逐字稿匯出成單一 ZIP 檔
明確不做(out of scope):雲端帳號與多人協作、付費 API、未授權內容下載、保證法律效力的會議紀錄、即時直播轉錄、完整台語專用模型訓練。
README 要求:說明本機安裝與模型下載方式、CPU 與 GPU 執行指令、支援格式、詞彙表格式、資料庫位置、匯出與刪除資料方式,並註明錄音內容應自行確認授權。
「用 Claude Code 開啟」複製的是 claude "<prompt>",貼進終端機即可;
Codex、Cursor、Copilot 等工具直接用左邊的複製鈕貼進對話框。
免費 / 開源替代
- Whisper 開源
OpenAI 開源語音辨識模型,可在本機轉錄多種語言。 - faster-whisper 開源
Whisper 的高效率實作,適合本機批次轉錄與 GPU 執行。 - Buzz 開源
桌面語音轉文字工具,支援 Whisper、本機轉錄與多種匯出格式。
替代品由 AI 依公開資訊列出,尚未逐一連線驗證(unverified),請自行確認是否仍在維護。
這個判決會隨模型進步翻盤:今天的「勉強可以」很可能半年後變成「可以刻」。
判決依 rubric v1.0.0 於 2026-08-31 生成。