Rev
把錄音與影片轉成文字,提供 AI 或人工逐字稿服務
🤔 勉強可以
AI 轉錄能自刻,人工校稿才是門檻
月費(約)
未知
一年省下
—
自己刻要多久
好幾天
幾個人做得出來
一個人
分類
📱 生產力
價格為約略值,以官網為準。Rev 主要採 AI 或人工逐分鐘計費,沒有明確的個人月費方案;價格依音檔長度與服務類型計算
護城河
判決理由
本機上傳音檔、呼叫 Whisper 轉錄、分段時間軸、搜尋文字與匯出 TXT、SRT、VTT,幾天內就能做出自用版。刻不出來的是 Rev 的人工逐字稿流程、穩定交件與特殊口音校稿;AI 版本則可用開源模型逼近,但長音檔切段、說話者辨識和錯誤修正仍要自己維護。
為什麼大家還是付錢
付費主要買準確率、人工校稿、快速交件與不用管理轉錄環境。偶爾處理訪談或會議,自刻 AI 版通常更便宜;正式內容才值得交給 Rev。
建置 prompt
複製下面這段,丟給你的 AI coding 工具,讓它替你刻一個自用版。
目標:做一個本機優先的錄音與影片轉錄工具,使用開源語音模型產生可搜尋、可校正、可匯出的逐字稿。
技術棧建議:Python FastAPI + SQLite + faster-whisper,前端使用原生 HTML、CSS、JavaScript,媒體處理使用 FFmpeg。
需求:
- 從本機匯入 MP3、WAV、M4A、MP4、MOV 等常見音訊與影片格式
- 使用 faster-whisper 在本機轉錄,提供模型大小與語言選擇
- 長檔案自動切段處理,顯示轉錄進度、目前片段與失敗重試狀態
- 逐句儲存開始時間、結束時間與文字內容
- 播放媒體時同步高亮目前句子,點擊文字可跳到對應時間
- 支援全文搜尋,搜尋結果可直接跳轉到音檔時間點
- 提供逐字稿編輯器,可修改文字、合併句子與調整時間軸
- 嘗試以聲音特徵分辨說話者,並允許手動重新命名說話者
- 支援匯出 TXT、Markdown、SRT、VTT 與 JSON
- 保留原始檔案路徑、模型名稱、語言與轉錄時間等 metadata
- 可刪除轉錄資料與快取檔,且不影響原始媒體檔
- 提供拖放匯入、批次轉錄與已完成檔案清單
明確不做(out of scope):人工校稿服務、雲端同步、多人協作、手機 App、付費 API、DRM 破解、保證法律或出版用途的逐字稿準確率。
README 要求:說明本機安裝與 FFmpeg 設定、模型下載方式、CPU 與 GPU 需求、支援格式、資料庫位置、匯出格式與如何搬走所有資料。
「用 Claude Code 開啟」複製的是 claude "<prompt>",貼進終端機即可;
Codex、Cursor、Copilot 等工具直接用左邊的複製鈕貼進對話框。
免費 / 開源替代
- Whisper 開源
OpenAI 開源語音轉文字模型,可在本機處理多種語言音檔。 - Buzz 開源
桌面版 Whisper 轉錄工具,支援匯入媒體與匯出字幕檔。 - MacWhisper 免費增值
macOS 本機轉錄工具,主打 Whisper 模型與字幕匯出。
替代品由 AI 依公開資訊列出,尚未逐一連線驗證(unverified),請自行確認是否仍在維護。
這個判決會隨模型進步翻盤:今天的「勉強可以」很可能半年後變成「可以刻」。
判決依 rubric v1.0.0 於 2026-08-31 生成。