New Relic
收集應用程式與基礎設施指標、日誌、追蹤和錯誤事件
🤔 勉強可以
監控能刻,託管與整合才是成本
月費(約)
免費增值
一年省下
—
自己刻要多久
好幾天
幾個人做得出來
兩個人
分類
🛠️ 開發工具
價格為約略值,以官網為準。Free 免費方案為 0 美元;付費方案依資料量、使用者與功能計費
護城河
判決理由
應用程式錯誤追蹤、HTTP 延遲、主機指標、日誌搜尋與告警規則,都能用 OpenTelemetry 加資料庫刻出自用版。難的是長期保存大量遙測資料、跨服務追蹤、代理程式相容性、權限管理,以及數百種雲端與開發工具整合。小團隊可縮成 Grafana 加 Prometheus,功能夠用但維護要自己扛。
為什麼大家還是付錢
付費買的是免維護的資料收集管線、集中式查詢、告警可靠度與整合現成度。出了問題時,少花幾小時查監控,通常就值得月費。
建置 prompt
複製下面這段,丟給你的 AI coding 工具,讓它替你刻一個自用版。
目標:做一個本機優先的自用應用程式可觀測性面板,收集指標、日誌、追蹤與錯誤事件。
技術棧建議:OpenTelemetry Collector + Prometheus + Loki + Tempo + Grafana,使用 Docker Compose,資料留在本機磁碟。
需求:
- 提供 Docker Compose 一鍵啟動 Grafana、Prometheus、Loki、Tempo 與 OpenTelemetry Collector
- 提供 Python FastAPI 與 Node.js Express 的最小範例,示範自動產生指標、日誌與分散式追蹤
- 收集 HTTP 請求數、錯誤數、延遲百分位數、程序記憶體與 CPU 使用量
- 支援依服務名稱、環境、路由與狀態碼篩選資料
- 在 Grafana 建立服務總覽儀表板,顯示流量、錯誤率與 p50/p95/p99 延遲
- 建立日誌搜尋頁,支援關鍵字、時間範圍與結構化欄位查詢
- 建立追蹤查詢頁,可從服務、操作名稱與錯誤狀態找 trace
- 提供錯誤事件摘要,依例外類型、服務與版本分組
- 支援告警規則:錯誤率、延遲、主機資源與服務無心跳
- 告警先寫入本機事件紀錄,並可選擇透過 SMTP 寄送通知
- 設定資料保留天數與磁碟用量上限,超過時自動清理舊資料
- 提供健康檢查、備份與還原腳本
- 可將查詢結果與錯誤事件匯出為 JSON 或 CSV
明確不做(out of scope):全球託管、多人帳號與權限、商用等級 SLA、數百種第三方整合、永久保存遙測資料、行動 App。
README 要求:說明各元件用途、啟動與停止指令、OpenTelemetry 設定、儀表板匯入方式、資料位置、備份還原、保留政策與匯出格式。
「用 Claude Code 開啟」複製的是 claude "<prompt>",貼進終端機即可;
Codex、Cursor、Copilot 等工具直接用左邊的複製鈕貼進對話框。
免費 / 開源替代
- Grafana 開源
開源可觀測性介面,能整合多種指標、日誌與追蹤資料。 - Prometheus 開源
開源時間序列監控工具,適合收集指標與設定告警。 - SigNoz 開源
開源 OpenTelemetry 可觀測性平台,整合指標、日誌與追蹤。 - Zabbix 開源
成熟的開源監控平台,主力是主機、網路與服務監控。
替代品由 AI 依公開資訊列出,尚未逐一連線驗證(unverified),請自行確認是否仍在維護。
這個判決會隨模型進步翻盤:今天的「勉強可以」很可能半年後變成「可以刻」。
判決依 rubric v1.0.0 於 2026-08-31 生成。