Datadog
集中收集應用程式、主機與服務的日誌、指標和追蹤資料
🤔 勉強可以
基本監控能刻,整合廣度才是帳單理由
月費(約)
$15
約 NT$480
一年省下
$180/年
自己刻要多久
好幾天
幾個人做得出來
兩個人
分類
🛠️ 開發工具
價格為約略值,以官網為準。Infrastructure Monitoring Pro 方案,依每台主機每月約 15 美元的年繳起始價估算;
護城河
判決理由
主機 CPU、記憶體、磁碟監控,應用程式日誌收集,Prometheus 指標圖表和簡單告警,用 Docker、OpenTelemetry、Grafana 加 SQLite 幾天能做出自用版。刻不完的是 Datadog 對雲端、資料庫、容器和第三方服務的大量現成整合,以及高流量下的儲存、索引、降噪和告警可靠度。
為什麼大家還是付錢
付費買的是裝上 Agent 就能監控整套基礎設施,還有數百種整合、通知、保留期限與不用自己維護的託管服務。小型自用環境通常不值得付。
建置 prompt
複製下面這段,丟給你的 AI coding 工具,讓它替你刻一個自用版。
目標:做一個本機優先的自用可觀測性面板,收集主機、容器與應用程式的日誌、指標和追蹤資料。
技術棧建議:OpenTelemetry Collector + Prometheus + Grafana + Loki,使用 Docker Compose 管理服務,設定與儀表板存放在本機檔案。
需求:
- 啟動一組 Docker Compose 服務,包含 OpenTelemetry Collector、Prometheus、Grafana 與 Loki
- 收集本機主機的 CPU、記憶體、磁碟、網路和程序指標
- 提供應用程式可用的 OTLP HTTP 與 gRPC 接收端點
- 收集 JSON 與純文字日誌,解析時間、等級、服務名稱和 request_id 欄位
- 支援依服務、環境、日誌等級和關鍵字搜尋日誌
- 接收 OpenTelemetry traces,顯示服務名稱、延遲、錯誤和 trace 詳情
- 建立主機資源、HTTP 請求、錯誤率和延遲的預設 Grafana 儀表板
- 支援以 PromQL 與 LogQL 建立自訂查詢和面板
- 支援告警規則,例如 CPU 過高、磁碟不足、錯誤率上升和服務無回應
- 告警可透過電子郵件或 Webhook 發送,並記錄觸發與恢復時間
- 設定日誌與指標的保留天數,超過期限自動清理
- 管理頁顯示資料來源狀態、磁碟用量、最近錯誤和收集器健康狀態
- 可匯出儀表板 JSON、告警規則、服務設定與查詢結果 CSV
明確不做(out of scope):雲端廠商一鍵整合、多使用者權限、商用等級高可用、全球節點、長期大量資料保存、手機 App 與自動根因分析。
README 要求:說明架構、Docker Compose 啟動方式、應用程式接入範例、資料目錄、保留期限設定、備份與匯出流程,以及如何完整移除服務。
「用 Claude Code 開啟」複製的是 claude "<prompt>",貼進終端機即可;
Codex、Cursor、Copilot 等工具直接用左邊的複製鈕貼進對話框。
免費 / 開源替代
- Grafana 開源
開源儀表板與告警工具,可串接 Prometheus、Loki 等資料來源。 - Prometheus 開源
開源時間序列監控系統,適合收集指標與執行告警規則。 - SigNoz 開源
開源 OpenTelemetry 可觀測性平台,整合指標、日誌與追蹤。 - Loki 開源
開源日誌聚合系統,搭配 Grafana 查詢與建立告警。
替代品由 AI 依公開資訊列出,尚未逐一連線驗證(unverified),請自行確認是否仍在維護。
這個判決會隨模型進步翻盤:今天的「勉強可以」很可能半年後變成「可以刻」。
判決依 rubric v1.0.0 於 2026-08-31 生成。