ccxray

WIRE-LEVEL OBSERVABILITY FOR CODING AGENTS

看清你的 coding agent 到底做了什麼。

Claude Code 是個黑盒子——你看不到它送出的 system prompt、每一輪真正的花費,也不知道是什麼吃掉了你的 context window。ccxray 在 wire 層記錄每一次 API 呼叫並即時呈現。一行指令、零設定、100% 在你自己的機器上。

Node.js 18+ · macOS / Linux · 不需要 API key——它只轉送你的 CLI 本來就會送的東西。多個終端機自動共用同一個 dashboard。

Claude Code · Codex · Grok零設定個人使用免費awesome-claude-code 收錄

不用註冊 · 不需 API key · 100% 本機

ccxray dashboard:即時 session、每輪成本、cache 與 context 分解 — Dashboard——專案、session 與逐輪明細
Dashboard——專案、session 與逐輪明細
ccxray dashboard:即時 session、每輪成本、cache 與 context 分解 — Turn timeline 與 subagent 泳道
Turn timeline 與 subagent 泳道
ccxray dashboard:即時 session、每輪成本、cache 與 context 分解 — 用量與成本歷史
用量與成本歷史

在新分頁開啟完整 Demo

四個發現

Agent 默默讓你付出代價的四種方式

這些都不會丟出錯誤。它們只是安靜傷害你的 session、帳單,和你的信任。

Act I

Session 中途失憶

Context window 滿了之後,auto-compact 會壓縮你的對話——有失真,而且不會先問你。

805 → 21

一次 auto-compact 之後剩下的訊息數。97.4% 的對話,在一輪之內消失。

Act II

突然爆炸的帳單

Prompt cache 閒置一陣子就會過期。一旦錯過,整個 context 以原價重新計費。

成本尖峰——真實 session 裡 6 分鐘內連續三次 cache 失效。

Act III

你從沒看見的 subagent

Agent 呼叫會生出彼此隔離的分身,各自有 context 和思考——做完就消失。

62 條 lane

平行 subagent,峰值每秒 29 次呼叫。沒有 timeline 就完全看不見。

Act IV

開口前就先繳的稅

MCP schema、skills、CLAUDE.md 和記憶——你還沒開口,模型就得先讀完這份行前簡報。每一場 session 都要繳這筆固定的稅。

48.5%

200K window 在第一句回覆前就少了 48.5%——In 99K、$1.02,28 個 MCP 全部 0 uses。

AI coding agent 不是工具,是你的 runtime。

你不會在沒有 monitoring 的情況下部署 server。但我們每天讓 AI agent 在零可觀測性的狀態下改 production code。

這不是效率問題,是工程紀律問題。

Wire 上看得到的東西

以下全部來自實際攔截的流量——不是從 log 推估。

Workflow timeline 與 subagent 泳道

多 agent session 自動切成平行泳道——orchestrator 在主 lane,fork 和 teammate 各自有顏色的軌道。62 個並行 subagent 不再隱形。

Workflow timeline 與 subagent 泳道

用量、成本與 rate limit

Burn rate、逐模型花費、cache 命中經濟,以及 Claude 與 Codex 的帳號別 rate-limit 卡片。每個 token 去了哪裡,一清二楚。

用量、成本與 rate limit

System prompt 追蹤

自動版本偵測加 diff 檢視。ccxray 就是靠這個,比 Anthropic 官方 postmortem 早兩週發現 Claude Code 的 system prompt 變更。

system prompt · v2.1.249 → v2.1.251 · 3 blocks changed

You are Claude Code, Anthropic's official CLI…

- Only use emojis if the user explicitly requests it

+ IMPORTANT: Assist with authorized security testing…

+ <system-reminder> blocks may be injected mid-turn

2 agents affected · first seen 14:02 · diff view →

鍵盤優先的操作

按 ? 叫出快速鍵表;e / s / a / m 跳到錯誤、skill、subagent、MCP 呼叫。每個畫面都是可分享的 deep-link URL。

鍵盤優先的操作

你的 agent 讀得懂的用量 CLI

ccxray usage --json 回傳精簡、有文件的固定格式(4 KB 以內)。讓 agent 自己稽核自己的花費。

$ ccxray usage --json | jq .totals

{

"costUsd": 4.83,

"cacheReadTokens": 18432011,

"turns": 212

}

現在就試 dashboard

這是真的 dashboard——不是影片。載入三個專案(兩個特別打造、加上一個真實匯入的 workshop 專案)、16 場 sessions,還有平行 subagent。點點看,鍵盤也能用。

全螢幕開啟

提示:按 ? 看快速鍵,按 e 跳到錯誤。

WHERE THIS IS GOING

從 context 到 outcome。

今天你看得到 agent 做了什麼,但仍然很難看到它當時到底知道什麼。ccxray 正在為 coding agent 打造 execution provenance:

Task outcome

跨 provider 的 session 標注:任務是真的成功了——而不只是「程式以 0 結束」。

Context provenance

哪些材料真的進了模型的 context window,每一份又是從哪裡來的。

Handoff graph

一個 agent 交給另一個 agent 什麼——以及哪些 context 根本沒傳過去。

Run 對比

同一個任務的多次嘗試,用證據對比——不是憑感覺。

原則

  • · 觀測到的 wire 事實,優先於對隱藏推理的臆測
  • · Observed ≠ derived ≠ inferred ≠ judged——永不悄悄壓平
  • · 引用原始內容,而不是複製它
  • · 證據撐不起的因果,不說
設計討論公開在 GitHub 進行

誠實的限制

我們寧可你在安裝前就知道。驗證日期 2026-08-30。

Codex 支援還在 beta
每一輪 Codex 都會透過 WebSocket 記錄模型、token 用量、instructions 和 tools——但部分細節仍不如 Claude session 完整。
Grok 支援是 beta
Grok CLI 代理可用,包括帳號用量卡片,但實戰里程比 Claude 路徑少。
只涵蓋 CLI agent
Claude Desktop、ChatGPT Desktop 不提供可設定的 API endpoint,wire proxy 看不到它們。ccxray 涵蓋的是 CLI agent。
資料留在本機
所有記錄都存在你機器上的 ~/.ccxray。什麼都不會上傳——也因此沒有雲端同步。
Demo 是快照
頁內 demo 是全新生成、去識別化的 demo sessions 靜態快照——沒有即時流量、沒有真實工作資料。你本機的 dashboard 永遠比較新。
你可能不需要它
Session 都很短、也不在意成本?純 CLI 也許就夠了。