1. 上下文視窗上限:限制模型在單一會話中能同時處理的權杖總數。滿了時,模型會提示壓縮,或自動壓縮紀錄。 2. 帳號用量上限:限制滾動時間視窗內的總請求量或權杖消耗(例如 5 小時重設或每週配額)。達到時,Claude 會顯示「You have exceeded your current usage limit」,並附上重設時間。
開發者常把上下文視窗已滿與帳號速率上限搞混,或以為會話交接工具會人為放大 Claude 的上下文視窗。Watch 不會繞過用量配額,也不會取代 Claude 的原生壓縮。理解差異才能選對恢復路徑。
步驟 1:查看終端機錯誤訊號以辨識上限類型
若 Claude 回報「exceeded your limit」並附重設時間,那是帳號用量上限:執行 /compact 會失敗,因為模型配額已用盡;請等待重設,或交接給 Codex/OpenCode。若 Claude 回報對話長度上限或高延遲,那是上下文視窗上限:請執行 /compact。
步驟 2:對上下文長度使用原生處理(/compact 與 /clear)
在 Claude Code 內執行 /compact,把對話紀錄壓縮成精簡摘要。若不再需要先前的調查回合,執行 /clear,在目前工作區重新開始。
步驟 3:達到帳號用量配額時保存會話狀態
確認 Claude Code 已將會話文字稿寫入 ~/.claude/projects/<enc-cwd>/<session-id>.jsonl。使用 Watch 檢查工作目錄,以及 Codex 或 OpenCode 目標是否就緒。
步驟 4:交接給另一個 Agent,不必重述脈絡
使用 Watch 把已記錄的推理與測試結果轉成目的地 Agent 的格式,再在新的 CLI 中帶著先前脈絡繼續。
# 情境 A:上下文視窗上限的原生處理(在 Claude Code 內)
/compact # 自動壓縮紀錄以釋出上下文容量
/clear # 清除對話,同時保留工作目錄脈絡
# 情境 B:達到帳號用量上限時的多 Agent 交接(在 Shell)
npm run watch -- open <claude-session-id> --to codex --json
npm run watch -- open <claude-session-id> --to opencode --json1. Watch 不會擴大單一 Agent 的上下文:在新 Agent 繼續時,仍受該 Agent 自己的上下文視窗上限約束。 2. 工具呈現會改變:Claude 的 tool_use 事件在 Codex 會降級為結構化文字,以避免結構解析錯誤。 3. 不要突然終止程序:關閉終端機視窗前,請確認會話檔已寫入。