header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

Claude Code官方省Token指南:11個技巧讓額度用得更久

動察 Beating 監測,Anthropic 发布 Claude Code 省 Token 指南。核心就一句:上下文越長,後面每一輪越貴。聊天、文件和命令輸出都會繼續佔用 Token,也會因此更快消耗額度。

整理下來,有 11 個最實用的技巧:

1. 换任务就 /clear。一个任务做完就清掉上下文。还在做同一个任务,只是前面的内容沒用了,再用 /compact 壓縮。長會話越往後越貴,因為每一輪都會重新帶上之前的内容。

2. 模型和 effort 開局就選好。中途執行 /model 或 /effort 會打掉 prompt cache(提示詞快取),下一輪需要重新處理整段上下文。Fast mode 也是一樣,最好一開始就開。

3. 離開前先 /compact。訂閱用戶的快取約 1 小時過期,API Key 默認約 5 分鐘。快取過期後再回來,下一輪通常要重新處理整個上下文。趁快取還在時壓縮更便宜。

4. 最近幾輪跑偏就 /rewind。它只刪掉後面幾輪,前面的快取還能繼續用。/compact 會重寫整個對話,成本更高。

5. 文件直接用 @ 文件名。Claude 會在第一輪直接拿到文件,可以省掉一次 Read 或搜索。一個文件通常只需要 @ 一次,重複 @ 反而可能把同一文件再塞一份進上下文。

6. Prompt 儘量說具體。與其說「測試掛了」,不如直接告訴 Claude 哪個測試、哪個文件。否則它可能先 grep、搜索、讀一堆文件,這些結果之後每一輪都會繼續佔上下文。

7. 測試和日誌儘量少輸出。Build、測試、git log 的輸出都會留在上下文。可以加 quiet 參數、只輸出錯誤,或者用 tail 截斷。Claude Code 對超過 3 萬字符的命令輸出反而會自動寫入文件,只把摘要和路徑留在會話裡。

8. 用 /context 查啟動負擔。新會話一開始就可以看 CLAUDE.md、MCP 和工具定義占了多少上下文。CLAUDE.md 只放通用規則,專項流程放進按需加載的 Skill,不用的 MCP 用 /mcp 關掉。

9. 簡單任務用更小的模型、更低的 effort: 大模型輸入和輸出都更貴,thinking 也屬於輸出 Token。純執行類任務沒必要一直用最高檔模型和最高推理強度。

10. 大日誌交給 subagent,小任務別濫用。Subagent 有獨立上下文,只把最終結果帶回主會話,適合讀大量日誌、搜索文檔。但它也要重新讀文件、自己跑多輪,小任務反而可能更貴。搜索、讀日誌這類任務還可以指定 Haiku 或 Sonnet。

11. /loop 最好單獨開會話。每次循環都是完整的一輪,會重複攜帶當前會話的全部上下文。如果間隔超過快取時間,還可能疊加一次快取失效。官方建議另開終端,用一個乾淨會話專門跑循環。

Anthropic 的建議歸根結底就是:少塞無用內容,任務結束及時清,會話別拖得太長。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成