一、單一任務獨立對話,配合 1 小時快取記憶Claude 的提示快取(Prompt Caching)機制是有時間限制的(TTL,存活時間預設為 5 分鐘,部分進階設定或 Pro 方案可延長至 1 小時)。

二、將步驟批量整合,一行指令處理完畢與大模型對話,最忌諱像跟真人聊天一樣「一句一句交代」。因為每一次發送訊息,系統都會把前面的「所有對話歷史」重新傳輸與計算一次。

三、主動進行對話壓縮,善用 /compact 並指定保留重點當對話太長時,系統的自動截斷會破壞快取機制。若使用 Claude Code 或特定介面,可以透過手動壓縮來清理版面。

四、直接給精確代碼,嚴禁讓 Claude 盲搜檔案或讀厚重 PDF讓 Claude 去「找檔案」、「讀取一整個資料夾」,或是丟幾百頁的 PDF 讓它自己找重點,是非常致命的 Token 殺手。

**五、極致壓縮專屬設定檔(CLAUDE.md),例如「改寫文言文」**在情境工程中,像 CLAUDE.md 這種常駐設定檔會在每次對話被載入 [9]。雖然透過快取機制讀取只需一折費用,但首次載入的寫入成本是標準輸入的 1.25 倍到 2 倍,因此設定檔越精簡越好。

--

--

📢 聲明: 本文 AI 寫作比例達 90% 以上,作為作者意志之延伸工具。

vocus|新世代的創作平台