Claude Opus 5.5 的 100 萬 Context 不是 Agent 的永久記憶

大 context 能支撐一次長任務,持久記憶仍需要檔案、記錄、檢索與明確交接。

Buda Team
← 返回部落格
Claude Opus 5.5 的 100 萬 Context 不是 Agent 的永久記憶

Claude Opus 5.5 有 100 萬 Context,為什麼 Agent 還是會忘事?

一個 Agent 在長會話裡讀完資料,第二天換個會話繼續工作,卻忘了昨天批准過哪一版。這不是“視窗還不夠大”,而是決策只待在對話裡,沒有變成下一次工作能找到的記錄。

Opus 5.5 提供 100 萬 token 的 context window,最大輸出 12.8 萬 token。它能在一次請求中處理更多材料;但視窗裡的資訊不會自動成為可複用、可審計的團隊記憶。

大視窗能解決當下閱讀,不能決定明天該相信什麼

當前上下文可以容納任務要求、長文件和工具返回結果。隨著任務推進,部分內容會被裁剪、總結,或被新的會話取代。即便每次都塞入全量歷史,模型仍需判斷哪份檔案是最新、哪個結論被批准、哪條數字後來已被修正。這些是版本和責任問題,不是容量問題。

因此不要把“Agent 看過”當成“團隊已經儲存”。前者只說明某次推理用到了材料;後者需要一個有位置、有時間、有來源和更新規則的記錄。

上下文容量與持久狀態是不同的能力

四種狀態,分別放在該放的地方

工作上下文放當前步驟需要的指令與證據,可以按任務重新組裝。進度狀態寫明已執行什麼、哪些測試失敗、哪些檔案已修改、下一步從哪裡開始;這樣任務中斷後不必靠回放全部對話恢復。

持久知識儲存已確認的事實、決策和來源,也記錄誰負責更新與何時複核。審計歷史保留批准過程、修改差異和最終版本;它不能隨著一次“幫我總結會話”就被無聲覆蓋。

例如製作多語言文章:上下文裡可以放當前語言的草稿和風格規則;進度裡記已完成的語言與待改段落;持久記錄儲存最終標題、連結和已確認事實;審計歷史說明哪個版本經過稽核。下一個編輯不需要通讀所有聊天,也能找到正確的起點。

Preserved thinking 不是一種記憶資料庫

Anthropic 的遷移說明要求工具呼叫後的 thinking blocks 按原樣返回,且先前訊息與工具定義應保持一致。隨意改寫歷史,可能使這些塊失效。這個約束服務於對話完整性,不等於模型會把每次推理自動整理成組織知識。

如果工作要跨會話、跨模型或跨 Agent,交接應寫出人可檢查的結論和未決事項,而不是依賴某段專有的 thinking 內容。把內部推理當作長期記錄,不僅難以檢索,也很難解釋給後來負責稽核的人。

把任務進度與可接受的事實寫到持久記錄裡

一次可復現的交接怎麼做

開始時確定目標、輸入材料、許可權、完成標準和檔案位置。執行中在關鍵節點留下產物,而不是等最後一輪才說“做完了”。每次交接至少包含:已完成動作、可開啟的結果、驗證方法、失敗與未確定事項、下一步和需要人批准的動作。

隨後故意中斷會話,換一個 Agent 接手:它能否不依賴原對話找到正確檔案?能否說清哪條資料有來源、哪一版被認可?能否從上次失敗處繼續而不重複已做的外部動作?這些問題比單純問“能塞下多少 token”更能檢驗工作流的記憶質量。

Buda 的檔案、會話、工具記錄和可稽核產物為交接提供可見的工作面。真正可靠的長期狀態仍要由檔案和記錄承接,並由人決定哪些結論可以進入可信版本。

在 Buda 中使用 Opus 5.5

Claude Opus 5.5 已在 Buda 上線,可在 Agent 的模型選擇器中選擇,繼續使用原工作區和檔案。更大的模型上下文不會讓對話自動變成永久記憶;關鍵決定、證據與交接檢查點仍應儲存到檔案或可信記錄中。

閱讀 Buda 上線公告 · Buda Credits

來源