Anthropic 正在擴展其於四月推出的 Claude Managed Agents 平台,新增三項功能,旨在提升 AI 代理在實際應用中的可靠性和適應性。

其中一項創新功能是「夢境」(Dreaming),它能審查代理過往的工作階段,找出模式,並在不同工作階段之間分享洞察,例如重複出現的錯誤或已驗證的工作流程。

從技術層面來看,「夢境」以非同步作業方式運行:它會讀取現有的記憶儲存區,並可選取最多 100 個過往工作階段,清理重複和過時的條目,然後從中建立一個新的、有組織的記憶。原始記憶會保持不變。目前支援 Claude Opus 4.7 和 Claude Sonnet 4.6,計費方式遵循標準的 API token 定價。

Claude Console 中的「夢境」介面允許使用者選擇記憶儲存區和模型,指定工作階段,並啟動該流程。

成果評估(Outcomes):獨立評估器根據固定標準檢查代理結果

「成果評估」和「多代理協作」正從研究預覽階段轉為公開測試版。透過「成果評估」,開發者可以定義一個評分標準:一份包含具體成功條件的文件,例如「CSV 檔案包含一個帶有數值價格的欄位」。

一個獨立的評估器(或稱評分員)會在自己的上下文視窗中,根據這些標準檢查代理的輸出,且不受代理推理過程的影響。如果結果不符合規範,評估器會找出不足之處,代理則會修正其工作,預設最多三次,最多可嘗試 20 次。

多代理協作(Multiagent orchestration):協調者將工作分配給專業子代理

透過多代理協作,一個主導代理(協調者)管理多個專業代理的工作。每個代理都在自己的執行緒中運行,擁有獨立的上下文、自己的模型、系統提示詞和專用工具,但它們共享相同的檔案系統。協調者可以平行分配任務,例如同時將程式碼審查和測試建立委派給不同的代理。該系統支援最多 20 個不同的代理和最多 25 個執行緒同時運行。

多代理協作實際應用:一個協調者準備資料,並將分析任務委派給三個平行運行的專業子代理。

「夢境」目前以研究預覽版形式提供,開發者可透過 Claude 網站上的表單申請存取。「成果評估」、「多代理協作」和「記憶」則作為 Anthropic Managed Agents 平台的一部分,以公開測試版形式提供。更多詳細資訊可在文件、Claude 部落格和 Claude Console 中找到。