Model Context Protocol (MCP) 是實現 AI 互通性的基本構成要素之一,它為 AI 模型提供安全存取外部資料來源和服務的方式。這項底層技術讓聊天機器人能夠連接到您的行事曆、資料庫或內部工具,而無需工程師為每個連接建立客製化的管道。下週,該協定將迎來一次重大更新,儘管終端使用者可能不會察覺,但它可能對整個生態系的發展產生巨大影響。
新版本的官方規範已於五月公開,但我們週一早上從 Arcade 的團隊那裡獲得了異常清晰的變更解釋。Arcade 是一家成立兩年的新創公司,其業務核心就是讓 AI 代理能夠在真實企業中實際運作,讓它們安全地連接並操作 Gmail、Slack 和 Salesforce 等工具。
Arcade 在六月募得了 6,000 萬美元,其理念是大多數 AI 代理的失敗並非因為底層模型不夠強大,而是因為周邊基礎設施尚未準備就緒,而這次更新正是為了解決這個問題。本質上,MCP 正在改變其處理會話 ID(session ID)的方式,這些小小的識別碼讓伺服器能記住「啊,這是五秒前同一個對話」,以便伺服器能更容易地大規模運作。
正如 Arcade 創辦人 Nate Barbettini 所說:
「在目前的系統下,當像 Claude 這樣的 MCP 用戶端首次連接到伺服器時,它會發送一個『你好』訊息:我是 Claude,這是我的版本,這是我的功能。伺服器會回覆其功能並傳回一個會話 ID… 從那時起,用戶端在每個請求中都會發送該會話 ID,以便伺服器知道這是同一個對話。有時 ID 會過期,因此用戶端必須察覺、請求一個新的,然後繼續…」
「想像一個實際的部署情境。您正在為數百萬用戶運行伺服器,後面有一個負載平衡器,其唯一工作是將每個請求路由到伺服器叢集中任何空閒的伺服器,有時甚至在不同區域。現在,這些機器中的每一台都必須知道由其他機器發出的會話 ID。這並非不可能,但卻是個嚴重的麻煩,它會與負載平衡器產生衝突,而不是與之協同工作。」
換句話說,目前的設定假設單一伺服器會記住您,但真實的公司會將流量分散到數十個預設不互相通訊的伺服器上,因此目前的 MCP 伺服器必須額外工作才能追蹤誰是誰。這對於任何大規模運行 MCP 伺服器的人來說都是一個嚴重的問題,也是今年儘管 AI 代理備受炒作,我們卻沒有看到更多公司推出大規模、第一方 MCP 整合的部分原因。
在新系統下,該協定將在伺服器端對會話 ID 採取更寬鬆的「無狀態」(stateless)方法,類似於大多數普通網站的運作方式,這應該會使整個系統更容易維護,理論上也能以更低的成本大規模運行。
這一切聽起來可能很技術性,但它重要地提醒我們,並非所有 AI 開發都以驚人的速度推進。儘管模型訓練競相超前,但這些模型所需的許多技術基礎設施仍然受制於標準制定機構緩慢的共識過程。它確實正在發生;只是速度慢了一點!

