Mistral 的新旗艦模型 Mistral Medium 3.5,將過去獨立的聊天、推理和程式碼模型整合為單一產品。這家法國公司還為其程式碼工具 Vibe 增加了非同步雲端代理,並為 Le Chat 提供了新的代理模式。根據模型卡片說明,Mistral Medium 3.5 是一個擁有 1280 億參數和 256,000 個 token 上下文視窗的密集模型。

「密集」意味著每次生成 token 時,所有 1280 億個參數都會被載入並啟用。這使得推論成本較高,但運行起來更簡單,並且在生產環境中往往表現更穩定。Mistral 知道有更便宜的方法。Mistral Large 3 使用專家混合模型(MoE)架構,總參數達 6750 億,但每次 token 僅啟用 410 億個參數。

Mistral Small 4 擁有 1190 億個參數,僅啟用 60 億個。Deepseek 和 Qwen 等競爭對手早已將其頂級模型轉向 MoE,因為它能在相似品質下提供更便宜的推論。在這種背景下,將新旗艦模型建構成純密集模型是一個保守的選擇:雖然推論成本優化程度較低,但更容易作為一個統一模型用於聊天、推理、程式碼和代理。

Mistral 表示該模型可以在四個 GPU 上自行託管。實際上,這對於大多數非配備完善資料中心的使用者來說,可能仍然遙不可及。推理功能成為可切換參數,全新視覺編碼器從頭打造該模型遵循業界趨勢,不再使用獨立的推理模型,而是將推理作為每次查詢的參數。

一個 reasoning_effort 設定可以在快速回應和處理複雜代理任務的較重模式之間切換。Mistral 還從頭重新訓練了視覺編碼器,以處理可變的圖像尺寸和長寬比。在 Mistral 自己的基準測試中,Medium 3.5 在 SWE-Bench Verified 上得分 77.6%,在 T3-Telecom 上得分 91.4%。

Mistral 表示,該模型取代了 Le Chat 中的 Medium 3.1 和 Magistral 推理模型,以及 Vibe CLI 中的 Devstral 2。修改版 MIT 授權取代 Apache 2.0模型權重可在 Hugging Face 上下載,但不再使用 Mistral 之前使用的 Apache 2.0 授權。

該公司轉為採用「修改版 MIT 授權」,允許商業和非商業使用,但對高營收公司設有例外條款。這與 Mistral Large 3 和 Small 4 等採用 Apache 2.0 授權的模型有所不同。透過 API,Medium 3.5 的輸入 token 費用為每百萬 $1.50,輸出 token 費用為每百萬 $7.50。

程式碼代理移出筆記本第二項發布對開發者而言可能比模型本身更重要。Mistral 的程式碼工具 Vibe 正在獲得遠端代理功能,這些代理可以在雲端同時運行多個,無需開發者監控。本地會話及其歷史記錄、任務狀態和審批都可以遷移到雲端。每個代理都在獨立的沙盒中運行,並在完成後可以開啟拉取請求(pull request)。

Vibe 連接到 GitHub、Linear、Jira、Sentry、Slack 和 Teams。Mistral 指出,模組重構、測試生成、依賴項升級和錯誤修復等日常工作是主要的使用案例。雲端版本基於 Mistral Studio 的工作流程構建,該工作室最初由公司內部開發並供企業客戶使用。

這個概念並不新鮮。OpenAI、Anthropic 和 Cursor 都已提供類似的設置。Le Chat 的工作模式預設啟用連接器Mistral 還為運行 Medium 3.5 的 Le Chat 增加了「工作模式」。它專為跨多個工具的多步驟任務設計,例如處理電子郵件、訊息或日曆條目,或執行結構化搜尋。

在工作模式下,與郵箱、日曆、文件和其他系統的連接器預設為啟用。這使得複雜的工作流程更容易設置,但也將更多資料流的責任轉嫁給使用者。Le Chat 在執行發送訊息或寫入外部系統等敏感操作之前,會要求明確確認。工作模式適用於 Pro、Team 和 Enterprise 方案。