周四,Anthropic 發佈了 Opus 4.8,這是其目前最先進公開模型的最新版本。這個模型可在各處使用,標準價格與前一個 Opus 版本相同。新模型距離 Opus 4.7 發佈僅有 41 天,這比 Anthropic 常見的更新週期快許多。(最新 Sonnet 與 Haiku 模型分別為三個月與七個月前發佈。)這快速的更新週期可能與 Opus 4.7 遭遇的冷淡反應有關,一些用戶認為這版本令人失望。這段時間內,OpenAI 的 Codex 與 Google 的 Gemini Flash 模型也都推出了重大更新,讓 Anthropic 更加感受到壓力。Opus 4.8 帶來預期的最佳指標表現,但也特別關注模型在處理不良或不確定資料時的表現。在發佈文章中,Anthropic 的早期測試者發現新模型「較可能標記其工作中的不確定性,並較少做出無根據的斷言。」這點也得到 Bridgewater 副董事長的證詞支持,他表示升級後最大的不同是「Opus 4.8 更傾向主動標記分析輸入與輸出中的問題,這是其他模型常忽略的,必須由用戶自行發現。」除了新模型,Anthropic 還推出了名為 Dynamic Workflows 的功能,將在研究預覽中提供。這個系統設計用來協助較大的模型如 Opus 管理跨數百個平行子代理的複雜任務。發佈文章說明:「Claude Code 與 Opus 4.8 現在可以從啟動到合併,處理數以萬計的程式碼行,並以現有的測試套件作為標準。」Anthropic 仍延後發佈其最進階的 Mythos 模型,因上月預覽時引發的網路安全疑慮。不過,公司今天在 Opus 發佈中暗示 Mythos 的預覽期可能很快結束,一旦必要的安全措施完成。公司寫道:「我們正在快速開發這些安全措施,預計在接下來幾週內就能將 Mythos 等級模型提供給所有客戶。」
Anthropic 發佈 Opus 4.8 新增「動態工作流」工具
分享這篇文章: