對使用 AI 的開發者來說,目前的「vibe coding」基本上就是得像照顧小孩一樣監看每一個動作,或是冒著讓模型不受控制的風險。Anthropic 表示,其最新更新的 Claude 旨在消除這項選擇,讓 AI 自己決定哪些動作可以安全執行 —— 並設有一定的限制。這項舉措反映了業界更廣泛的轉變,因為 AI 工具正越來越被設計成可以自行行動,而無需等待人類的批准。挑戰在於如何在速度與控制之間取得平衡:過多的防護措施會讓流程變慢,過少則可能讓系統變得危險且難以預測。Anthropic 新推出的「Auto 模式」目前處於研究預覽階段 —— 表示這項功能已可供測試,但還不是正式產品 —— 是其最新嘗試在這之間找到平衡點。Auto 模式會使用 AI 安全防護機制,在每個動作執行前進行審查,檢查是否有用戶未要求的風險行為,以及是否有提示注入(prompt injection)的跡象 —— 這是一種攻擊方式,透過在 AI 處理的內容中隱藏惡意指令,使其執行未預期的動作。任何被判定為安全的動作將自動執行,而被視為有風險的動作則會被阻擋。這項功能基本上是 Claude Code 現有「dangerously-skip-permissions」指令的延續,該指令將所有決策權交給 AI,但在此基礎上增加了安全層。這項功能建立在 GitHub 和 OpenAI 等公司推出的自主編碼工具之上,這些工具可以代表開發者執行任務。但 Auto 模式更進一步,將原本由用戶決定是否需要許可的權限,轉交給 AI 自己判斷。Anthropic 目前尚未詳細說明其安全層是如何區分安全動作與風險動作的標準 —— 這一點開發者在廣泛採用前很可能會想要更深入了解。(TechCrunch 已經聯繫該公司,尋求更多關於這方面的資訊。) Auto 模式是在 Anthropic 發布 Claude Code Review 之後推出的,這是一款自動程式碼審查工具,用來在程式碼進入專案前就檢測錯誤,以及 Dispatch for Cowork,這款工具允許用戶將任務交給 AI 代理處理。Auto 模式將在接下來幾天內對企業用戶和 API 使用者推出。該公司表示目前 Auto 模式僅支援 Claude Sonnet 4.6 和 Opus 4.6,並建議在「隔離環境」中使用這項新功能 —— 這類環境與生產系統分離,能降低出錯時的潛在損失。
Anthropic 賜予 Claude 更多控制權,但仍加以限制
分享這篇文章: