Google 週二推出 Gemini 3.5 Flash,一款新 AI 模型,公司表示這是目前最強大的模型,專為程式設計與自主 AI 代理而設計。這款模型在公司年度 Google I/O 開發者大會上發表,可以獨立執行程式碼流程、管理研究專案,並在內部測試中從頭開始建立作業系統。這項發佈顯示 Google 的策略從將 AI 套用在對話工具轉向 AI 代理工具。這不僅是回答問題,而是計畫、建立與執行實際工作,並減少人為輸入。DeepMind 首席技術官 Koray Kavukcuoglu 在公開發佈前告訴記者:「3.5 Flash 提供了極高的品質與低延遲的結合,它在幾乎所有測試項目上都優於我們最新的邊界模型 3.1 Pro,包括程式設計、代理任務與多模態推理。」他補充說,這款模型的速度是其他邊界模型的 4 倍,這速度對程式設計與代理任務來說非常理想,但 Google 更進一步開發出一個優化版的 Flash,速度提升至 12 倍,品質則與原版相同。根據 Kavukcuoglu 的說法,這速度是 Flash 設計用於代理工作的核心。在 I/O 現場,Google 工程師 Varun Mohan 示範了代理程式各自執行不同元件,之後再集結起來在 Antigravity 平台內建立完整的作業系統。Image Credits: Google Kavukcuoglu 表示 Flash 3.5 是與 Antigravity 共同開發,讓代理程式能在一個「原生環境」中運作與執行。在 I/O 期間,Google 發布了 Antigravity 2.0,這是一款專為代理程式開發設計的獨立桌面應用程式。這些進展不僅僅是展示。Google 表示 3.5 Flash 的代理能力已經在合作夥伴中產生影響,例如銀行與金融科技公司自動化進行數週的工作流程,或數據科學團隊在複雜數據環境中尋找見解。該模型可以持續運行數小時,不過 Google 高階產品主管 Tulsee Doshi 表示,當模型遇到需要人類判斷的決定點或權限問題時,會暫停並要求使用者輸入。當 Google 發布即將推出的 3.5 Pro 模型時,這兩個模型將協同運作。Doshi 告訴 TechCrunch:「3.5 Pro 成為你的協調者與計畫者,然後它實際上可以利用 Flash 作為各種子代理。我想這真的取決於你想要那種推理能力,你想要那種較大的模型來推動推理,還是你有任務真的適合使用強大的計算能力。」目前,3.5 Flash 是 Gemini 應用程式與全球搜尋的 AI 模式中的預設模型。在 I/O 期間,Google 還宣布搜尋功能將引入代理能力,讓使用者可以直接在平台上建立、自訂與管理 AI 代理。這款新模型也會驅動 Gemini Spark,這是 Google 新推出的個人 AI 代理,設計為 24 小時運行,協助消費者管理數位生活。為平均消費者提供這等程度的 AI 能力,也引來關注。Google 目前正因一名男子在與 Gemini 聊天數週後幾乎造成重大傷亡事件並自殺而面臨訴訟。當強大的自主代理變得更普遍時,潛在的危害也隨之增加。Google 表示 Gemini 3.5 已加強網路與 CBRN(化學、生物、放射性與核子)防護措施,並更精準地處理敏感問題,而不是直接拒絕。Gemini 3.5 Flash 現已透過 Antigravity、Gemini API、Gemini Enterprise、Gemini 應用程式以及搜尋的 AI 模式正式推出。
Google 擊出下一波 AI 風暴 傳遞 Agent 概念 不再依賴 Chatbot
分享這篇文章: