實體: Gemini
所有提到 Gemini 的 AI 新聞與動態。
-
Google 在 IO 2026 宣佈成為 AI 設計領域的重要參與者
Google 於週二在年度 Google I/O 活動中宣佈推出 Pics,這是一款針對 Google Workspace 的全新 AI 驅動設計與影象生成應用程式。該應用旨在讓從教師到小型企業擁有者等所有使用者都能輕鬆使用,透過簡單的文字提示即可生成社交媒體圖示、邀請函、行銷素材及原型圖,無需具備編輯技能或專業工具。Google 表示,Pics 的推出意在挑戰 Canva 等流行設計應用,以及來自 Anthropic 的 Claude Design 等 AI 原生競爭產品,標誌著 AI 驅動設計已成為企業視覺內容競爭的核心領域。 Pics 將首先向測試群組開放,並預計於今年夏天向 Google AI Ultra 訂閱者推出。針對目前 AI 模型難以精確修改單一細節的痛點,Pics 不僅能生成影象,更提供易於編輯的功能。Gemini 驅動編輯層,使生成設計中的每個元素皆可調整。使用者可輸入新提示進行修改,也可直接點選欲更改部分並留下註解,類似於 Google Docs 的回饋機制,甚至可手動直接編輯。例如,若需更改生日派對邀請卡上的時間,使用者可無需重新撰寫提示即可完成。 Pics 由 Nano Banana 2 驅動,該模型支援精確文字渲染、現實世界知識及詳細視覺輸出。作為 Google Workspace 的內建功能,Pics 促進了跨應用的視覺協作。完成設計後,使用者可下載、複製、列印或分享,並可將作品交由他人進行最終修訂。
-
現在你可以與 Gmail 賬號對話,如 Google IO 2026 所示
Google 於 2026 年 2 月在其年度開發者大會 Google I/O 2026 上宣佈,將擴充套件 Gmail 的「AI 收件箱」功能,新增名為 Gmail Live 的對話式 AI 功能。該功能由 Gemini AI 驅動,允許使用者以自然語言提問,而非輸入關鍵字搜尋,從而快速查詢收件箱中隱藏的資訊。產品負責人 Devanshi Bhandari 表示,Gmail Live 能回答自然提問、回應後續問題,並在需要時切換話題。此功能可協助使用者查詢航班資訊、牙醫預約、Airbnb 門禁程式碼或學校活動等細節,甚至能從郵件中提取酒店房號或推斷未明確提及的人名。類似技術也將應用於 Google Keep 待辦事項清單。Gmail Live 不會取代傳統搜尋,初期僅限於 Google AI Ultra 訂閱者,預計於今年晚些時候推出。此外,Gmail 還獲得了即發草稿、即時檔案存取及管理待辦事項等新能力。此舉旨在回應外界對 AI 價值的質疑,並展示 AI 在實際產品中的應用價值。
-
Google 參考 Meta 策略,於 IO 2026 亮相全新音訊驅動智慧眼鏡
Google 於週二在 Google I/O 開發者大會上宣佈,正重返智慧眼鏡市場,並與 Warby Parker 及 Gentle Monster 合作推出全新 AI 驅動的眼鏡系列。這些裝置設計為與 Android 和 iOS 裝置相容,並與 Samsung 共同開發。Google 將這些新產品稱為「音訊眼鏡」,使用者可透過語音指令操作,並整合 Gemini 等應用程式與服務。演示中,一名 Google 員工僅透過語音即可線上點咖啡,裝置同步後即可執行指令。Google 曾於多年前推出 Google Glass,該產品最終引發了「眼鏡洞」一詞的負面稱呼。然而,隨著 Meta 等大公司及眾多創業公司投入該領域,市場格局已發生變化。此次合作預計於今年晚些時候上市。此外,文章還提及 Google 於 2026 年 Google I/O 的其他重大新聞,包括更新 Gemini 應用程式以應對 ChatGPT 和 Claude,以及推出全天候的 Gemini Spark 代理助手,該助手具備與 Gmail 的整合功能。
-
Google 擊出下一波 AI 風暴 傳遞 Agent 概念 不再依賴 Chatbot
Google 於週二推出了 Gemini 3.5 Flash,宣稱這是其目前編碼能力與自主 AI 代理最強勁的模型。該模型在 Google I/O 開發者大會上亮相,能獨立執行編碼流程、管理研究專案,並在內部測試中從零構建整個作業系統。此發布標誌著 Google 從將 AI 定位為對話工具轉向代理工具,強調其能進行規劃、構建與迭代,且需最少的人類介入。DeepMind 技術長 Koray Kavukcuoglu 表示,3.5 Flash 在品質與低延遲方面結合出色,在編碼、代理任務及多模態推理等幾乎所有基準測試中均優於最新邊界模型 3.1 Pro。其速度是其他邊界模型的 4 倍,而 Google 開發的最佳化版本在保持同等品質下更快達 12 倍,這對於需要同時執行的多代理長程任務至關重要。 在 I/O 現場,工程師 Varun Mohan 展示了代理在 Antigravity 開發平臺中分組工作並共同構建作業系統的演示。Kavukcuoglu 指出,Flash 3.5 與 Antigravity 共同開發,旨在為代理提供原生執行環境。Google 同時推出了 Antigravity 2.0,一款專為代理優先開發設計的獨立桌面應用程式。實際應用成效已顯現,銀行與金融科技企業正利用其自動化多週工作流程,資料科學團隊則在複雜環境中挖掘洞察。該模型可自主執行數小時,但在遇到需人類判斷的決策點或許可權問題時會暫停並請求輸入。 Google 即將推出的 3.5 Pro 模型將與 Flash 協同運作,Pro 作為協調者與規劃者,而 Flash 則作為執行子代理。目前 3.5 Flash 已成為 Gemini 應用程式及搜尋 AI 模式中的預設模型,搜尋平臺亦將引入代理功能。此外,該模型將驅動 Gemini Spark,一款全天候執行的個人 AI 代理,協助消費者管理數位生活。儘管面臨因使用者與 Gemini 對話後引發悲劇事件的訴訟壓力,Google 表示 Gemini 3.5 已加強網路安全及生化輻射核(CBRN)防護,並能更恰當地處理敏感問題。該模型今日透過 Antigravity、Gemini API、Gemini