實體: Gemini
所有提到 Gemini 的 AI 新聞與動態。
-
Google預告新款Gemini功能於CES 2026電視應用
Google 於十一月將 Gemini AI 引入 Google TV 裝置,旨在提升電視觀看體驗。在拉斯維加斯舉行的 CES 2026 展會上,Google 展示了即將上線的一系列新 Gemini 功能,讓觀眾能深入探討主題、利用 AI 搜尋並重構個人照片與影片,甚至透過語音指令直接控制電視操作,無需複雜的設定導航。這些功能將先於選定的 TCL 電視推出,隨後逐步擴充套件至其他 Google TV 裝置。專為大螢幕設計的 Gemini for Google TV 允許使用者透過自然語言對話尋找節目、獲取劇情摘要或獲得推薦,例如詢問適合兩人口味的影片、回憶不起片名但能描述劇情或提及演員,或是查詢熱門醫院劇集。Gemini 透過新的視覺豐富框架回應問題,結合文字、影像、影片背景及即時體育更新。此外,電視螢幕不僅限於娛樂,還可用作教育工具,提供敘述式互動概覽以簡化概念,並允許使用者提出後續問題深入學習。使用者還能查詢 Google 照片庫中特定人物或時刻,運用 Gemini AI 為照片和影片套用藝術風格,將回憶轉化為電影風格的動態影集。最實用的功能之一是透過語音最佳化電視設定,使用者可指示「畫面太暗」或「聽不清對白」,Gemini 將自動調整相關設定,無需離開當前節目。Google 表示,新 Gemini 功能需要裝置執行 Android TV OS 14 或更高版本,並需連線網路。並非所有語言、國家或裝置在發售時皆支援,且使用者必須擁有 Google 帳號才能存取 Gemini for TV 體驗。
-
Waymo 正測試 Gemini 作為車內 AI 助手用於其機械驅動計程車
根據研究員簡·曼楚恩·黃(Jane Manchun Wong)的發現,Waymo 似乎正在測試將 Google 的 Gemini AI 聊天機器人整合進其無人駕駛計程車中,旨在開發一位能陪伴乘客並回答其問題的 AI 助手。黃在部落格文章中披露,她在挖掘 Waymo 手機應用程式程式碼時,發現了該未發布 Gemini 整合的完整系統提示(system prompt)。這份內部標題為「Waymo Ride Assistant Meta-Prompt」的檔案包含超過 1,200 行規格說明,詳細定義了 AI 助手在車內的行為準則。 雖然此功能尚未在公開版本中推出,但系統提示顯示這不僅僅是一個簡單的聊天機器人。該助手被指示具備回答問題、管理車內特定功能(如空調控制)以及在必要時安撫乘客的能力。Waymo 發言人朱莉婭·伊琳娜(Julia Ilina)表示,團隊正在不斷調整功能以讓搭乘體驗更令人愉悅、無縫且實用,但部分功能可能不會最終上線。Waymo 此前已利用 Gemini 的「世界知識」訓練其自動駕駛車輛,以應對複雜、罕見且高風險的場景。 根據系統提示,該助手被賦予明確的身份與目的,即成為「整合於 Waymo 自動駕駛車輛中的友好且有用的 AI 夥伴」,其主要目標是透過提供有用資訊和協助來提升乘客體驗,方式需安全、令人安心且不顯眼。機器人被指示使用清晰簡潔的語言,避免技術術語,並將回應限制在一到三句話內。當乘客透過車內螢幕啟動助手時,Gemini 可從預設的、以乘客名字為基礎的問候語中選擇。系統也能存取關於乘客的上下文資料,例如他們搭乘過多少次 Waymo 行程。 目前,Gemini 可存取並控制車內功能,包括溫度、照明和音樂。值得注意的是,音量控制、路線變更、座椅調整和窗戶控制等功能不在其控制清單中。若乘客詢問 Gemini 無法控制的特性,機器人應回覆「 aspirational phrases」(如「這是我目前還無法做到的事情」)。系統提示還要求助手明確區分其 Gemini AI 助手的身份與自動駕駛技術(Waymo Driver)。例如,當被問及「你如何看路?」時,不應回答「我使用多種感測器」,而應回答「
-
Google推出Gemini 3 Flash並將其設為Gemini應用的預設模型
Google 今日發布了快速且廉價的 Gemini 3 Flash 模型,該模型基於上月發布的 Gemini 3,旨在與 OpenAI 競爭。此模型將成為 Gemini 應用程式及搜尋 AI 模式中的預設模型,距離 Google 宣佈 Gemini 2.5 Flash 模式已過去六個月,帶來顯著改進。在測試中,Gemini 3 Flash 在無工具使用的情況下,於「人類最後考試」 benchmarks 獲得 33.7% 的成績,優於 Gemini 2.5 Flash 的 11%,並與 Gemini 3 Pro 的 37.5% 及 GPT-5.2 的 34.5% 相當。在 MMMU-Pro 多模態與推理 benchmarks 上,該模型以 81.2% 的成績超越所有競爭對手。 Google 已在全球範圍內將 Gemini 3 Flash 設為 Gemini 應用程式的預設模型,取代 Gemini 2.5 Flash,使用者仍可選擇 Pro 模型處理數學與編碼問題。新模型擅長識別多模態內容,例如上傳pickleball 短影片獲取建議、繪製草圖讓模型猜測內容,或上傳音訊進行分析與生成測驗。此外,使用者還可透過提示詞在應用程式中建立應用原型。Gemini 3 Pro 現已對美國所有人開放,用於搜尋,更多美國使用者也能訪問 Nano Banana Pro 影象模型。 企業與開發者方面,JetBrains、Figma、Cursor、Harvey 和 Latitude 等公司已使用 Gemini 3 Flash,該模型透過 Vertex AI 和 Gemini Enterprise 提供。開發者可透過 API 和 Antigravity 編碼工具預覽該模型。Gemini 3 Pro 在 SWE-bench 驗證編碼 benchmarks 上得分 78%,僅次於 GPT-5.2。該模型適合影片分析、資料提取和視覺問答,因速度快而適用於快速重複工作流程。定價為每百萬輸入 token 0.50 美元,每百萬輸出 token 3.00 美元,略高於 Gemini Flash 2.5 的 0.30 美元和 2.50 美元,但 Google 聲稱新模型效能優於 Gemini 2.5 Pro 且速度快三倍,思考任務平均減少 30% 的 token 使用。
-
Google 的 vibe-coding 工具 Opal 現已支援 Gemini
Google 宣佈將其「vibe-coding」工具 Opal 整合進 Gemini 網頁應用程式中,允許使用者無需編寫程式碼即可建立 AI 驅動的微型應用程式。該工具位於 Gems 管理員內,Gems 是 Google 於 2024 年推出的針對特定任務或情境的 Gemini 自訂版本,例如學習教練、腦力激盪助手、職業指南、編碼夥伴及編輯器。Opal 讓使用者透過自然語言描述所需應用程式,系統會利用不同的 Gemini 模型自動生成,並提供視覺編輯器來排列步驟與連結功能。此功能可將使用者的提示轉化為步驟清單,使建立應用程式更直觀。若需進階自訂選項,使用者可前往 opal.google.com 使用 Advanced Editor。建立完成的微型應用程式可重複使用。隨著過去幾年 AI 程式設計的流行,市場上已出現 Lovable、Cursor、Anthropic 及 OpenAI 等公司的相關產品,以及專注於消費者的 Wabi 等工具。Gemini 網頁應用程式可於 gemini.google.com 使用。