實體: Gemini
所有提到 Gemini 的 AI 新聞與動態。
-
YouTube 現在會自動標註 AI 視頻
YouTube 宣佈將不再僅依賴創作者自行標記 AI 生成影片,而是由內部系統自動識別並貼上標籤。公司表示,當檢測到「顯著的寫實 AI」內容時,系統將自動介入。此舉發生在 Google 於 Google I/O 開發者大會上推出 Gemini Omni 多模態 AI 模型後,該模型能生成高品質且符合物理、文化及科學邏輯的影片。自今年五月起,YouTube 將利用新內部訊號識別並標記 AI 內容。雖然創作者仍被鼓勵主動披露,但若遺漏,影片將由平臺自動標記。若內容被誤判,創作者可更新披露狀態,但若使用 YouTube 自有工具如 Veo 或 Dream Screen 製作,則無法移除標籤。此外,若影片包含 C2PA 後設資料,表示完全由 AI 生成,標籤將永久附加。近期 OpenAI 已承諾採用 C2PA 標準,並與 Nvidia、Kakao 及 ElevenLabs 等機構合作。YouTube 同時擴充套件了 AI 深度偽造檢測功能,允許任何成人掃描影片尋找面部匹配,此前測試物件包括名人、公眾人物及政治人物。AI 標籤位置將調整以更具可見性:長影片標籤將顯示於播放器下方、描述上方,而 YouTube Shorts 則直接覆蓋在影片上。僅輕微修改或動畫內容(如奇幻場景)的標籤仍僅顯示於描述區。YouTube 強調此舉不會影響影片推薦機制或獲利能力。平臺持續投資 AI 技術,包括互動搜尋 Ask YouTube、音樂影片清單生成器、AI 影片摘要及其他生成式 AI 創作工具。
-
所有人皆正在實時應對AI安全議題 — 雖然連Google也不例外
在洛杉磯近期的一場活動中,Google Cloud 首席營運官 Francis deSouza 就企業在人工智慧(AI)安全方面的現狀與需求發表了看法。他強調,安全不能成為後顧之憂,企業必須採取平臺化方法,從一開始就要求平臺具備安全、治理與可審計性。deSouza 特別警告了「影子 AI」的風險,即員工使用未經組織監督的消費級工具。他指出,沒有資料策略與安全策略的 AI 戰略是不存在的,且企業實際上多處於多雲環境,需確保跨雲與跨模型的安全態勢一致。 隨著攻擊面的擴大,傳統防禦模型已顯不足。攻擊者從初始滲透到進入下一階段的時間已從八小時縮短至 22 秒。deSouza 提出,企業需以機器速度應對機器速度,發展出 AI 原生且完全由代理(agents)驅動的防禦體系,讓人類監督而非直接操作防禦。然而,具備相關資質的領導人才匱乏,且 AI 引入的漏洞擴散速度遠快於安全團隊的應對能力。 此外,文章提及 Google Cloud 開發者面臨的實際安全挑戰。近期有開發者因 API 金鑰洩露而收到高達數萬美元甚至五萬美元的未授權 Gemini 模型呼叫費用。Google 雖在報導後退款,但表示無意改變自動升級收費層級的政策,優先防止服務中斷。安全公司 Aikido 的研究進一步指出,即使開發者立即刪除洩露的金鑰,攻擊者仍可持續使用該金鑰約 23 分鐘,因為 Google 的撤銷機制傳播緩慢。相比之下,服務帳戶金鑰僅需約五秒撤銷,顯示當前問題更多源於公司優先順序而非技術限制。這凸顯了平臺提供商所宣稱的安全建議與其自身適應速度之間存在的差距。
-
我們試用過谷歌的 AI 眼鏡,它們幾乎已就緒
在 Google I/O 開發者大會上,Google 展示了其下一代 AI 眼鏡的原型機,這與公司預計今年秋季推出的僅具音訊功能的版本不同,新產品將提供音訊與視覺的結合體驗。這款 Android XR 眼鏡內建顯示器,可將天氣、導航、Uber 取車資訊、即時翻譯等小工具疊加在現實世界之上,甚至支援使用者利用 AI 自訂小工具。該產品由 Warby Parker、Gentle Monster 和 Samsung 共同開發,並與 iOS 及 Android 手機相容。 測試版本仍為原型,主要用於驗證顯示技術與電池效能,外觀與最終出貨版在尺寸與細節上會有差異。出貨版將具備自動偵測佩戴狀態的功能。使用者透過兩秒鐘按壓右側鏡框即可啟動 Gemini AI,此時會發出提示音。在演示中,啟動 Gemini 同時開啟相機,但出貨版將允許使用者自行設定。初步測試顯示,透過眼鏡播放音樂雖能聽見,但音質不如高品質耳機,不過在戶外活動時能保持環境音的通透性。 功能測試方面,照片拍攝需按下按鈕,影像會傳輸至手機與手錶,並可透過 Gemini 進行 AI 編輯,例如將人物轉化為動漫角色,此過程在現場網路負載下約需 45 秒。開啟顯示器後,使用者可見包含天氣與倒數計時的小工具介面,單眼顯示器雖有輕微模糊與眼部疲勞感,但功能完整。語言翻譯功能表現優異,能即時將西班牙語轉為英文文字顯示並口語朗讀,此功能亦適用於音訊版眼鏡。導航功能則與手機 Google Maps 整合,透過抬頭顯示方向並向下檢視地圖定位,支援模糊搜尋如「最近的咖啡館」。此外,眼鏡還能識別物體並回答問題,如辨識畫作或提供食譜建議,雖然部分功能目前可透過 Google Lens 完成,但無須掏出手機的操作體驗仍具吸引力。Google 表示,音訊版眼鏡同樣支援 Gemini AI,可進行音樂播放、拍照、通話及控制手機應用程式,甚至能辨識廚房中的料理並提供烹飪建議。公司預計今年晚些時候將擴大 Android XR 測試計畫並公佈更多資訊。
-
Google 推出 AI 代理生態系吸引消費者關注
Google 在週二舉行的 I/O 開發者大會上推出了多項 AI 代理產品,包括資訊代理、Gemini Spark、Android Halo 以及每日簡報 Daily Brief。這些功能旨在讓使用者在背景中運作,協助追蹤市場趨勢、價格或天氣,並整合 Gmail、Google Docs 等產品以處理日常任務。然而,這些功能目前主要針對付費訂閱者推出,美國使用者可於今年夏天開始使用資訊代理,Gemini Spark 則將很快開放給 Google Ultra 訂閱者,Android Halo 預計於今年晚些時候上線。Daily Brief 則將向 Ultra、Pro 及 Plus 訂閱者逐步推出。 儘管 Google 展示了這些技術的潛力,例如透過 Chrome 瀏覽器協助配置汽車選項,但許多產品尚未正式發售,且僅限於付費使用者。這種策略導致普通消費者難以接觸到這些工具,而他們正面臨支付賬單、尋找工作等實際挑戰。此外,Google 在演示中使用的卡通風格動畫和資料中心建設的暗示,引發了對 AI 技術可能帶來的社會影響的擔憂。與過去推出 Gmail 和 Google Search 等免費革命性產品不同,此次 Google 更傾向於透過付費訂閱迭代功能,而非讓大眾免費使用。相比之下,其他 AI 起點公司如 Poke、Poppy 和 Wingman 則透過訊息應用程式提供更自然的互動方式。Google 未能有效傳達 AI 代理如何減少螢幕時間並解決日常問題,導致這些工具對大多數人而言仍遙不可及。