實體: Veo
所有提到 Veo 的 AI 新聞與動態。
-
YouTube 現在會自動標註 AI 視頻
YouTube 宣佈將不再僅依賴創作者自行標記 AI 生成影片,而是由內部系統自動識別並貼上標籤。公司表示,當檢測到「顯著的寫實 AI」內容時,系統將自動介入。此舉發生在 Google 於 Google I/O 開發者大會上推出 Gemini Omni 多模態 AI 模型後,該模型能生成高品質且符合物理、文化及科學邏輯的影片。自今年五月起,YouTube 將利用新內部訊號識別並標記 AI 內容。雖然創作者仍被鼓勵主動披露,但若遺漏,影片將由平臺自動標記。若內容被誤判,創作者可更新披露狀態,但若使用 YouTube 自有工具如 Veo 或 Dream Screen 製作,則無法移除標籤。此外,若影片包含 C2PA 後設資料,表示完全由 AI 生成,標籤將永久附加。近期 OpenAI 已承諾採用 C2PA 標準,並與 Nvidia、Kakao 及 ElevenLabs 等機構合作。YouTube 同時擴充套件了 AI 深度偽造檢測功能,允許任何成人掃描影片尋找面部匹配,此前測試物件包括名人、公眾人物及政治人物。AI 標籤位置將調整以更具可見性:長影片標籤將顯示於播放器下方、描述上方,而 YouTube Shorts 則直接覆蓋在影片上。僅輕微修改或動畫內容(如奇幻場景)的標籤仍僅顯示於描述區。YouTube 強調此舉不會影響影片推薦機制或獲利能力。平臺持續投資 AI 技術,包括互動搜尋 Ask YouTube、音樂影片清單生成器、AI 影片摘要及其他生成式 AI 創作工具。
-
Google 的 Gemini Omni 可將圖片、音訊和文字轉換為影片 —— 這僅是開始
Google 於 Google I/O 開發者大會上推出 Gemini Omni 系列多模態模型,旨在實現從任何輸入建立任何內容的目標。該系列首發的 Gemini Omni Flash 模型今日開放使用,整合了影象、音訊、影片和文字,並能透過推理產生符合物理、文化、歷史及科學邏輯的高質量影片。與現有 Veo 模型不同,Omni 允許使用者使用普通文字指令編輯照片,類似於 Nano Banana 功能,並支援生成帶有自定義數字頭像的影片。為防止深度偽造,使用者需透過記錄聲音和數字進行認證,且所有生成的影片將包含 Google SynthID 數字水印。Omni Flash 初始可渲染十秒影片,主要面向消費者市場,未來將推出更長時長版本及效能更強的 Omni Pro 模型。該技術將透過 API 向企業和創意工作者開放,並可應用於廣告製作和電影行業。此外,Google 還推出了 Gemini Spark 全天候代理助手,並更新了 Gemini 應用以應對競爭。
-
更多Gemini功能即將登上Google TV
Google 於週三宣佈推出新一代 AI 驅動功能,將整合至 Google TV,並新增專用的短影片資訊流,直接將 YouTube Shorts 帶入主畫面。此次更新的核心是強化 Gemini 能力,在 Gemini 標籤頁內新增「Create」按鈕,讓使用者可體驗生成式 AI 工具 Nano Banana 與 Veo。這些功能首批在 Gemini 支援的美國 TCL 電視上推出,後續將擴充套件至更多裝置。Nano Banana 是 Google 的圖片生成與編輯模型,使用者可透過簡單語音指令轉換照片,例如更換服裝、改變背景或生成全新場景,Google 將其定位為家庭共享體驗,鼓勵使用者提出趣味指令,如讓 AI 製作「我爸爸穿著可笑服裝」的照片以博取家人笑聲。Veo 則允許使用者從零開始創作影片片段,或透過描述情境讓靜態圖片動起來,例如指令「讓我的祖父在太空中做月球漫步」。此外,Google Photos 也在 Google TV 上獲得升級,整合 Gemini 驅動搜尋功能,使用者可快速檢索特定回憶,如度假或生日派對,無需翻找整個資料庫,結果以可瀏覽格式呈現,方便全螢幕檢視或啟動動態影片。新增的「Remix」功能可讓使用者將照片應用水彩或油畫等藝術風格,而「Dynamic Slideshows」則引入動畫佈局、邊框與色彩處理,使用者可透過設定螢幕保護程式將任何 Google Photos 收藏集轉化為適合電視播放的生動影片。除了 AI 工具,Google 也針對短影片趨勢推出新「Short videos for you」欄位,近期將包含 YouTube Shorts 內容,此舉呼應 YouTube 近期在手機端新增隱藏 Shorts 選項所反映的混合使用者需求,Google 暗示未來可能擴充套件至其他平臺。Instagram 已於今年初將 TV 應用程式擴充套件至美國 Google TV 裝置。
-
Google地圖即將迎來強大的AI升級
Google 於本週在拉斯維加斯舉辦的 Cloud Next 活動中,正式推出針對企業使用者設計的新一代生成式 AI 功能,旨在強化其地圖與地理空間應用。其中一項名為「Maps Imagery Grounding」的新功能,允許企業使用者透過 Gemini Enterprise Agent Platform 輸入提示詞,即可在 Google Street View 中快速生成逼真的場景,用於視覺化電影拍攝場地或規劃中的建築工地,甚至可結合 Veo 技術進行場景動畫製作。此外,Google 還擴充了對衛星影像資料的分析能力,推出「Aerial and Satellite Insights」功能,讓使用者能直接在 Google Cloud 的 BigQuery 資料倉儲中分析影像,將原本需要數週的工作縮短至數分鐘內完成。同時,Google 推出了兩款新的 Earth AI Imagery 模型,這些系統經過訓練能自動識別影像中的特定物件,如橋樑、道路和電力線路,大幅降低了企業自行開發和訓練 AI 系統所需數月的時間成本。目前,Google 的 Earth AI 平臺已與空客及波士頓兒童醫院等合作夥伴共同應用於環境監測與災難應變等領域,這些更新為企業、資料分析師及城市規劃者帶來了全新的可能性。