實體: Veo
所有提到 Veo 的 AI 新聞與動態。
-
Google為Veo 3新增圖像轉視頻生成功能
Google 於週四宣佈,將其影象轉影片生成功能新增至 Veo 3 AI 影片生成器,並透過 Gemini 應用程式提供。該功能此前已於五月在 Google I/O 開發者大會上推出的 AI 影片工具 Flow 中率先測試。自五月推出 Veo 3 驅動的影片生成後,Google 已於上週將此功能開放至全球超過 150 個國家。目前,僅 Google AI Ultra 和 Google AI Pro 計劃使用者可享有此功能,每日限生成三則影片,且無累積機制。 使用者可透過在提示框中選擇「影片」選項並上傳照片來生成影片片段,同時也能在提示中描述聲音以新增音效。影片生成後可下載或分享。Google 指出,自該功能推出七週以來,使用者已在 Gemini 應用程式和 Flow 工具中建立超過 4000 萬則影片。所有使用 Veo 3 模型生成的影片將帶有可見的「Veo」水印,以及 Google AI 工具採用的不可見 SynthID 數位水印,用於識別 AI 生成的數位內容。今年早些時候,Google 還發布了檢測包含 SynthID 內容的工具。
-
Google將Gemini帶上Wear OS智慧手錶 并為Circle to Search新增AI模式
Google 於週三宣佈將 Gemini 功能正式推出至 Wear OS 智慧手錶,此舉距五月份的首次預告已近兩個月。此次更新涵蓋 Pixel、Samsung、OPPO、OnePlus 及 Xiaomi 等品牌執行 Wear OS 4 以上系統的手錶。使用者可透過說「Hey, Google」、長按側邊按鈕或點選 Gemini 圖示來啟動對話。Gemini 能協助使用者在烹飪時詢問蔬菜烤製時間與溫度,或出門前查詢天氣是否需要雨傘。此外,Gemini 還能跨應用執行任務,如總結郵件內容、將棒球賽程加入日曆,或記住停車位置與購物提醒。 Google 同時強化了 Circle to Search 功能,讓使用者透過圈選、高亮或書寫螢幕內容即可啟動搜尋。該功能現已整合 AI Mode,提供 AI 摘要並允許使用者不切換應用程式進行深入提問。此功能目前於美國與印度開放,並支援 Google Lens 及 Android 與 iOS 裝置,甚至可應用於手機遊戲中識別角色或尋找策略。Google 亦最佳化 AI Overviews 的回應格式,使其更清晰且包含更多視覺元素。最後,Pixel 9 Pro 使用者將免費獲得一年 Google AI Pro 訂閱服務,包含使用 Veo 3 將想法轉化為帶有自然音效的短片。
-
Google 全球推出全新 Veo 3 電影生成模型
Google 於週四宣佈,已開始將 Veo 3 影片生成模型逐步推給 Gemini 使用者,目前涵蓋超過 159 個國家。透過此新模型進行影片生成僅限於 Google AI Pro 付費訂閱使用者,且每日上限為三則影片。Veo 3 模型於五月首次亮相,允許使用者透過文字提示生成長達八秒的影片。Google 的 Josh Woodward 表示,公司正致力於為 Gemini 增加圖片轉影片的功能。
-
Google 的 Veo 3 是否 playable world models 的開端?
Google 執行長 DeepMind 總裁 Demis Hassabis 於二日傍晚表示,其最新影片生成模型 Veo 3 或許可應用於電子遊戲領域。此回應針對 X 平臺上使用者請求「讓我用 Veo 3 影片玩遊戲」的帖子,Hassabis 幽默地回答「那該多有趣啊」。隨後,Google AI Studio 產品負責人 Logan Kilpatrick 以三個閉嘴表情符號回應。儘管 Google 發言人表示目前無新資訊,但構建可玩世界模型並非不可能。世界模型與影片生成模型不同,前者模擬真實環境動態以預測世界演變,後者則合成真實影片序列。Google 計劃將多模態基礎模型 Gemini 2.5 Pro 轉化為模擬人類大腦部分功能的模型。去年十二月,DeepMind 推出了 Genie 2,該模型能生成無限種可玩世界。隨後 Google 成立新團隊開發模擬真實世界的 AI 模型。其他機構如 AI 先驅 Fei-Fei Li 的 World Labs 也從隱蔽狀態中走出,開發能從單張圖片生成遊戲般 3D 場景的系統。Veo 3 目前處於公開預覽階段,可建立影片及配對的音訊,包括語音和樂曲。雖然 Veo 3 透過模擬物理學實現逼真動作,但它仍非世界模型,而是用於遊戲電影敘事、預告片及敘事原型設計的「被動輸出」生成模型。未來模型需轉變為更主動、互動且可預測的模擬器。遊戲生產的真正挑戰在於實時、一致且可控的模擬。因此,Google 未來若涉足遊戲或可玩世界開發,或許會採取結合 Veo 與 Genie 的混合方法。Google 可能面臨與 Microsoft、Scenario、Runway、Pika 以及最終 OpenAI 的影片生成模型 Sora 競爭。考慮到 Google 在世界模型領域的計劃及其雄厚的資金與分發能力,競爭對手應密切關注此領域動態。