實體: Veo
所有提到 Veo 的 AI 新聞與動態。
-
印度領先於谷歌的Nano Banana,並融入在地創意風格
Google 的 Nano Banana 影象生成模型(正式名稱為 Gemini 2.5 Flash Image)自上月推出以來,推動了 Gemini 應用程式在全球的熱潮,尤其在印度引發了獨特的創意風潮。根據 Google DeepMind 多模態生成負責人 David Sharon 的說法,印度目前是全球 Nano Banana 使用量最高的國家,該模型在印度 App Store 和 Google Play 免費應用程式排行榜上均居首位,且根據 Appfigures 資料,Gemini 已登上全球應用程式商店排行榜前列。印度作為全球第二大智慧型手機市場和第二大網路人口國家,其採用率自然領先,但 Google 更關注的是印度使用者如何使用該模型。 印度使用者展現出高度創意且具在地特色的用法,例如重現 1990 年代寶萊塢電影風格的復古造型,包括當時的服裝、髮型和妝容;還有被稱為"AI 紗麗”的趨勢,使用者生成身穿傳統印度服飾的復古肖像。此外,使用者還將自己置於倫敦大本鐘或英國復古電話亭等地標前,甚至將自己變成復古郵票或微型人偶。雖然某些趨勢如微型人偶最初源自泰國,但印度在將其推向全球方面扮演了關鍵角色。除了 Nano Banana,印度使用者還利用 Gemini 中的 Veo 3 影片生成模型,從祖父母或高祖父母的舊照片中建立短片。 資料顯示,Gemini 應用程式在印度的下載量極其驚人。從一月到八月,印度月均下載量約為 190 萬,比美國高出 55%,佔全球月均下載量的 16.6%。截至今年八月,印度總下載量達 1520 萬,而美國為 980 萬。Nano Banana 更新於九月一日推出後,印度每日下載量急劇上升,九月十三日達到峰值 41.4 萬次,增幅達 667%。Gemini 自九月十日以來在 iOS App Store 排名第一,九月十二日在 Google Play 也奪得全類別榜首。儘管印度在內購支出上未居首位,全球 iOS 內購總額約為 640 萬美元,其中美國佔 230 萬美元(35%),印度僅佔 9.5 萬美元(1.5%),但印度在九月一至十六日間的支出成長
-
YouTube 公告推出新生成式 AI 工具協助 Shorts 創作者
YouTube 於週二在「Made on YouTube」直播活動中,為 Shorts 創作者推出了全新的生成式 AI 工具。公司將 Google 的文字生成影片模型 Veo 3 的自訂版本 Veo 3 Fast 引入 Shorts,該版本在 480p 解析度下具有更低的延遲,並首次支援帶音效的影片生成。此次更新已在美國、英國、加拿大、澳大利亞和紐西蘭地區開始 rollout,未來將擴充套件至更多地區。 YouTube 還帶來了新的 Veo 功能,允許將影片中的動作應用到圖片上,例如讓靜態圖片中的人物根據影片進行舞蹈動作,這是透過捕捉並轉移一個主體到另一個主體的運動技術實現的。創作者現在還可以使用 Veo 為影片應用不同風格,如波普藝術或摺紙風格,並能透過文字描述新增角色或道具。這些功能預計將在未來幾個月內推出。 此外,YouTube 推出了新的混音工具,創作者可以將合格影片中的對話轉化為其他 Shorts 的 catchy 音軌。YouTube 產品總監 Dina Berrada 表示,作為全球最大的創意樂園,YouTube 是趨勢的發源地。該新功能利用 Google 的 AI 音樂模型 Lyria 2 來建立音軌,創作者可以為歌曲新增自己的氛圍,如「放鬆」、「適合跳舞」或「有趣」。此功能預計很快會進行測試,並在未來幾週內向美國更多創作者推出。 最後,新的「Edit with AI」功能允許創作者將原始素材轉化為初稿。該功能透過識別和排列最佳時刻、新增音樂和轉場,甚至新增能對影片內容做出反應的英語或印地語旁白,為創作者提供 Shorts 的起點。YouTube 正在 Shorts 和 YouTube Create 應用中測試此功能,並計劃在未來幾週內在選定市場擴充套件該功能。
-
Google Photos 升級影像轉視訊功能採用 VEO 3
Google 最新推出的影片生成模型 Veo 3 即將登陸 Google Photos 應用。該新功能位於手機版的 Create 標籤頁,允許美國使用者將靜態圖片轉化為影片片段。雖然 Google Photos 此前已透過「照片轉影片」功能提供基礎服務,但公司表示引入 Veo 3 能顯著提升影片質量。此次發布也體現了 Google 將其最新 AI 技術透過產品推向消費者的策略,截至 2025 年 5 月,Google Photos 的月活躍使用者數已超過 15 億。 Veo 3 於 5 月在 I/O 開發者大會上首次亮相,後於 7 月加入 Gemini 應用,並僅限於 AI Ultra 和 AI Pro 訂閱計劃使用者使用。這些訂閱使用者每天可生成三段影片,且影片上會帶有可見或不可見的水標記以識別其 AI 生成屬性。在 Google Photos 中,該功能旨在讓使用者將回憶帶入現實,甚至為舊照片賦予動態效果。現有的照片轉影片功能由 Veo 2 驅動,使用者可從相簿選擇照片,並從「微妙動作」或「驚喜動畫」兩個提示詞中選擇,點選「我感覺幸運」按鈕後,系統會生成一段六秒長的影片供分享。 隨著 Veo 3 的加入,該功能在 Google Photos 中將保持免費,但僅限於有限次數的生成。AI Pro 和 AI Ultra 訂閱使用者則可獲得更多生成次數。不過,該功能目前不支援音訊,且生成的影片長度為四秒。新特性位於 Google Photos 應用內的新「Create 中心」,這是一個專門探索由 AI 驅動的創意工具和功能的區域。除了 Veo 3,該中心還包含照片風格重混、製作拼貼畫、從相簿組裝蒙太奇、建立名為「電影感」的動態 3D 照片,以及將圖片轉換為 GIF 的工具。
-
Meta 與 Midjourney 合作開發 AI 圖像與影片模型
Meta 與 Midjourney 簽署合作協議,授權後者使用其 AI 影像與影片生成技術。Meta 首席 AI 官 Alexandr Wang 於週五在 Threads 上宣佈此訊息,表示 Meta 的研究團隊將與 Midjourney 合作,將該技術整合到未來的 AI 模型與產品中。Wang 強調,為了交付最佳產品,Meta 必須採取全面策略,包括頂尖人才、雄心勃勃的運算路線圖,以及與行業最佳夥伴合作。此次合作有助於 Meta 開發能與 OpenAI 的 Sora、Black Forest Lab 的 Flux 以及 Google 的 Veo 等領先 AI 影像與影片模型競爭的產品。 去年,Meta 推出了自有 AI 影像生成工具 Imagine,並將其應用於 Facebook、Instagram 和 Messenger 等產品中。此外,Meta 還擁有 AI 影片生成工具 Movie Gen,允許使用者根據提示建立影片。此次與 Midjourney 的授權協議標誌著 Meta 在 AI 競賽中保持領先的最新舉措。今年早些時候,Meta 執行長 Mark Zuckerberg 展開了大規模 AI 人才招聘,部分研究人員的薪酬包高達一億美元以上。Meta 還投資了十四億美元於 Scale AI,並收購了 AI 語音起點 Play AI。Zuckerberg 曾與 Elon Musk 討論加入其對 OpenAI 的九十七億美元收購案,但最終未成行。 關於合作細節,Midjourney 執行長 David Holz 表示公司保持獨立,未接受外部投資。Midjourney 成立於 2022 年,憑藉其寫實且獨特的風格迅速成為 AI 影像生成領域的領導者。2023 年,該公司預計營收可達二億美元,訂閱服務起價為每月十美元,最高階別每月可達一百二十美元。今年六月,Midjourney 推出了首款 AI 影片模型 V1。此次合作發生在 Midjourney 被迪士尼和環球影視集團起訴僅兩個月之後,兩家指控其利用版權作品訓練 AI 影像模型。儘管近期涉及 AI 訓練資料的訴訟多傾向於科技企業,但相關爭議仍持續存在。