實體: Veo
所有提到 Veo 的 AI 新聞與動態。
-
Google 發佈 Gemini CLI,一款用於終端機的開放源碼 AI 工具
Google 於週三宣佈推出 Gemini CLI,這是一款旨在讓開發者能在終端機本地執行的代理型 AI 工具。該工具將 Google 的 Gemini AI 模型與本地程式碼庫連線,允許開發者透過自然語言請求來解釋複雜程式碼、撰寫新功能、除錯或執行命令。Gemini CLI 是 Google 推動開發者將其 AI 模型整合進編碼工作流的一部分,旨在與 OpenAI 的 Codex CLI 及 Anthropic 的 Claude Code 等命令列 AI 工具競爭。自今年四月推出 Gemini 2.5 Pro 以來,該模型深受開發者喜愛,並帶動了 Cursor 和 GitHub Copilot 等第三方工具的使用。為建立直接關係,Google 推出了 Gemini CLI,其不僅可用於編碼,還能結合 Google 的 Veo 3 模型製作影片、利用 Deep Research 代理生成研究報告,並透過 Google Search 獲取即時資訊。此外,Gemini CLI 可連線 MCP 伺服器以存取外部資料庫。為了鼓勵採用,Google 將該工具以 Apache 2.0 許可證開源,並提供慷慨的使用限制:免費使用者每分鐘可傳送 60 個模型請求,每天 1,000 個請求,約為開發者以往使用該工具時平均數值的兩倍。儘管如此,使用 AI 編碼工具仍存在風險,根據 2024 年 Stack Overflow 的調查,僅有 43% 的開發者信任 AI 工具的準確性,且相關研究顯示這些模型偶爾會引入錯誤或未能修復安全漏洞。
-
Midjourney 發布首款 AI 視頻生成模型 V1
Midjourney 於 2025 年 6 月 18 日宣佈推出其備受矚目的 AI 影片生成模型 V1。該模型允許使用者上傳圖片或 Midjourney 其他模型生成的圖片,並自動產生四段每段五秒的影片。V1 僅透過 Discord 平臺提供,初期僅支援網頁端使用,訂閱費用為每月 10 美元。此舉使 Midjourney 與 OpenAI 的 Sora、Runway 的 Gen 4、Adobe 的 Firefly 及 Google 的 Veo 3 等競爭對手展開競爭。Midjourney 執行長 David Holz 表示,該模型是邁向建立具備「即時開放世界模擬」能力的 AI 模型的下一步,未來還將開發用於 3D 渲染及即時 AI 的模型。 然而,Midjourney 在推出 V1 僅一週前,便面臨迪士尼與環球影業的訴訟。兩家影業公司指控 Midjourney 的 AI 模型生成了涉及荷馬·辛普森與達斯·維達等受版權保護角色的圖片。儘管 Midjourney 強調其產品專注於創意而非商業應用,並指出影片生成費用將是圖片生成的八倍,但版權爭議仍無法迴避。針對 V1,使用者可選擇自動動畫或手動描述特定動畫,並調整相機與主體移動幅度,設定為「低動態」或「高動態」。雖然初始影片長度為五秒,但使用者可透過延長功能將影片最長擴充套件至 21 秒。目前,訂閱 Midjourney 的 $60 專業版或 $120 巨無霸版計畫,即可享有在較慢的「放鬆」模式下無限次生成影片。初期評價正面,但與市場上已存在數月的其他領先 AI 影片模型相比,其表現仍待觀察。