實體: Gemini
所有提到 Gemini 的 AI 新聞與動態。
-
Google推出Lyria 3 Pro音樂生成模型
Google 於週三宣佈推出 Lyria 3 Pro,這是繼 Lyria 3 發布一個月後推出的音樂生成模型。新模型允許使用者建立長達三分鐘的曲目,相比 Lyria 3 提供的 30 秒短曲目有顯著提升。Lyria 3 Pro 還提供了更好的創意控制和自訂功能,使用者可在提示中指定樂曲的不同元素,如前奏、主歌、副歌和橋段,因為該模型對樂曲結構的理解優於前代產品。此前,Google 已在 Gemini 應用中透過 Lyria 3 引入音樂生成能力,Pro 版本同樣在 Gemini 應用中推出,但僅付費訂閱使用者可訪問。此外,Lyria 3 Pro 也將部署於 Google Vids 影片編輯應用和 ProducerAI 音樂生產工具中,後者是 Google 上月收購的生成式 AI 音樂生產工具。Google 還將音樂生成能力擴充套件至企業工具,包括 Vertex AI(公共預覽版)、Gemini API 和 AI Studio。Google 強調,該模型使用來自其合作伙伴以及 YouTube 和 Google 的許可資料進行訓練,並表示模型不會模仿特定藝術家,但若使用者在提示中指定藝術家,模型會從該藝術家那裡獲取「廣泛靈感」來生成曲目。所有使用 Lyria 3 和 Lyria 3 Pro 創作的曲目均標記有 SynthID,以表明該曲目由 AI 生成。本週早些時候,Spotify 推出了讓藝術家審查以他們名字發布的歌曲的新工具,防止 AI 生成音樂被錯誤歸屬。同時,Deezer 也推出了讓任何流媒體服務識別 AI 生成音樂的工具。
-
Google TV 新推出的 Gemini 功能讓球迷隨時掌握球隊動態及其他資訊
Google 於週二在 Google TV 上推出了三款由 Gemini 驅動的新功能,包括 AI 驅動的視覺回應、深入探索任何主題的能力,以及對體育比賽的旁白概覽。其中引人注目的新增功能是視覺回應,例如當使用者詢問勇士隊比賽的比分時,系統會提供即時比分卡及觀看地點資訊;使用者亦可搜尋食譜,Gemini 會搭配相關影片教程進行補充。此外,Google TV 還引入了「深度探索」功能,允許使用者對健康、經濟、科技等複雜主題進行詳細探討,系統會提供旁白視覺分解,使用者可透過選擇「深入探索」選項或進入 Gemini 標籤頁的「學習」功能來啟動。針對體育迷,Gemini 推出了「體育簡報」,讓使用者無需觀看每場直播即可透過旁白概覽 NBA、NHL 和 MLB 等聯盟的最新動態與亮點。這些功能目前正逐步向美國和加拿大使用者推出,Google 計劃於今年春季將 Gemini 的能力擴充套件至澳洲、紐西蘭和英國,隨後其他國家也將跟進。Gemini 最初於 2025 年 9 月在 Google TV 上推出,當時僅針對部分 TCL 電視進行有限發布,隨後已擴充套件至更多硬體並獲得多次更新,包括透過自然語言調整設定(如修復螢幕亮度或音訊不平衡),使其比進入選單更快。使用者還可透過語音搜尋 Google 照片庫並應用 AI 風格與效果。
-
靈活機器人成為最新與Google DeepMind合作的機器人公司
德國敏捷機器人公司(Agile Robots)近日與 Google DeepMind 簽署戰略研究合作協議,旨在共同開發具備人工智慧能力的機器人。該合作由敏捷機器人公司於二日在德國慕尼黑正式宣佈。根據協議內容,敏捷機器人將在其機器人中實施 Google DeepMind 的 Gemini 機器人基礎模型,同時收集機器人產生的資料以最佳化底層 Gemini AI 模型。雙方將協同工作,測試、微調並部署應用 Gemini 基礎模型的機器人,涵蓋電子製造、汽車、資料中心及物流等產業領域。敏捷機器人公司共同創辦人兼執行長陳兆峰表示,該公司已在全球安裝超過兩萬套機器人解決方案,證明瞭大規模智慧自動化的可行性,並指出整合 Gemini 機器人模型將使公司處於快速增長市場的領先地位。此項合作被描述為長期性質,但雙方未透露具體時長或價格細節。敏捷機器人公司成立於二零一八年,已從包括軟銀視覺基金、小米集團及中亞集團在內的多位投資者處籌集超過二億七千萬美元風險投資。這是今年第二家與 Google DeepMind 達成合作以推進技術的機器人硬體公司,此前今年早些時候,由現代汽車持有的波士頓動力學公司也宣佈與 Google DeepMind 合作,利用其 AI 基礎模型開發人形機器人 Atlas。此外,德國機器人新創公司 Neura Robotics 亦於三月初與高通達成合作,使用其 IQ10 處理器系列作為未來機器人的參考設計。隨著硬體與軟體日益複雜,具備不同專長的企業透過合作開發自主運作機器人成為趨勢,業界普遍認為實體 AI 是下一個市場前沿,這些合作將推動該領域持續加速發展。
-
蘋果公布2026年WWDC日期,預告將展示「人工智慧進展
蘋果公司宣佈其下一屆全球開發者大會(WWDC)將於六月八日至六月十二日在加州庫比蒂諾總部及線上舉行。與去年專注於「液態玻璃」介面設計不同,今年大會將聚焦於「人工智慧程序」,並涵蓋 iOS、macOS、tvOS 及 watchOS 平臺的更新,同時提供新的軟體與開發工具。會議將透過 Apple Developer 應用程式、官方網站及 YouTube 頻道直播,中國地區則在 Bilibili 頻道播出。市場預期蘋果將推出搭載先進人工智慧功能的新一代 Siri,並可能展示具備更佳個人情境理解與螢幕感知能力的版本。此外,蘋果今年初已與 Google 簽署協議,利用 Gemini 驅動平臺上的 AI 功能。去年大會曾宣佈 Foundation Model 框架,允許 AI 模型在離線環境運作,今年或將進一步展示相關進展。同時,蘋果此前已將 ChatGPT 等編碼模型引入 Xcode,並在今年初引入了 Anthropic 的 Claude Agent 與 OpenAI 的 Codex 等代理編碼工具,這些發展均可能在本屆大會中獲得更多關注。