實體: Google
所有提到 Google 的 AI 新聞與動態。
-
谷歌推出Doppl應用程式,讓用戶 visualize 如何搭配服裝會看起來的效果
Google 於週四宣佈推出名為 Doppl 的全新實驗性應用程式,該應用利用人工智慧技術,讓使用者能虛擬試穿不同款式的服裝。此應用程式目前僅在美國的 iOS 和 Android 平臺上架。使用者需先上傳一張全身照片,隨後可透過照片或截圖選擇各種服裝進行虛擬試穿,這些服裝來源可包括二手店、朋友或社交媒體。選定服裝後,Doppl 會生成使用者虛擬形象穿著該服裝的圖片,並能將靜態圖片轉換為 AI 生成的影片,以更真實地呈現上身效果。使用者可儲存喜愛造型並瀏覽其他虛擬試穿結果,甚至分享給他人。Google 表示,此功能建立在 Google Shopping 近期推出的虛擬試穿能力之上,透過獨立應用程式讓功能更易存取,並能收集更多資料以輔助未來發展。與以往聚焦於多樣化模特兒身體不同,Doppl 允許使用者在動畫版本的自己身上試穿衣物。Google 強調這是一項 Google Labs 實驗,尚處於早期階段,可能無法完全準確呈現合身度、外觀及服裝細節。由於這是實驗性發布,目前尚不清楚 Google 是否會將此應用擴充套件至其他地區。
-
Google Photos 融合經典搜尋與 AI 提升搜尋速度
Google 在暫停其有缺陷的 AI 驅動「Ask Photos」功能後,宣佈已改善該功能快速返回搜尋結果的能力。此功能於去年 Google I/O 開發者大會首次推出,允許使用者使用自然語言查詢搜尋數位照片集合。該功能利用 Google Gemini,能理解照片內容及其他後設資料以回應輸入。然而,使用者抱怨該功能不可靠且回應緩慢,Google Photos 產品經理 Jamie Aspinall 於六月在 X 上表示,該功能在延遲、品質和使用者體驗方面尚未達到預期,因此暫停 rollout 數週以恢復原始搜尋的速度與召回率。 Google 在短文中表示,將 Photos 經典搜尋功能的最優解帶入 Ask Photos,特別針對「海灘」或「狗」等簡單查詢,使結果顯示更快速。AI 則在背景中運作,尋找最相關照片並處理複雜查詢。例如,搜尋「白狗」時,初階搜尋結果會立即出現,待 AI 分析完成後,相關結果將顯示於下方,並可能識別狗的名稱及首次出現時間。介面仍允許切換至經典搜尋。由於這些變更,Google 已恢復向美國更多使用者推出 Ask Photos。要符合資格使用,使用者必須年滿十八歲,帳號語言設為英文,並啟用「Face Groups」功能以標記照片庫中的人與寵物。
-
Meta 聘請 OpenAI 關鍵研究人員協助推進 AI 推理模型
Meta 已聘請前 OpenAI 研究員 Trapit Bansal 加入其新成立的 AI 超級智慧部門,專注於開發 AI 推理模型。OpenAI 發言人 Kayla Wood 確認 Bansal 已離職,其 LinkedIn 顯示他於六月離開,並自 2022 年起在 OpenAI 工作,是與共同創辦人 Ilya Sutskever 一起推動強化學習的關鍵人物,也是 OpenAI 首個 AI 推理模型 o1 的基礎貢獻者。Bansal 的加入將為 Meta 的 AI 超級智慧實驗室帶來顯著提升,該實驗室現已有前 Scale AI 執行長 Alexandr Wang,並正尋求聘請前 GitHub 執行長 Nat Friedman 及 Safe Superintelligence 共同創辦人 Daniel Gross。Bansal 的目標是協助 Meta 開發與 OpenAI 的 o3 或 DeepSeek 的 R1 等行業領先技術競爭的 frontier AI 推理模型,目前 Meta 尚未公開提供此類模型。 Mark Zuckerberg 近期展開大規模招聘,向頂尖研究人員提供高達一億美元的薪酬包。除了 Bansal,還有 Lucas Beyer、Alexander Kolesnikov、Xiaohua Zhai、Jack Rae 及 Johan Schalkwyk 等前 OpenAI 或 Google DeepMind 研究員加入該團隊。Zuckerberg 曾嘗試收購 Safe Superintelligence、Thinking Machines Labs 及 Perplexity 等擁有強大 AI 研究團隊的初創公司,但這些談判均未進入最終階段。OpenAI 執行長 Sam Altman 在播客中表示,雖然 Meta 試圖挖角,但公司最佳人才尚未接受邀請。AI 推理模型是 Meta 的關鍵戰略方向,隨著 OpenAI、Google 及 DeepSeek 推出高效能模型,Meta 需透過訓練模型在給出答案前進行更多推理來提升表現。Bansal 的加入旨在讓 Meta 的 AI 超級智慧部門成為類似 Google DeepMind 的關鍵內部群組,支援 Clara Shih 領導的企業 AI 代理專案。儘管 Meta 希望在此輪 AI 競賽中脫穎而出,但 OpenAI 計劃在數週內發布開放式 AI 推理模型,這將為 Meta 的開放式 AI 產品帶來更大壓力。
-
YouTube 新增類似 AI 總結的搜尋結果輪播功能
YouTube 於週四宣佈推出新的 AI 驅動功能,旨在協助使用者更輕鬆地查詢內容與資訊。平臺將推出類似 Google AI Overviews 的 AI 驅動搜尋結果橫幅,並擴大測試對話式 AI。此新功能的 AI 搜尋結果橫幅目前僅開放給美國 YouTube Premium 使用者,將建議影片並顯示簡短的 AI 生成主題描述,以幫助使用者更快找到所需內容。該功能將出現在與購物、地點或特定地點活動相關的搜尋中。例如,搜尋「夏威夷最佳海灘」時,使用者將看到由 AI 生成的橫幅,突出展示最佳浮潛地點和火山海灘的影片片段,並附有描述及更多影片以協助規劃假期。 此功能與 Google 的 AI Overviews 工具相似,後者會提供搜尋結果頁頂部的 AI 生成摘要。雖然此功能有助於使用者發現內容,但可能對依賴互動來賺取收入的創作者造成負面影響。若使用者能直接從 AI 橫幅獲取資訊,可能不會點選影片。此舉發生在兩週前《華爾街日報》報導 Google 的 AI Overviews 和其他 AI 工具嚴重影響新聞出版商流量之後。YouTube 創作者擔心此新橫幅功能會減少對其影片的互動,就像 Google 搜尋中的 AI Overviews 導致新聞網站轉介減少一樣。 關於 YouTube 的對話式 AI 工具,該 Google 旗下平臺宣佈將向部分非 Premium 使用者開放。此工具於 2023 年底首次推出,利用 AI 協助使用者獲取更多資訊、內容推薦及影片摘要,甚至可用於學術影片中的關鍵概念自測。YouTube 解釋稱,工具的回答由大型語言模型生成,這些模型參考 YouTube 和網路上的資訊,旨在幫助觀眾更深入地探索所觀看的內容。例如,當觀看滾軸滑冰教學影片時,對話式 AI 會詢問是否要「總結影片」或「推薦相關內容」。使用者也可以提出自定義問題,如「這支影片的歌是什麼?」,工具將提供歌曲名稱、藝人、流派等詳細資訊。