跳至內容
AI 新聞站
返回

Google 的 Genie 世界模型現可模擬真實街景與街景視圖

我們都曾經在 Google 地圖上使用街景功能,展示給朋友看我們童年家屋的樣子,或把那個小人圖示放在巴黎的街道上,確認是否預訂了位於風景優美的地區的飯店。現在可以想像,如果能以更沉浸、互動的方式來做這件事,讓你真正模擬街道及其周遭環境,甚至可以調整天氣或預覽「後天」情境下的街景。這正是 Google 最新整合的目標之一。從今天開始,Google DeepMind 將街景與 Project Genie 連接起來,這家公司通用的世界模型可以產生多樣、互動的環境。這個新功能是在 Google I/O 2026 開發者大會上推出的。DeepMind 開放-endedness 團隊的研究科學家 Jack Parker-Holder 告訴 TechCrunch:「這對於代理(agent)與機器人應用場景都非常強大,也讓人類可以進行互動,這一直是 Genie 的核心理念。」他舉例說明,假設有一個新部署在倫敦的機器人,很少見到太陽,Genie 可以模擬那些少見的太陽照射在維多利亞式住宅上的場合,讓機器人不會被突如其來的陽光驚嚇。他繼續說:「同時,你可能會說:『我要去紐約市,但不是這個季節。』『會下雪。我想看看那個街區在雪中是什麼樣子。』」Google 自從 20 年前開始透過裝備相機的車輛與佩戴「追蹤背包」的個人,累積街景資料。這家科技巨頭已在 110 個國家與七大洲累積超過 2800 億張圖片。Jack 表示:「透過街景,我們擁有大量世界影像資料,可以想像,將這豐富的現實世界資訊與資料與模擬世界的能力結合,潛在的力量有多大。」Google 於去年 8 月推出了最新世界模型 Genie 3 的研究預覽版,並在 1 月向美國 Google AI Ultra 訂閱者開放使用,讓客戶可以透過文字提示或圖片創造互動遊戲世界。目標是將 Genie 用於教育、遊戲與機器人訓練。Genie 3 已經協助 Waymo 的模擬器訓練其自駕車在極為罕見的事件(如龍捲風或隨機大象出沒)上表現。將街景資料加入其中,可以幫助 Waymo 更好地準備在全球更多城市發佈。Waymo 有自己的模擬器,曾幫助其擴展至美國 11 個城市並測試其 AI 駕駛系統。Parker-Holder 表示,與 Genie 的不同之處在於,那些模擬都是從車子的視角出發。街景則允許不僅僅模擬與真實地點相連的世界,還可以改變視角,例如人類或機器人的視角。Google 從今天開始向美國部分 Ultra 訂閱者推出街景功能,並會逐步擴展至更多用戶。全球 Ultra 訂閱者將在未來幾週內獲得使用權。DeepMind 產品經理 Diego Rivas 表示,研究團隊的目標是讓這項新功能盡可能多的用戶使用。他提醒說,街景與 Genie 都還處於實驗階段,因此在準確度方面還有許多可以改進的地方。Google 團隊展示的樣本中,包括我曾經居住過的社區的水下模擬,結果令人印象深刻且容易辨識,但還是遊戲品質,而非逼真照片般的畫質。這些模型目前還不具備物理理解能力,意味著它們還無法理解因果關係。例如,在一個模擬女性穿過積雪的約書亞樹的場景中,她直接穿過仙人掌與灌木。相較之下,例如 Google 的圖像生成器 Nano Banana,現在可以生成完美的資訊圖表文字;或是其視頻生成器 Veo,它了解紙船會隨著水流漂動、煙霧會散入空氣、布料會覆蓋在形狀上。這些模型並未將物理法則硬編入程式中,而是透過長期的被動觀察,像生物一樣直覺地學習。Parker-Holder 表示:「我認為這類模型在準確度與品質上,可能比視頻模型落後 6 到 12 個月,因此這是我們將會解決的問題。」Google 地圖總監 Jonathan Herbert 表示,Genie 目前還無法忠實重建街道。他認為真正的突破在於 AI 的空間連續性。如果你轉動 360 度,AI 會正確記憶並模擬你身後的環境。從那時起,模型可以在其上建立新的環境。Herbert 表示:「我們一直思考如何在街景資料之上建立最完整、最豐富的世界模型。」「我們一直有這個想法,就是用地圖資料以新的方式進行新的 AI 研究,已經有一段很長的時間了。」追蹤 Google I/O 2026 的其他重大消息 Google 搜索將不再是原來的樣子 Google 更新 Gemini 應用程式對抗 ChatGPT 和 Claude Google 引入 Gemini Spark,一個 24/7 的代理助理,支援 Gmail 結合 如何使用 Google 新的資訊代理


分享這篇文章:

上一篇
Google 參考 Meta 策略,於 IO 2026 亮相全新音訊驅動智慧眼鏡
下一篇
Google 擊出下一波 AI 風暴 傳遞 Agent 概念 不再依賴 Chatbot