跳至內容
AI 新聞站
返回

我們試用過谷歌的 AI 眼鏡,它們幾乎已就緒

在本週的 Google I/O 開發者大會上,我們有機會親身體驗 Google 即將推出的 AI 增強眼鏡 —— 這不是公司預告今年秋天開始出貨的僅限音訊功能的眼鏡,而是提供音訊與視訊結合體驗的眼鏡。這些 Android XR 眼鏡首次在去年的活動上公布,提供一種內置鏡片顯示的技術,將有用的資訊顯示在你面前,疊加在真實世界之上。這包括一些小工具,例如天氣、步行路線、Uber 取車資訊、即時翻譯等功能,甚至你也可以使用 AI 自己設計的小工具。圖片來源:Andrej Sokolow/picture alliance(新視窗)/ Getty Images

Google 表示,這些眼鏡將與 iOS 和 Android 手機配對,包括僅音訊格式與未來的顯示版本。擁有顯示功能的眼鏡將是繼今年晚些時候推出的首款音訊眼鏡之後的下一步。這些眼鏡是由 Warby Parker、Gentle Monster 和 Samsung 共同開發,將 Google 的技術與他們品牌設計風格相結合。

我們測試的眼鏡目前仍是非常初的原型,雖然已經打磨得足夠精緻,可以進行外部測試。展示 XR 眼鏡的代表表示,這個原型讓他們不必過於關注不同風格與形狀的外觀細節,因此可以更自由地實驗顯示技術以及其對電池續航的影響。這意味著這些眼鏡與未來出貨版本的眼鏡在配戴感、形狀、尺寸以及細節處理上會有所不同。換句話說,這更像是在一個基本、舒適的框架上實驗眼鏡的「內在」部分。

未來出貨版本的眼鏡將能偵測到眼鏡被戴在頭上與取下的狀態,但我們測試的版本則沒有這個功能。圖片來源:Google

要啟動 Gemini,你只需在眼鏡框架的右側按壓兩秒鐘。啟動時會發出啟動提示音,讓你知道 Gemini 已啟動並開始聆聽。在演示版本中,啟動 Gemini 還會同時啟動相機,但未來出貨版本將允許用戶自行設定是否在啟動 Gemini 時同時啟動相機。在初步測試中,我們透過眼鏡請 Gemini 播放一首喜愛的藝人歌曲。不幸的是,現場環境太嘈雜,無法評估音質,雖然音樂已經調到最大音量,但仍相對難以清晰且細節地聽到。不過從這有限的體驗中,我們的印象是這些眼鏡不太會成為高品質耳機的替代品,但如果你只是想要在戶外走路、遠足或做家務時聽點音樂,還是可以的。與不戴耳機相比,你更容易聽到有人對話,這與 Apple AirPods 等設備的透明模式體驗不同。要關閉音樂,只需輕點眼鏡框架側邊中間的位置,就像輕敲你的耳際一樣。

圖片來源:Google

在第二個測試中,我們按下了拍照按鈕來拍攝一個人的照片。顯示功能關閉,因此照片會傳送到手機和手錶上。(未來你將可以透過長按來拍攝影片,但這個功能在原型中尚未可用。在影片的情況下,你會看到影片預覽圖標而不是照片。)你也可以直接請 Gemini 拍攝照片,而不必按拍照按鈕,並對結果進行某些類型的 AI 處理。例如,你可以說:「拍攝照片並將這個人變成動漫人物。」照片會傳送到手機,再傳送到 Gemini 和 Nano Banana 伺服器,最後以修改過的版本返回。在 Google I/O 會場,Wi-Fi 網路負載較重,整個過程約需 45 秒。

圖片來源:Andrej Sokolow/picture alliance(新視窗)/ Getty Images

當顯示功能啟用時,你會在視野中看到一個簡單的主畫面。演示版本中預載了一些小工具,顯示天氣和 Google I/O 會場倒數計時。你也可以在特定應用程式中建立快速啟動器,例如 Google 地圖或翻譯,如果這些是你使用眼鏡的主要用途。原型中只有一個顯示在右眼上方,但這個平台可以支援單顯示、雙顯示以及僅音訊眼鏡。圖片本身稍微模糊,但我們認為這與我們佩戴的隱形眼鏡有關,這類眼鏡一邊用於遠距離視力,另一邊則用於近距離視力。當我們關閉一隻眼睛時,圖片會更清晰,但體驗幾乎立即讓我們右眼感到一些視力疲勞,不清楚是否完全與隱形眼鏡有關。

圖片來源:Andrej Sokolow/picture alliance(新視窗)/ Getty Images

其中一個最好的演示是眼鏡上的語言翻譯功能,這功能由手機上的 Google 翻譯應用支援。其中一位演示者快速說西班牙語,眼鏡自動偵測語言並在顯示器上顯示英文文字,同時 Gemini 會在耳中說出英文。我們可以看到,這類旅行者會為此體驗購買這些眼鏡。我們要注意的是,翻譯功能也會在僅音訊眼鏡上運行,只是不會在眼鏡上顯示文字。相反,你可以在手機上看到文字轉錄,如果需要的話,還可以與實時音訊反饋同時使用。

另一個演示是使用眼鏡進行導航。雖然我們無法離開會場實際測試其準確性,但我們可以大致了解其運作方式。你可以透過請 Gemini 導航到一個目的地來啟動 Google 地圖體驗 —— 這個目的地甚至可以是像「最近的咖啡店」這樣模糊的描述。Gemini 會在手機上啟動 Google 地圖,並在體驗載入時短暫延遲後,眼鏡會顯示路線指引。當你向前看時,下一個轉彎資訊會顯示。但如果你需要在空間中導航,可以向下看地圖上的藍點。你也可以向左或向右轉動,就像在手機上調整藍點的方向一樣。當你再次向上看時,就可以繼續行走而不需要讓地圖阻擋視線。因為這個體驗與手機上的 Google 地圖相連,所以預設的儲存目的地,例如「家」和「工作」會已經可用。

圖片來源:Google

我們還能短暫使用眼鏡來識別我們視野中的各種物體並提出問題。眼鏡最初在書架上我們面前的莫奈畫作複製品上有些困難,這是因為原型中沒有自動啟動相機,必須從應用程式中再次啟動。不過,即使我們靠近並專注於左下角的莫奈簽名,Gemini 也花了幾個問題才說看起來像莫奈。其他測試則比較順利,眼鏡立即識別了書架上的植物並回答了書中不同食譜的問題。雖然這些功能現在也可以透過 Google Lens(或其他整合在聊天機器人應用中的 AI 模型)實現,但我們認為這很有趣,因為你不需要拿出手機就可以做到。

Google 表示,今年晚些時候會有更多關於其 Android XR 顯示眼鏡的資訊,當時也會擴展其受信任測試者計畫。圖片來源:Google

在這期間,公司認為音訊功能已經足夠滿足一些用戶的需求,這或許是他們尚未準備好顯示眼鏡的說法,儘管在這方面與 Meta 和 Snap 競爭激烈。與顯示版本一樣,音訊眼鏡也提供 Google 的 Gemini AI,你會透過眼鏡框架的揚聲器聽到私人音訊。你可以做很多事情,例如透過眼鏡聽音樂、按按鈕拍照、打電話,或從這些眼鏡中點開手機應用程式,就像未來顯示版本一樣。雖然我們沒有演示其他第三方應用程式的功能,但眼鏡將允許用戶告訴 Gemini 做一些事情,例如「從這個食譜中提取食材並加入我的採購清單」。在另一個 Google 在活動主題演講中展示的例子中,眼鏡可以看到穿戴者在爐子上烹飪的餐點,並提供關於這道菜的建議,例如肉是否已經完全熟透。


分享這篇文章:

上一篇
你無法再用 Google 搜尋「disregard」這個詞
下一篇
Spotify 與 Universal Music 美國簽訂協議允許粉絲創作 AI 覆蓋與混音