實體: Google
所有提到 Google 的 AI 新聞與動態。
-
這家新創公司認為印度的零工經濟能訓練世界上的機器人
印度線上外送市場近年快速成長,Zomato 與 Swiggy 已上市,雲端廚房數量增加,同時居家服務類起點公司如 Urban Company、Snabbit 和 Pronto 也日益受歡迎。矽谷起點公司 Human Archive 正趁勢與這些公司合作,讓工人佩戴裝有相機的特殊帽子,收集第一視角(egocentric)的日常任務影片資料,用於訓練機器人。該公司未透露具體合作夥伴,但表示正與居家服務、飯店及餐飲業公司合作,目前已在多個地點部署超過一千個主動式頭戴裝置。 Human Archive 於週二宣佈從 Wing Venture Capital、NVP Capital、Y Combinator 以及 OpenAI、Nvidia、Google、Mercor、AfterQuery、BAIR、SAIL、Brad Boa 和 Meta 等機構與天使投資人處籌得 820 萬美元資金。該公司由三名加州大學柏克萊分校學生及一名史丹佛大學學生 Samay Maini、Rushil Agarwal、Shloke Patel 和 Raj Patel 創立,後兩者為親兄弟,Raj Patel 擔任執行長。四名創辦人皆具備機器人、硬體及觸覺資料的研究背景。 隨著機器人實驗室與前沿 AI 公司競相開發能執行實體任務的機器,面臨關鍵瓶頸即高品質真實世界訓練資料短缺。Human Archive 押注印度蓬勃的零工經濟中的工人是未開發且可擴充套件的資料來源。儘管公司聲稱與多家合作,但近期被多家印度居家服務公司拒絕,包括 Pronto 和 Urban Company。Entrackr 報導 Pronto 正積極尋求資料合作,Snabbit 曾進行初步討論後專案告吹。Urban Company 執行長 Abhiraj Singh Bhal 在 X 表示不會參與,引發創辦人 Raj Patel 反擊,稱若不合作將面臨客戶流失。共同創辦人 Rushil Agarwal 更直言 Pronto 創辦人 Anjali Sardana 曾嘲笑他並稱其為「愚蠢」,Pronto 承認對話但表示不推進。 為差異化,Human Archive 開發觸覺手套、全身動作捕捉服及腕部相機,同步收集動作與觸覺力資料,搭配 RGB-D(色彩與深度資訊)銷售給 AI 實驗室。創辦人表示僅靠影片資料不足,需結合其他感測器資料。公司初期使用 iPhone 或現成裝置,現已發展超過七
-
所有人皆正在實時應對AI安全議題 — 雖然連Google也不例外
在洛杉磯近期的一場活動中,Google Cloud 首席營運官 Francis deSouza 就企業在人工智慧(AI)安全方面的現狀與需求發表了看法。他強調,安全不能成為後顧之憂,企業必須採取平臺化方法,從一開始就要求平臺具備安全、治理與可審計性。deSouza 特別警告了「影子 AI」的風險,即員工使用未經組織監督的消費級工具。他指出,沒有資料策略與安全策略的 AI 戰略是不存在的,且企業實際上多處於多雲環境,需確保跨雲與跨模型的安全態勢一致。 隨著攻擊面的擴大,傳統防禦模型已顯不足。攻擊者從初始滲透到進入下一階段的時間已從八小時縮短至 22 秒。deSouza 提出,企業需以機器速度應對機器速度,發展出 AI 原生且完全由代理(agents)驅動的防禦體系,讓人類監督而非直接操作防禦。然而,具備相關資質的領導人才匱乏,且 AI 引入的漏洞擴散速度遠快於安全團隊的應對能力。 此外,文章提及 Google Cloud 開發者面臨的實際安全挑戰。近期有開發者因 API 金鑰洩露而收到高達數萬美元甚至五萬美元的未授權 Gemini 模型呼叫費用。Google 雖在報導後退款,但表示無意改變自動升級收費層級的政策,優先防止服務中斷。安全公司 Aikido 的研究進一步指出,即使開發者立即刪除洩露的金鑰,攻擊者仍可持續使用該金鑰約 23 分鐘,因為 Google 的撤銷機制傳播緩慢。相比之下,服務帳戶金鑰僅需約五秒撤銷,顯示當前問題更多源於公司優先順序而非技術限制。這凸顯了平臺提供商所宣稱的安全建議與其自身適應速度之間存在的差距。
-
你無法再用 Google 搜尋「disregard」這個詞
Google 近期推出了全新的搜尋體驗,將 AI 摘要置於前臺,並將傳統的十個藍色連結大幅推後。然而,由於 Google 搜尋龐大的規模,公司似乎未考慮到許多邊緣案例。例如,當使用者輸入「disregard」這個詞時,搜尋結果中雖然仍保留 Merriam-Webster 的連結,但使用者必須滑動過一大塊空白區域才能看到。對於大多數使用者而言,這單一回覆是他們唯一能見到的內容,且 AI 回應對搜尋「disregard」的使用者而言毫無價值,僅是一個破損的工具。相比之下,Bing 在處理此類搜尋時較不積極使用 AI 摘要,雖然也不完美,但仍能提供部分有用的資訊。作者身為近十五年經驗的專業科技記者,表示在此之前從未見過 Bing 的搜尋結果比 Google 更具價值。這確實是科技發展史上首次出現這種情況。
-
我們試用過谷歌的 AI 眼鏡,它們幾乎已就緒
在 Google I/O 開發者大會上,Google 展示了其下一代 AI 眼鏡的原型機,這與公司預計今年秋季推出的僅具音訊功能的版本不同,新產品將提供音訊與視覺的結合體驗。這款 Android XR 眼鏡內建顯示器,可將天氣、導航、Uber 取車資訊、即時翻譯等小工具疊加在現實世界之上,甚至支援使用者利用 AI 自訂小工具。該產品由 Warby Parker、Gentle Monster 和 Samsung 共同開發,並與 iOS 及 Android 手機相容。 測試版本仍為原型,主要用於驗證顯示技術與電池效能,外觀與最終出貨版在尺寸與細節上會有差異。出貨版將具備自動偵測佩戴狀態的功能。使用者透過兩秒鐘按壓右側鏡框即可啟動 Gemini AI,此時會發出提示音。在演示中,啟動 Gemini 同時開啟相機,但出貨版將允許使用者自行設定。初步測試顯示,透過眼鏡播放音樂雖能聽見,但音質不如高品質耳機,不過在戶外活動時能保持環境音的通透性。 功能測試方面,照片拍攝需按下按鈕,影像會傳輸至手機與手錶,並可透過 Gemini 進行 AI 編輯,例如將人物轉化為動漫角色,此過程在現場網路負載下約需 45 秒。開啟顯示器後,使用者可見包含天氣與倒數計時的小工具介面,單眼顯示器雖有輕微模糊與眼部疲勞感,但功能完整。語言翻譯功能表現優異,能即時將西班牙語轉為英文文字顯示並口語朗讀,此功能亦適用於音訊版眼鏡。導航功能則與手機 Google Maps 整合,透過抬頭顯示方向並向下檢視地圖定位,支援模糊搜尋如「最近的咖啡館」。此外,眼鏡還能識別物體並回答問題,如辨識畫作或提供食譜建議,雖然部分功能目前可透過 Google Lens 完成,但無須掏出手機的操作體驗仍具吸引力。Google 表示,音訊版眼鏡同樣支援 Gemini AI,可進行音樂播放、拍照、通話及控制手機應用程式,甚至能辨識廚房中的料理並提供烹飪建議。公司預計今年晚些時候將擴大 Android XR 測試計畫並公佈更多資訊。