實體: Google
所有提到 Google 的 AI 新聞與動態。
-
輝瑞CEO質疑報導稱其百億美元對OpenAI投資已受阻
英偉達執行長黃仁勳於週六表示,近期關於英偉達與 OpenAI 之間存在摩擦的報導完全是「無稽之談」。此言論出現在《華爾街日報》於週五晚間發表的一篇報導後,該報導聲稱英偉達正考慮縮減對 OpenAI 的投資。兩家公司此前於九月宣佈,英偉達將投資高達一萬億美元並為 OpenAI 建設十吉瓦的計算基礎設施。然而,《華爾街日報》指出,黃仁勳開始強調該協議非具約束力,並私下批評 OpenAI 的商業策略,同時對競爭對手如 Anthropic 和 Google 表示擔憂。此外,兩家公司似乎正在重新評估其關係,儘管這不代表完全斷絕聯絡,近期的討論據報聚焦於英偉達進行數十億美元的股權投資。OpenAI 發言人對《華爾街日報》表示,兩家公司正「積極處理合作細節」,並強調英偉達從一開始就支撐了 OpenAI 的突破,目前為其系統供電,並將繼續在未來擴充套件中發揮核心作用。根據彭博社報導,記者在黃仁勳訪臺期間詢問了相關報導。黃仁勳堅持表示,英偉達「肯定會參與」OpenAI 的最新融資輪次,因為這是一項極佳的投資。他表示將投入大量資金,並相信 OpenAI 的工作令人驚嘆,稱其為當代最具影響力的公司之一。黃仁勳未具體說明投資金額,而是表示應由 OpenAI 執行長山姆·阿爾曼決定籌資金額。《華爾街日報》於十二月報導稱 OpenAI 正尋求一萬億美元的融資輪次,而《紐約時報》則於本週報導,英偉達、亞馬遜、微軟和軟銀均在討論潛在投資。
-
一探Physical Intelligence,這家打造矽谷最夯機器人腦的創業公司
位於舊金山的 Physical Intelligence 是一家專注於通用機器人基礎模型的研發公司,其總部外觀低調,內部則充滿了各種機器人嘗試完成日常任務的場景。該公司由加州大學伯克利分校的副教授 Sergey Levine 共同創立,他將該公司的理念比作「ChatGPT 的機器人版本」。目前,公司正在測試一個連續迴圈系統,收集來自倉庫、家庭等多地資料以訓練通用機器人基礎模型。這些模型會返回測試站點進行評估,例如機器人嘗試摺疊褲子、將襯衫翻面或剝西蘭瓜,這些實驗旨在驗證模型是否能泛化到從未接觸過的物體或動作上。 公司創辦人之一 Lachy Groom 在加入前曾是 Stripe 的早期員工,並擔任過數年天使投資人,投資過 Figma、Notion 等公司。他於 2021 年投資了 Standard Bots,隨後創立了 Physical Intelligence。該公司成立兩年多來已籌資超過 10 億美元,估值達 56 億美元。Groom 表示公司目前的資金主要用於計算資源,且沒有明確的商業化時間表,這與許多追求短期回報的科技公司不同。另一位共同創辦人 Quan Vuong 來自 Google DeepMind,他解釋公司的策略是透過跨實體學習和多後設資料來源,降低新硬體平臺的匯入成本。 Physical Intelligence 目前與物流、超市及巧克力製造商等少數公司合作測試系統。在競爭方面,匹茲堡的 Skild AI 於 2023 年成立,近期籌資 14 億美元,估值 140 億美元,採取不同的商業化路線,已實現 3000 萬美元營收。Skild AI 批評其他基礎模型缺乏真正的物理常識,而 Physical Intelligence 則堅持透過延遲商業化來追求更優越的通用智慧。儘管硬體成本高昂且開發困難,公司目前擁有約 80 名員工,並計劃緩慢擴張。外界對其能否成功存疑,但創辦人認為時機已至,團隊將繼續專注於研究與資料收集。
-
蘋果買下以色列創業公司 Q.ai 繁榮 AI 競賽升温
蘋果、Meta 與 Google 正激烈爭奪下一代人工智慧領導地位,近期均加強對硬體的重視。蘋果透過收購以色列起點公司 Q.ai,旨在特別在音訊領域取得優勢。根據路透社報導,Q.ai 專精於影像與機器學習,其技術能解讀耳語並改善嘈雜環境中的音訊。蘋果已將新人工智慧功能加入 AirPods,包括去年推出的即時翻譯功能,並開發能偵測微妙面部肌肉活動的技術,可能用於強化 Vision Pro 頭戴式裝置。金融時報指出,此筆交易價值近兩億美元,為蘋果迄今第二大收購案,僅次於 2014 年以三億美元收購 Beats Electronics。值得注意的是,這已是執行長 Aviad Maizels 第二次將公司賣給蘋果,他曾在 2013 年出售 3D 感測公司 PrimeSense,協助蘋果從指紋辨識轉向面部辨識。Q.ai 於 2022 年創立,由 Kleiner Perkins、GV(前 Google Ventures)等機構投資,其創始團隊成員將加入蘋果。此訊息發布於蘋果首季財報前幾小時,分析師預估營收約一兆三百八十億美元,且預期為四年來最強勁的 iPhone 銷售成長。
-
我在 Google 新 AI 世界生成器中建造棉花糖城堡
Google DeepMind 於週四起開放 Project Genie 給美國 Google AI Ultra 訂閱者使用,這是一款能從文字提示或圖片建立互動遊戲世界的實驗性原型工具。該工具結合了 Genie 3 世界模型、Nano Banana Pro 圖片生成模型以及 Gemini。此舉是 DeepMind 為開發更強大的世界模型而收集使用者反饋與訓練資料的一部分。世界模型能生成環境的內部表示並預測未來結果,被視為實現人工通用智慧(AGI)的關鍵步驟。 Project Genie 允許使用者提供環境和主角的文字提示,由 Nano Banana Pro 生成圖片作為基礎,隨後 Genie 將其轉化為可探索的互動世界。使用者可修改圖片或基於真實照片建立世界,但模型偶爾會產生錯誤,例如將綠色頭髮生成為紫色。目前系統僅提供 60 秒的世界生成與導航時間,以應對計算資源限制。該工具已啟用安全防護,禁止生成涉及裸露或侵犯迪士尼等版權內容的世界。 測試顯示,Project Genie 在藝術風格(如黏土動畫、水彩、動漫)上表現出色,但在追求照片級真實感或電影效果時表現不佳,常呈現出遊戲感。使用真實照片時,模型有時會扭曲場景或產生不自然的數位感。導航控制方面,箭鍵、空格鍵及 WASD 鍵有時反應遲鈍或方向錯誤,導致移動困難。DeepMind 研究人員承認這是實驗性質的原型,未來將致力於提升真實感與互動能力,包括改善角色穿牆問題及提供更多使用者控制選項。儘管存在缺陷,該工具仍展示了在娛樂領域應用世界模型的潛力,並可能未來擴充套件至模擬訓練實體機器人。