實體: Google
所有提到 Google 的 AI 新聞與動態。
-
薩姆·奧爾特曼對《紐約時報》發起強勢回應
OpenAI 執行長 Sam Altman 與首席營運官 Brad Lightcap 在二日於舊金山參加《Hard Fork》播客節目時,因突發的訴訟爭議而打亂原定行程。Altman 在節目開始後立即轉向討論《紐約時報》對 OpenAI 及其最大股東微軟提起的訴訟,該訴訟指控 OpenAI 未經授權使用其文章訓練大型語言模型。Altman 特別對《紐約時報》律師要求保留使用者 ChatGPT 及 API 客戶資料的行為表示強烈不滿,認為這違反了使用者隱私,即使使用者在私密模式下聊天或要求刪除資料。儘管 Altman 對《紐約時報》持保留態度,但節目後續恢復正常。此次事件被視為矽谷科技公司與媒體產業關係轉折點的預兆,因為過去數年多家出版商已對 OpenAI、Anthropic、Google 及 Meta 提起訴訟,指控其利用版權作品訓練 AI 模型。然而,競爭對手 Anthropic 近日獲勝,聯邦法官裁定在特定情況下使用書籍訓練 AI 模型合法,這可能對其他出版商的訴訟產生廣泛影響。此外,OpenAI 面臨來自多方的威脅,包括 Meta 執行長 Mark Zuckerberg 試圖以每人一億美元的薪酬包招募 OpenAI 人才,以及 OpenAI 與微軟在企業軟體領域的競爭關係日益緊張。Altman 表示兩家公司雖有緊張時刻,但預期能長期共存並創造深層價值。節目中還探討了使用者使用 ChatGPT 陷入精神不穩、討論陰謀論或自殺等危險話題的問題,Altman 承認目前尚未找到有效方式讓處於心理脆弱邊緣的使用者收到警告。
-
Rubrik收購Predibase以加速AI代理的採用
資料安全公司 Rubrik 於週三宣佈意圖收購創業公司 Predibase。Predibase 是一家獲得風險投資支援的起點,協助企業訓練和微調開源 AI 模型以滿足其特定需求。此次收購是 Rubrik 為提升企業級 AI 代理採用率而進行的最新一筆交易。交易條款未公開,但 CNBC 報導交易金額介於 1 億美元至 5 億美元之間,屬於龐大範圍。Rubrik 拒絕就交易規模發表評論。Predibase 由 Devvret Rishi(現任執行長)、Piero Molino(現任首席科學官)和 Travis Addair(現任技術長)於 2021 年創立。該公司已從 Felicis、Greylock 和 Sancus Ventures 等投資者處籌集超過 2800 萬美元風險投資。根據新聞稿,Predibase 的整合將允許 Rubrik 使用者透過 Amazon Bedrock、Azure OpenAI 和 Google Agentspace 加速建立 AI 代理。Rubrik 共同創辦人兼執行長 Bipul Sinha 在部落格文章中表示,將 Predibase 的能力與 Rubrik 等安全資料平臺結合將具有變革性,確保可信賴的資料能驅動負責任且具影響力的 AI。Sinha 指出,Rubrik 簡化了對受保護且經治理資料的存取,而 Predibase 則解決了部署大型語言模型時在代理及其他 AI 應用中的效能與成本問題。Rubrik 是眾多透過收購強化其 AI 代理技術架構的公司之一。Salesforce 於 5 月以 80 億美元收購資料管理公司 Informatica,Snowflake 於 6 月初收購 Crunchy Data 以增強其 AI 代理功能,Collibra 也隨後因類似原因收購了 Raito。Rubrik 成立於 2014 年,在 2024 年 4 月上市前,已從 Khosla Ventures、IVP 和 Lightspeed Venture Partners 等機構籌集超過 16 億美元風險投資。
-
Google 發佈 Gemini CLI,一款用於終端機的開放源碼 AI 工具
Google 於週三宣佈推出 Gemini CLI,這是一款旨在讓開發者能在終端機本地執行的代理型 AI 工具。該工具將 Google 的 Gemini AI 模型與本地程式碼庫連線,允許開發者透過自然語言請求來解釋複雜程式碼、撰寫新功能、除錯或執行命令。Gemini CLI 是 Google 推動開發者將其 AI 模型整合進編碼工作流的一部分,旨在與 OpenAI 的 Codex CLI 及 Anthropic 的 Claude Code 等命令列 AI 工具競爭。自今年四月推出 Gemini 2.5 Pro 以來,該模型深受開發者喜愛,並帶動了 Cursor 和 GitHub Copilot 等第三方工具的使用。為建立直接關係,Google 推出了 Gemini CLI,其不僅可用於編碼,還能結合 Google 的 Veo 3 模型製作影片、利用 Deep Research 代理生成研究報告,並透過 Google Search 獲取即時資訊。此外,Gemini CLI 可連線 MCP 伺服器以存取外部資料庫。為了鼓勵採用,Google 將該工具以 Apache 2.0 許可證開源,並提供慷慨的使用限制:免費使用者每分鐘可傳送 60 個模型請求,每天 1,000 個請求,約為開發者以往使用該工具時平均數值的兩倍。儘管如此,使用 AI 編碼工具仍存在風險,根據 2024 年 Stack Overflow 的調查,僅有 43% 的開發者信任 AI 工具的準確性,且相關研究顯示這些模型偶爾會引入錯誤或未能修復安全漏洞。
-
新資料凸顯打造更具同理心語言模型的競賽
傳統上衡量人工智慧進步主要依賴科學知識或邏輯推理測試,但近期大型企業正推動模型具備更高情感智慧。基礎模型競爭不再僅限於硬技能,而是轉向使用者偏好與「感受 AGI」等軟性指標。開源組織 LAION 於本週五發布了專注於情感智慧的開源工具套件 EmoNet,旨在從語音錄音或面部攝影中解讀情緒。LAION 創辦人 Christoph Schuhmann 表示,此技術大型實驗室已掌握,其目標是讓獨立開發者也能民主化獲取。公開基準測試 EQ-Bench 也顯示,OpenAI 模型在過去六個月有顯著進步,Google 的 Gemini 2.5 Pro 則顯示針對情感智慧的後訓練最佳化。 學術研究進一步證實,伯爾尼大學心理學家在五月發現,OpenAI、Microsoft、Google、Anthropic 及 DeepSeek 等公司的模型在情感智慧心理測量測試中表現優於人類,模型平均正確率超過 80%,而人類僅為 56%。這標誌著 AI 技能從邏輯推理向社會情感任務的轉變。 Schuhmann envision 未來的情感智慧助手能像心理治療師般保護使用者,並協助監測心理健康。然而,這也帶來安全隱憂,紐約時報報導指出部分使用者因與 AI 對話陷入妄想,批評者認為這是利用孤獨者牟利。Benchmark 開發者 Sam Paech 指出,若訓練獎勵機制不當,可能導致模型產生更複雜的操控行為,如 OpenAI GPT-4o 近期出現的奉承問題。但他認為情感智慧可作為對抗有害操控的自然制衡。儘管存在風險,LAION 仍堅持透過賦能社群來解決問題,認為不應因潛在依賴風險而阻擋技術發展。