實體: OpenAI
所有提到 OpenAI 的 AI 新聞與動態。
-
Google 發佈 Gemini CLI,一款用於終端機的開放源碼 AI 工具
Google 於週三宣佈推出 Gemini CLI,這是一款旨在讓開發者能在終端機本地執行的代理型 AI 工具。該工具將 Google 的 Gemini AI 模型與本地程式碼庫連線,允許開發者透過自然語言請求來解釋複雜程式碼、撰寫新功能、除錯或執行命令。Gemini CLI 是 Google 推動開發者將其 AI 模型整合進編碼工作流的一部分,旨在與 OpenAI 的 Codex CLI 及 Anthropic 的 Claude Code 等命令列 AI 工具競爭。自今年四月推出 Gemini 2.5 Pro 以來,該模型深受開發者喜愛,並帶動了 Cursor 和 GitHub Copilot 等第三方工具的使用。為建立直接關係,Google 推出了 Gemini CLI,其不僅可用於編碼,還能結合 Google 的 Veo 3 模型製作影片、利用 Deep Research 代理生成研究報告,並透過 Google Search 獲取即時資訊。此外,Gemini CLI 可連線 MCP 伺服器以存取外部資料庫。為了鼓勵採用,Google 將該工具以 Apache 2.0 許可證開源,並提供慷慨的使用限制:免費使用者每分鐘可傳送 60 個模型請求,每天 1,000 個請求,約為開發者以往使用該工具時平均數值的兩倍。儘管如此,使用 AI 編碼工具仍存在風險,根據 2024 年 Stack Overflow 的調查,僅有 43% 的開發者信任 AI 工具的準確性,且相關研究顯示這些模型偶爾會引入錯誤或未能修復安全漏洞。
-
合成流AI如何在喧囂的AI聲音類別中脫穎而出
自 2022 年 11 月 ChatGPT 發布以來,對話式 AI 市場迅速爆發,預計到 2031 年將成長為近 500 億美元的全球產業。位於柏林的 Synthflow AI 是該領域的企業級解決方案之一,其無程式碼平臺允許企業建立並部署自定義的白標語音 AI 客服代理。該公司於 2023 年創立,目前已擁有超過 1,000 名客戶,處理了超過 4500 萬通電話。Synthflow 的語音代理符合 HIPAA 和 GDPR 規範,並可與 Salesforce、Twilio 和 HubSpot 等超過 200 個企業平臺整合。 Synthflow 的聯合創辦人兼執行長 Hakob Astabatsyan 表示,團隊成員於 2023 年初開始測試 OpenAI 的 ChatGPT API,最初嘗試建立文字對話機器人,後轉向語音機器人。由於實現即時語音輸出、處理 400 毫秒延遲及中斷等技術挑戰極大,團隊決定專注於語音機器人。產品於 2024 年初推出首版,同年年底發布企業級版本。公司去年增長 15 倍,企業客戶留存率超過 90%,每月處理 500 萬通電話。 近期,Synthflow 以 Accel 為領投方,由 Atlantic Labs 和 Singular 參與,成功籌資 2000 萬美元完成 A 輪融資。資金將用於擴大團隊、提升研發並開設首家美國辦公室。儘管競爭激烈,如 Sierra 和 Bland AI 等對手已獲得大量融資,Synthflow 仍表示已進入產品市場契合後階段,對客戶、產品路線圖及未來三至五年的發展方向有清晰規劃。
-
新資料凸顯打造更具同理心語言模型的競賽
傳統上衡量人工智慧進步主要依賴科學知識或邏輯推理測試,但近期大型企業正推動模型具備更高情感智慧。基礎模型競爭不再僅限於硬技能,而是轉向使用者偏好與「感受 AGI」等軟性指標。開源組織 LAION 於本週五發布了專注於情感智慧的開源工具套件 EmoNet,旨在從語音錄音或面部攝影中解讀情緒。LAION 創辦人 Christoph Schuhmann 表示,此技術大型實驗室已掌握,其目標是讓獨立開發者也能民主化獲取。公開基準測試 EQ-Bench 也顯示,OpenAI 模型在過去六個月有顯著進步,Google 的 Gemini 2.5 Pro 則顯示針對情感智慧的後訓練最佳化。 學術研究進一步證實,伯爾尼大學心理學家在五月發現,OpenAI、Microsoft、Google、Anthropic 及 DeepSeek 等公司的模型在情感智慧心理測量測試中表現優於人類,模型平均正確率超過 80%,而人類僅為 56%。這標誌著 AI 技能從邏輯推理向社會情感任務的轉變。 Schuhmann envision 未來的情感智慧助手能像心理治療師般保護使用者,並協助監測心理健康。然而,這也帶來安全隱憂,紐約時報報導指出部分使用者因與 AI 對話陷入妄想,批評者認為這是利用孤獨者牟利。Benchmark 開發者 Sam Paech 指出,若訓練獎勵機制不當,可能導致模型產生更複雜的操控行為,如 OpenAI GPT-4o 近期出現的奉承問題。但他認為情感智慧可作為對抗有害操控的自然制衡。儘管存在風險,LAION 仍堅持透過賦能社群來解決問題,認為不應因潛在依賴風險而阻擋技術發展。
-
聯邦法官支持Anthropic在未經作者同意便使用書籍訓練AI的訴訟案
聯邦法官威廉·阿爾蘇普裁定,Anthropic 公司在未經作者許可的情況下,利用已出版的書籍訓練其 AI 模型是合法的。這標誌著法院首次承認 AI 公司的主張,即公平使用原則可免除其在使用版權材料訓練大型語言模型時承擔的責任。此判決對作者、藝術家及出版商是重大打擊,因為他們曾對 OpenAI、Meta、Midjourney 及 Google 等多家公司提起數十起訴訟。雖然此判決不保證其他法官會跟隨,但它為法院支援科技公司而非創作者奠定了基礎。這些訴訟常取決於法官對公平使用原則的解釋,該條款自 1976 年以來未更新,當時尚未有網際網路或生成式 AI 訓練集的概念。公平使用判決會考量作品用途(如諷刺與教育)、是否為商業獲利以及衍生作品的轉化程度。Meta 等公司也曾提出類似抗辯,但在此判決前法院態度不明。在本案 Bartz v. Anthropic 中,原告作者還質疑 Anthropic 獲取與儲存作品的過程。據指控,Anthropic 試圖建立包含「全世界所有書籍」的中央圖書館永久儲存,但數百萬本版權書籍是從盜版網站免費下載,這明確違法。法官雖認定訓練這些材料屬公平使用,但將就「中央圖書館」的性質進行審判。法官在判決書中寫道,將就用於建立 Anthropic 中央圖書館的盜版副本及相關損害進行審判。公司後來購買其先前從網際網路偷竊的書籍副本,不會免除其盜竊責任,但可能影響法定損害的範圍。