實體: OpenAI
所有提到 OpenAI 的 AI 新聞與動態。
-
麥里亞姆-韋伯斯特選「slop」為年度單字
美國權威字典 Merriam-Webster 於本週日宣佈,2025 年度用詞為「slop」。該詞被定義為「通常由人工智慧大量生產的低品質數位內容」。字典指出,此詞如同黏液、泥漿和汙泥,帶有令人不願觸碰的濕潤聲音,並滲透到各個領域。在人工智慧焦慮的時代,這個詞旨在傳達一種較少恐懼、更多嘲諷的語氣。Merriam-Webster 總裁 Greg Barlow 表示,這是一個能生動描述人工智慧技術的詞,讓人們感到既迷人又惱人,甚至有點荒謬。 今年,「slop」廣泛出現在媒體報導中,用以描述 OpenAI 的 Sora 和 Google Gemini 的 Veo 等平臺如何改變網際網路。這些新的媒體生成工具使得人工智慧生成的書籍、播客、流行歌曲、電視廣告乃至整部電影成為可能。一項 5 月的研究聲稱,近 75% 的網路新內容涉及某種形式的人工智慧。這些工具甚至催生了所謂的「slop 經濟」,即利用大量人工智慧生成內容來獲取廣告收入。批評者擔心這種趨勢會進一步極化數位社群,將人們分為能負擔付費牆高品質內容的群體,以及只能負擔資訊價值較低的人工智慧內容的群體。 此外,「slop」也被用於描述人工智慧對網路安全報告、法律簡報及大學論文等領域的影響。今年,科技用詞在年度用詞類別中表現突出,Macquarie Dictionary 選擇了「AI slop」,Oxford Dictionary 選擇了「ragebait」,而 Collins Dictionary 則選擇了「vibe coding」。
-
Google 發布迄今最深度的 AI 研究代理 —— 恰逢 OpenAI 放棄 GPT-5.2
Google 於週四發布了基於其最新基礎模型 Gemini 3 Pro 重新構思的 Gemini Deep Research 研究代理。此新代理不僅能生成研究報告,更允許開發者透過全新的互動 API 將 Google 的 SATA 模型研究能力嵌入至自有應用程式中,賦予開發者在代理式 AI 時代更深的控制權。該工具能綜合海量資訊並處理大型上下文,目前已被客戶用於盡職調查及藥物毒性安全研究等任務,並即將整合進 Google 搜尋、Google 金融、Gemini App 及 NotebookLM 等服務中,旨在讓 AI 代理取代人類進行搜尋。 Google 強調,Deep Research 受益於 Gemini 3 Pro 作為「最事實準確」模型的地位,該模型經過訓練以在複雜任務中減少幻覺。幻覺是長期深度推理代理任務中的關鍵問題,因為自主決策次數越多,單一錯誤便可能導致整體輸出失效。為證明其進展,Google 推出了名為 DeepSearchQA 的新基準測試,用於評估代理在複雜多步驟資訊搜尋任務中的表現,並開放了該基準。此外,測試還涵蓋了獨立基準「人類最後的考試」及瀏覽器代理任務基準 BrowserComp。測試結果顯示,Google 的新代理在自身基準及人類最後的考試中表現最佳,而 OpenAI 的 ChatGPT 5 Pro 則在各項測試中緊隨其後,並在 BrowserComp 上略勝一籌。然而,這些基準測試在 Google 發布後不久即顯陳舊,因為同一天 OpenAI 推出了代號為 Garlic 的 GPT 5.2 模型,該模型在一系列典型基準測試中表現優於對手,特別是 Google。此次 Google 發布的時機特別有趣,因為世界正等待著 Garlic 的推出。
-
迪士尼控告谷歌停止侵權 声稱遭大規模版權侵害
迪士尼於週三向 Google 發出停止侵權信,指控該科技巨頭大規模侵犯其版權。根據 Variety 報導,迪士尼聲稱 Google 利用人工智慧模型與服務,商業化分發未經授權的圖片與影片。信中比喻 Google 為「虛擬自動販賣機」,能大規模複製、渲染並分發迪士尼珍貴的版權角色與作品。此外,信中還指出許多由 Google 人工智慧服務生成的侵權圖片上帶有 Gemini 標誌,錯誤暗示 Google 對迪士尼智慧財產權的使用已獲授權。被指控侵犯的角色包括《冰雪奇緣》、《獅子王》、《莫阿娜》、《小美人魚》及《死侍》等。Google 未確認或否認這些指控,但表示將與迪士尼「展開對話」。Google 發言人強調雙方有長期互利關係,並使用公開網路資料構建人工智慧,同時已開發如 Google-extended 及 YouTube 內容識別等創新版權控制機制。值得注意的是,就在迪士尼發出此信的同一天,它與 OpenAI 簽署了一份價值 10 億美元、期限三年的協議,將迪士尼標誌性角色引入其 Sora 人工智慧影片生成器。
-
OpenAI 以 GPT-5.2 回應 Google 發出的「紅色警報」備註
OpenAI 於週四推出了其最新的前沿模型 GPT-5.2,旨在應對 Google 日益加劇的競爭,並將其定位為目前最先進的模型,專為開發者和日常專業用途設計。該模型透過 API 提供三種版本:Instant 專為資訊查詢、寫作和翻譯等常規查詢最佳化速度;Thinking 擅長程式設計、分析長文件、數學和規劃等複雜結構化工作;Pro 則是頂端模型,旨在為困難問題提供最大準確度和可靠性。OpenAI 首席產品官 Fidji Simo 表示,設計 5.2 是為了釋放更多經濟價值,使其在製作試算表、建立簡報、編寫程式、感知影象、理解長上下文以及使用工具方面表現更佳。 GPT-5.2 的推出正值與 Google Gemini 3 的激烈競爭中,後者在大多數測試專案上領先 LMArena 排行榜(程式設計除外,目前仍由 Anthropic 的 Claude Opus-4.5 領先)。月初有報導指出,OpenAI 執行長 Sam Altman 發布了內部「程式碼紅」備忘錄,反映 ChatGPT 流量下降及消費者市場份額流失的擔憂,呼籲調整優先事項,暫停廣告等承諾,專注於提升 ChatGPT 體驗。儘管部分員工建議延後發布以進行更多改進,OpenAI 仍將 GPT-5.2 視為重奪領導地位的手段,同時加強企業機會。公司針對開發者和工具生態系統,目標成為構建 AI 應用程式的預設基礎。 GPT-5.2 在程式設計、數學、科學、視覺、長上下文推理和工具使用等領域設定新基準,公司聲稱這將導致更可靠的代理工作流、生產級程式碼和跨大上下文及真實世界資料運作的複雜系統。其 Thinking 模式在 SWE-Bench Pro、GPQA Diamond 及 ARC-AGI 等測試中超越 Gemini 3 和 Claude Opus 4.5。研究負責人 Aidan Clark 指出,強健的數學分數是模型能否遵循多步驟邏輯、保持數字一致性並避免累積錯誤的代理指標,這對金融建模、預測和資料分析至關重要。產品負責人 Max Schwarzer 表示,GPT-5.2 Thinking 的程式碼生成和除錯有實質改進,錯誤比前代減少 38%,並