實體: GPT
所有提到 GPT 的 AI 新聞與動態。
-
OpenAI 發佈 GPT-5.4 具 Pro 與 Thinking 版本
OpenAI 於週四推出了 GPT-5.4,宣稱這是其最強大且高效的專業工作前沿模型。該模型提供標準版、推理版(GPT-5.4 Thinking)以及針對高績效最佳化的版本(GPT-5.4 Pro)。API 版本的上下文視窗可達一百萬 token,遠超 OpenAI 現有產品。新模型在 token 效率上顯著提升,能以較少 token 解決相同問題,並在 OSWorld-Verified 和 WebArena Verified 等電腦使用 benchmarks 中創下紀錄。在 OpenAI 的 GDPval 知識工作任務測試中,得分高達 83%。此外,GPT-5.4 在 Mercor 的 APEX-Agents 專業技能測試(涵蓋法律與金融領域)中取得領先,Mercor 執行長 Brendan Foody 指出該模型在製作簡報、財務模型及法律分析等長期交付成果方面表現卓越,且執行速度更快、成本更低。 在減少幻覺與事實錯誤方面,新模型相比 GPT 5.2 在個別宣告的錯誤率降低 33%,整體回應錯誤率降低 18%。API 版本引入了新的工具呼叫系統 Tool Search,取代了以往列出所有工具定義的方式,有效節省 token 並提升效率。同時,OpenAI 新增安全評估以測試模型的思維鏈(Chain-of-Thought),顯示在推理版中模型較少欺騙其思維過程,證明思維鏈監控仍是有效的安全工具。
-
黃仁勳表示英偉達正在縮減對OpenAI與Anthropic的投入,但其說明引發更多疑問而非解答
在週三於舊金山摩根士丹利科技、媒體與電信會議上,英偉達執行長黃仁勳表示,公司近期對 OpenAI 和 Anthropic 的投資可能是最後一次,因為這兩家公司預計今年晚些時候將上市,屆時投資機會將關閉。黃仁勳指出,英偉達透過銷售為這兩家公司提供動力的晶片獲利,無需再投入資金推高回報。儘管公司發言人引用財報會議紀錄稱投資旨在擴充套件生態系統,但市場對這類迴圈投資可能製造投機泡沫的擔憂日益增加。英偉達最初承諾投資 OpenAI 高達 1000 億美元,但最終確認的投資額為 300 億美元,遠低於先前承諾。此外,英偉達與 Anthropic 的關係也充滿緊張,Anthropic 執行長阿莫迪曾將美國晶片公司向中國出售高效能 AI 處理器比作「向朝鮮出售核武器」。隨後,川普政府因 Anthropic 拒絕禁止模型用於自主武器或大規模國內監控而將其列入黑名單,禁止聯邦機構和軍事承包商使用其技術。此舉引發爭議,OpenAI 隨即與五角大樓達成協議,而 Anthropic 則稱此舉為「虛偽」。在相關訊息公佈後 24 小時內,Anthropic 的 Claude 在 Apple 美國 App Store 免費應用程式排名中超越 ChatGPT 登上榜首。目前英偉達持有兩家方向背道而馳的公司的股份,黃仁勳提出的停止投資理由與後期私募投資運作方式不符,市場更傾向認為這是為了脫離日益複雜且快速惡化的局勢。
-
Anthropic CEO 謝爾蓋·阿莫迪 認為 OpenAI 與軍方合作的說明是「徹底的謊言」,報導指出
安提克(Anthropic)共同創辦人兼執行長大衛·阿莫迪(Dario Amodei)對開源人工智慧(OpenAI)執行長山姆·阿爾曼(Sam Altman)的立場表示不滿。阿莫迪在內部備忘錄中指出,OpenAI 與美國國防部(DoD)的協議是「安全劇場」,其動機是為了安撫員工而非防止濫用。上週,安提克與國防部未能就軍事部門要求無限制訪問其技術達成協議。安提克已擁有價值 2 億美元的國防合約,並堅持要求國防部確認不會使用其人工智慧進行國內大規模監控或自主武器。相反,在特朗普政府時期被稱為戰爭部的國防部,選擇與 OpenAI 達成協議。阿爾曼聲稱其新合約將包含與安提克主張相同的紅線。阿莫迪批評阿爾曼的說法是「赤裸裸的謊言」,並指責其將自己描繪成調解者。安提克特別反對國防部堅持其人工智慧可用於「任何合法用途」的立場,而 OpenAI 則宣稱其合約允許用於「所有合法目的」。儘管 OpenAI 表示其合約已明確排除大規模國內監控,但批評者指出法律可能隨時間改變。目前公眾似乎傾向支援安提克,ChatGPT 安裝量在 OpenAI 與國防部達成協議後跳升了 295%。阿莫迪擔心這種話術在媒體和公眾面前失效,並擔憂其無法說服 OpenAI 的員工。
-
Google Search 推出 Gemini 的 Canvas 功能於 AI 模式對所有美國用戶開放
Google 已將 Canvas 在 AI Mode 的功能擴充套件至美國所有使用者,此前該功能僅作為 Google Labs 實驗於去年推出。此功能旨在協助使用者組織規劃專案或進行深入研究,現在支援在 Google 搜尋中草擬檔案或建立自訂工具。使用者可描述想法,系統即生成程式碼將其轉化為可分享的應用程式或遊戲,亦能協助潤飾創意寫作草稿並提供專案反饋。Canvas 可用於將研究報告轉換為網頁、測驗或音訊摘要,部分功能與 Google 的研究工具 Notebook LM 重疊。目前 Canvas 已整合於 Gemini 中,Google AI Pro 與 Google AI Ultra 訂閱者可存取最新模型 Gemini 3 及更大容量的百萬 token 上下文視窗。透過 Google 搜尋中的 AI Mode 功能,更多使用者將接觸到 Canvas,包括尚未嘗試 Gemini 能力的使用者,這凸顯了 Google 搜尋龐大使用者基礎的優勢。使用時,使用者需在 AI Mode 下選取工具選單中的 Canvas 選項並描述需求,系統將開啟側邊欄整合網路資訊與 Google 知識圖譜。若建立原型或應用程式,使用者可測試功能、切換檢視底層程式碼,並透過與 Gemini 對話來最佳化應用運作。Canvas 與 OpenAI 及 Anthropic 等競爭對手工具競爭,但 ChatGPT 的 Canvas 功能會根據查詢自動觸發,而 Google 與 Claude 則需要更直接的互動,兩者皆支援協助寫作或將想法轉化為專案。