實體: GPT
所有提到 GPT 的 AI 新聞與動態。
-
OpenAI 繼續沿著「紅色警報」路線推進,推出全新圖像生成模型
OpenAI 推出 GPT Image 1.5 新版本,承諾提升指令遵循能力、精確編輯功能,並實現最高四倍的圖片生成速度。該模型於週二起向所有 ChatGPT 使用者及 API 使用者開放。此舉是 OpenAI 與 Google Gemini 競爭加劇的延續,OpenAI 執行長 Sam Altman 上月在洩漏的內部備忘錄中發出「程式碼紅」警報,表示 Google 因 Gemini 3 及 Nano Banana Pro 的推出而奪取市場份額,導致 OpenAI 地位動搖。儘管 OpenAI 上週已推出 GPT-5.2 回應挑戰,但此次圖片生成器的更新仍具重大意義。GPT Image 1.5 提供類似 Nano Banana Pro 的後製功能,允許使用者對臉部相似度、照明、構圖及色彩等進行細微調整以維持視覺一致性,解決了現有生成式 AI 工具在迭代修改時常重新解讀圖片導致不一致的問題。此外,OpenAI 將圖片功能整合至 ChatGPT 側邊欄,打造類似創意工作室的介面,並計劃在搜尋結果中增加更多視覺元素與清晰來源,以提升使用者體驗。
-
風投機構探討為何大多數消費端AI新創企業仍缺乏持續競爭力
儘管生成式 AI 泡沫已持續三年,但大多數 AI 創業公司仍主要透過向企業銷售獲利,而非針對個人消費者。雖然通用大語言模型如 ChatGPT 迅速被消費者採用,但許多專為消費者設計的 GenAI 應用尚未引起共鳴。Goodwater Capital 的合夥人 Chi-Hua Chien 指出,早期圍繞影片、音訊和照片的應用雖具吸引力,但隨著 Sora、Nano Banana 等模型的出現以及中國開放原始碼影片模型的推出,許多機會已消失。他將這些應用比作 iPhone 2008 年推出後流行的第三方手電筒,最終被 iOS 整合。Chien 認為,AI 平臺需要類似 2009 至 2010 年手機平臺鞏固的時期,才能孕育出持久的消費者產品,這可能是 Uber 和 Airbnb 等巨頭誕生的前夜。目前 Google 的 Gemini 已達到與 ChatGPT 技術對等的水平,顯示穩定化跡象。 Scribble Ventures 的創辦人 Elizabeth Weil 也認為當前消費者 AI 應用處於「尷尬的青少年期」。Chien 指出,手機每天被拿起約五百次,卻僅接觸所見內容的 3% 至 5%,難以充分利用 AI 能力,因此可能需要新的個人裝置。OpenAI 與 Apple 前設計總監 Jony Ive 正開發傳聞中的無螢幕口袋裝置,Meta 的 Ray-Ban 智慧眼鏡搭配腕帶控制,其他起點則嘗試推出使用 AI 的別針、項鍊或戒指。不過,並非所有產品都依賴新裝置,Chien 建議可開發個人化 AI 財務顧問,Weil 則預期個人化「全天候」導師將普及,透過手機直接提供專業指導。儘管對 AI 潛力感到興奮,兩人對幾個隱形 AI 驅動的社交網路起點表示懷疑,因為這些平臺讓 AI 機器人與使用者互動,將社交變成單人遊戲,削弱了真實人類互動的價值。
-
First Voyage 筹得 250 萬美元用以開發協助建立習慣的 AI 伴侶
在人工智慧生成內容充斥的時代,新創公司 First Voyage 推出了名為 Momo Self Care 的應用程式,旨在幫助使用者建立良好習慣而非被無效的 AI 內容淹沒。該應用擁有一個數位寵物 Momo,使用者透過完成任務來照顧它,Momo 則會提醒使用者執行預設的習慣。類似於 Focus Friend,完成任務的使用者可獲得硬幣用於購買應用程式內的物品以客製化寵物,並能與 Momo 討論自我照顧,獲得針對個人目標的建議。共同創辦人兼執行長 Besart Çopa 表示,Momo 幫助使用者成為更好的自己,而使用者則以關懷和可愛配件回饋 Momo。 First Voyage 於本週一宣佈完成種子輪融資,籌得 250 萬美元,投資方包括 a16z speedrun、SignalFire、True Global 及其他投資者。據 Çopa 透露,Momo 使用者已在平臺上建立超過 200 萬個任務,最受歡迎的習慣涉及生產力、靈性與正念。儘管市場上充斥著 ChatGPT、Claude 和 Grok 等 AI 聊天機器人,引發對 AI 伴侶可能帶來負面影響的擔憂,Çopa 認為 AI 角色與人類關係將日益增加,但他強調針對健康與自我照顧的 AI 應用比針對基本衝動的應用更好。他提到團隊已加入安全防護機制,如提示詞過濾器,以確保對話在適當邊界內進行。 籌得的資金將用於將 Momo 推出至 Android 應用商店(目前僅在 iOS 可用),並提升其與使用者互動的智慧程度。團隊希望 Momo 能成為結合最佳 AI、動畫與遊戲化元素的消費品牌,改善更多人的生活。
-
Google 發布迄今最深度的 AI 研究代理 —— 恰逢 OpenAI 放棄 GPT-5.2
Google 於週四發布了基於其最新基礎模型 Gemini 3 Pro 重新構思的 Gemini Deep Research 研究代理。此新代理不僅能生成研究報告,更允許開發者透過全新的互動 API 將 Google 的 SATA 模型研究能力嵌入至自有應用程式中,賦予開發者在代理式 AI 時代更深的控制權。該工具能綜合海量資訊並處理大型上下文,目前已被客戶用於盡職調查及藥物毒性安全研究等任務,並即將整合進 Google 搜尋、Google 金融、Gemini App 及 NotebookLM 等服務中,旨在讓 AI 代理取代人類進行搜尋。 Google 強調,Deep Research 受益於 Gemini 3 Pro 作為「最事實準確」模型的地位,該模型經過訓練以在複雜任務中減少幻覺。幻覺是長期深度推理代理任務中的關鍵問題,因為自主決策次數越多,單一錯誤便可能導致整體輸出失效。為證明其進展,Google 推出了名為 DeepSearchQA 的新基準測試,用於評估代理在複雜多步驟資訊搜尋任務中的表現,並開放了該基準。此外,測試還涵蓋了獨立基準「人類最後的考試」及瀏覽器代理任務基準 BrowserComp。測試結果顯示,Google 的新代理在自身基準及人類最後的考試中表現最佳,而 OpenAI 的 ChatGPT 5 Pro 則在各項測試中緊隨其後,並在 BrowserComp 上略勝一籌。然而,這些基準測試在 Google 發布後不久即顯陳舊,因為同一天 OpenAI 推出了代號為 Garlic 的 GPT 5.2 模型,該模型在一系列典型基準測試中表現優於對手,特別是 Google。此次 Google 發布的時機特別有趣,因為世界正等待著 Garlic 的推出。