實體: GPT
所有提到 GPT 的 AI 新聞與動態。
-
蘋果高層表示新的AI驅動Siri並非「展示用軟體」,只是尚未準備好上市
在蘋果全球開發者大會(WWDC 25)後,針對去年 WWDC 24 展示的個人化 AI 語音助手 Siri 被質疑為虛構技術,蘋果高管予以否認。儘管尚未正式推出,蘋果執行長團隊強調 AI 是長期變革浪潮,無需為了搶先而推出功能錯誤的產品。軟體工程高階副總裁克雷格·費德瑞基指出,公司展示新版本 Siri 是為了讓外界瞭解 Apple Intelligence 的完整圖景。目前展示的是第一版架構,而第二版架構預計於 2026 年推出。費德瑞基確認,當時拍攝的影片使用的是真實執行的軟體、真實的大型語言模型及真實的語義搜尋功能。行銷高階副總裁格雷格·約斯維亞克表示,雖然技術當時運作,但錯誤率過高,若推出會令客戶失望,因此決定延後。蘋果的 AI 策略並非為了打造與 ChatGPT 競爭的聊天機器人,而是將智慧深度整合至所有平臺體驗中,並提供工具讓開發者利用基礎模型建立更聰明的應用程式。
-
瀏覽器公司推出其首個以AI為核心的瀏覽器Dia並進入測試階段
傳統網頁工具正面臨生存危機,因 AI 產品搶佔使用者注意力與市場份額。The Browser Company 去年停止開發其流行瀏覽器 Arc,因學習曲線過陡難以普及,現正專注開發整合 AI 的核心瀏覽器 Dia。該產品目前開放測試,需邀請碼使用。CEO Josh Miller 指出,Dia 旨在將 AI 介面直接嵌入瀏覽器,讓使用者無需前往 ChatGPT、Perplexity 或 Claude 等網站即可使用 AI 工具。Dia 基於 Google 支援的 Chromium 開發,具備熟悉的外觀。其標誌性功能為 URL 欄即為內建 AI 聊天機器人介面,可搜尋網頁、總結上傳檔案、自動切換聊天與搜尋模式,並能根據開啟的標籤撰寫草稿。使用者可透過對話設定語氣、寫作風格及編碼偏好。透過「History」功能,使用者可授權瀏覽器使用七天瀏覽歷史作為回答語境;「Skills」功能則允許建立小型程式碼片段作為設定捷徑,類似 Siri 捷徑。雖然瀏覽器內嵌聊天機器人並非新事物,Opera Neon 與 Google Chrome 已整合類似功能,但 The Browser Company 表示現有 Arc 使用者可立即獲得 Dia 訪問許可權,現有 Dia 使用者則可傳送邀請給他人。
-
薩姆·奧特曼認為 AI 下年將產生「創新見解
OpenAI 執行長 Sam Altman 於週二發表新文章《The Gentle Singularity》,提出未來十五年 AI 將如何改變人類經驗的願景。Altman 在文中暗示,2026 年世界將見證能夠提出新見解的 AI 系統出現。儘管此說法較為模糊,但 OpenAI 的高層近期已表示公司正專注於讓 AI 模型產生新穎有趣的想法。這與 OpenAI 在四月推出 o3 和 o4-mini 推理模型時,共同創辦人兼總裁 Greg Brockman 的說法一致,他稱這些是科學家首次用來生成新且有益想法的模型。 除了 OpenAI,其他競爭對手也轉向訓練能協助科學家提出新假設的 AI 模型。Google 在五月發布 AlphaEvolve,宣稱其 AI 程式設計代理已生成解決複雜數學問題的新方法。由前 Google 執行長 Eric Schmidt 支援的 FutureHouse 則表示其 AI 代理工具已達成真正的科學發現。同年五月,Anthropic 也推出了支援科學研究的計劃。若這些公司成功,將能自動化科學過程的關鍵部分,並可能進入藥物研發、材料科學等領域。 Altman 並非首次透過部落格透露 OpenAI 的未來計畫。他在今年一月曾寫文預測 2025 年將是代理(agents)的年份,隨後公司推出了 Operator、Deep Research 和 Codex 等三個 AI 代理。然而,讓 AI 生成新見解可能比開發代理更困難。科學界對 AI 能否產生真正原創見解仍持懷疑態度。Hugging Face 首席科學官 Thomas Wolf 曾撰文指出,現代 AI 系統無法提出關鍵的偉大問題。前 OpenAI 研究負責人 Kenneth Stanley 也告訴 TechCrunch,當下的 AI 模型無法生成新假設。Stanley 現已加入 Lila Sciences,該公司籌資 2 億美元,專門建立 AI 驅動的實驗室,專注於讓 AI 模型提出更好的假設。Stanley 認為這難點在於讓 AI 具備對創意與興趣的感知。OpenAI 是否能真正創造出能產生新見解的 AI 模型仍有待觀察,但 Altman 的文章或許正是對公司未來方向的預示。
-
OpenAI 發佈 o3-pro,一款升級版的 o3 AI 推理模型
OpenAI 於 2025 年 6 月 10 日推出 o3-pro,宣稱這是其目前最強大的 AI 模型。作為 o3 推理模型的升級版,o3-pro 透過逐步解決問題的方式運作,在物理、數學、程式碼等領域表現更可靠。該模型自即日起取代 o1-pro,開放給 ChatGPT Pro 及 Team 使用者使用,企業與教育使用者則於下一週獲得存取權。o3-pro 亦已於開發者 API 上線,定價為每百萬輸入 token 20 美元,每百萬輸出 token 80 美元。一百萬輸入 token 約等於 75 萬字。 根據 OpenAI 的變更日誌,專家評估顯示 o3-pro 在所有測試類別中均優於 o3,尤其在科學、教育、程式、商業與寫作輔助等關鍵領域表現更佳,且在清晰度、完整性、指令遵循與準確性上獲評更高。該模型具備搜尋網頁、分析檔案、處理視覺輸入、使用 Python 及利用記憶個人化回應等工具能力。不過,回應時間通常比 o1-pro 長,且目前暫時禁用 ChatGPT 中的臨時對話功能以解決技術問題,無法生成圖片,也不支援 Canvas 工作區功能。 在內部測試中,o3-pro 在 AIME 2024 數學評估中表現優於 Google 的 Gemini 2.5 Pro,並在 GPQA Diamond 博士級科學知識測試中擊敗 Anthropic 最新推出的 Claude 4 Opus。完整安全細節可參考 o3 系統卡片。