實體: Claude
所有提到 Claude 的 AI 新聞與動態。
-
瀏覽器公司推出其首個以AI為核心的瀏覽器Dia並進入測試階段
傳統網頁工具正面臨生存危機,因 AI 產品搶佔使用者注意力與市場份額。The Browser Company 去年停止開發其流行瀏覽器 Arc,因學習曲線過陡難以普及,現正專注開發整合 AI 的核心瀏覽器 Dia。該產品目前開放測試,需邀請碼使用。CEO Josh Miller 指出,Dia 旨在將 AI 介面直接嵌入瀏覽器,讓使用者無需前往 ChatGPT、Perplexity 或 Claude 等網站即可使用 AI 工具。Dia 基於 Google 支援的 Chromium 開發,具備熟悉的外觀。其標誌性功能為 URL 欄即為內建 AI 聊天機器人介面,可搜尋網頁、總結上傳檔案、自動切換聊天與搜尋模式,並能根據開啟的標籤撰寫草稿。使用者可透過對話設定語氣、寫作風格及編碼偏好。透過「History」功能,使用者可授權瀏覽器使用七天瀏覽歷史作為回答語境;「Skills」功能則允許建立小型程式碼片段作為設定捷徑,類似 Siri 捷徑。雖然瀏覽器內嵌聊天機器人並非新事物,Opera Neon 與 Google Chrome 已整合類似功能,但 The Browser Company 表示現有 Arc 使用者可立即獲得 Dia 訪問許可權,現有 Dia 使用者則可傳送邀請給他人。
-
OpenAI 發佈 o3-pro,一款升級版的 o3 AI 推理模型
OpenAI 於 2025 年 6 月 10 日推出 o3-pro,宣稱這是其目前最強大的 AI 模型。作為 o3 推理模型的升級版,o3-pro 透過逐步解決問題的方式運作,在物理、數學、程式碼等領域表現更可靠。該模型自即日起取代 o1-pro,開放給 ChatGPT Pro 及 Team 使用者使用,企業與教育使用者則於下一週獲得存取權。o3-pro 亦已於開發者 API 上線,定價為每百萬輸入 token 20 美元,每百萬輸出 token 80 美元。一百萬輸入 token 約等於 75 萬字。 根據 OpenAI 的變更日誌,專家評估顯示 o3-pro 在所有測試類別中均優於 o3,尤其在科學、教育、程式、商業與寫作輔助等關鍵領域表現更佳,且在清晰度、完整性、指令遵循與準確性上獲評更高。該模型具備搜尋網頁、分析檔案、處理視覺輸入、使用 Python 及利用記憶個人化回應等工具能力。不過,回應時間通常比 o1-pro 長,且目前暫時禁用 ChatGPT 中的臨時對話功能以解決技術問題,無法生成圖片,也不支援 Canvas 工作區功能。 在內部測試中,o3-pro 在 AIME 2024 數學評估中表現優於 Google 的 Gemini 2.5 Pro,並在 GPQA Diamond 博士級科學知識測試中擊敗 Anthropic 最新推出的 Claude 4 Opus。完整安全細節可參考 o3 系統卡片。
-
Mistral 發佈一對 AI 推理模型
法國人工智慧實驗室 Mistral 於週二宣佈推出其首款推理模型系列 Magistral,旨在提升數學、物理等領域的問題解決一致性與可靠性。該系列包含 Magistral Small 與 Magistral Medium 兩種版本。Magistral Small 擁有 240 億引數,可透過 Hugging Face 平臺下載,採用 Apache 2.0 許可證。Magistral Medium 則在 Mistral 的 Le Chat 聊天機器人平臺及 API 上進行預覽,並支援企業客戶。Mistral 自 2023 年成立以來,已獲得 General Catalyst 等投資機構支援,總籌資額超過 11 億歐元。儘管資源雄厚,Mistral 在推理模型開發上曾稍顯落後,Magistral Medium 在 GPQA Diamond、AIME 及 LiveCodeBench 等測試中表現不如 Google 的 Gemini 2.5 Pro 與 Anthropic 的 Claude Opus 4。然而,Mistral 強調 Magistral 在 Le Chat 平臺上的回答速度比競爭對手快 10 倍,並支援義大利語、阿拉伯語、俄語及簡體中文等多種語言。該模型適用於企業場景,涵蓋結構化計算、程式邏輯、決策樹及風險評估等任務,並針對多步驟邏輯進行微調,以增強可解釋性。此發布緊接在 Mistral Code 客戶端及 Le Chat Enterprise 企業服務推出之後。
-
Anthropic 的 AI 產生部落格短命離世
Anthropic 正式關閉了其「Claude Explains」部落格,該專案僅執行約一個月便結束。TechCrunch 曾報導,Anthropic 曾嘗試讓其 Claude AI 模型撰寫部落格文章,並計劃將內容擴充套件至創意寫作、資料分析及商業策略等領域。然而,該部落格最終被視為一項測試,旨在幫助團隊結合客戶對解釋性內容的需求與行銷目標。此部落格雖有專門頁面且由人類編輯校對準確性,但內容來源透明度不足,引發了社會媒體上的質疑。部分使用者認為這是一種自動化內容行銷的嘗試,試圖利用熱門話題作為潛在客戶的導流漏斗。根據 SEO 工具 Ahrefs 的資料,在關閉前,超過 24 個網站曾連結到該部落格的文章。此外,Anthropic 可能也對 AI 寫作能力過於樂觀感到擔憂,因為目前最優秀的 AI 仍容易自信地編造事實,導致出版商出現尷尬錯誤。例如,彭博社曾不得不糾正數十篇由 AI 生成的文章摘要,而 G/O Media 則因編輯不願見而發布的錯誤百出 AI 寫作內容而遭受廣泛嘲諷。Anthropic 發言人強調,該部落格是人類專業知識與 AI 能力協作的示範,旨在展示 AI 如何增強而非取代人類專家的工作價值。