實體: OpenAI
所有提到 OpenAI 的 AI 新聞與動態。
-
加州州長紐森簽署歷史性AI安全法案SB 53
加州州長加文·紐森已簽署 SB 53 號法案,這是一部具有全國先例的法案,為大型 AI 公司設立了新的透明度要求。該法案要求包括 OpenAI、Anthropic、Meta 和 Google DeepMind 在內的大型 AI 實驗室,必須公開安全協議。同時,SB 53 確保了這些公司員工的吹哨人保護,並建立了機制,讓 AI 公司和公眾可向加州緊急事務辦公室報告潛在的關鍵安全事件。公司還必須報告未經人類監督所犯的罪行,例如網路攻擊,以及模型在歐盟 AI 法案未要求的情況下表現出的欺騙行為。 AI 業界對該法案反應不一。科技企業普遍認為州級 AI 政策可能導致監管碎片化,從而阻礙創新,儘管 Anthropic 支援該法案,但 Meta 和 OpenAI 則反對 lobbying。OpenAI 甚至發表公開信勸阻紐森簽署。此法案出臺之際,矽谷科技精英正投入數億美元支援主張輕觸管制的候選人。OpenAI 和 Meta 的高管近期推出了支援 AI 友好的超級政治行動委員會。然而,其他州仍可能以加州為榜樣,試圖遏制未加約束的技術發展帶來的潛在危害。紐約州也透過了類似法案,正等待州長凱西·霍楚爾的簽名或否決。 紐森表示,該立法在保護社群與確保 AI 產業繁榮之間取得了平衡,加州將成為全國領先的國家,建立公眾信任。此外,州長正在考慮另一項 SB 243 號法案,該法案已獲兩院支援,旨在規範 AI 伴侶聊天機器人,要求實施安全協議並承擔法律責任。SB 53 是參議員斯科特·維尼的第二次嘗試,此前紐森否決了更廣泛的 SB 1047 號法案。維尼此次已聯絡主要 AI 公司,試圖幫助其理解法案修改內容。
-
DeepSeek:關於這款AI對話應用的所有資訊
中國人工智慧實驗室 DeepSeek 近期因聊天機器人應用程式在 Apple App Store 及 Google Play 排名上升而引發全球關注。該實驗室由量化對沖基金高飛者資本管理(High-Flyer Capital Management)支援,該基金由梁文風於 2019 年創立,專注於開發人工智慧演演算法。DeepSeek 實驗室於 2023 年獨立成為公司,並自建立之初便自建資料中心叢集進行模型訓練。由於受美國出口管制影響,公司訓練模型時被迫使用較弱版本的英偉達 H800 晶片,而非 H100。 DeepSeek 技術團隊以年輕且高學歷為特色,積極招募來自中國頂尖大學的博士研究員,並聘請非電腦科學背景的人才以擴充套件知識領域。該公司在 2023 年 11 月推出首批模型,包括 DeepSeek Coder、DeepSeek LLM 和 DeepSeek Chat。2024 年春季推出的 DeepSeek-V2 系列模型在效能上表現優異且執行成本較低,迫使國內競爭對手如位元組跳動和阿里巴巴降低價格或免費提供服務。2024 年 12 月推出的 DeepSeek-V3 模型在內部測試中表現優於 Meta 的 Llama 和 OpenAI 的 GPT-4o。此外,其 R1 推理模型在關鍵測試指標上與 OpenAI 的 o1 模型相當,能夠自我事實核查,在物理、科學和數學領域更具可靠性。 然而,作為中國開發的人工智慧,DeepSeek 的模型需符合中國網際網路監管機構的要求,確保回應體現「社會主義核心價值觀」。例如,其聊天機器人不會回答關於天安門廣場或臺灣自治的問題。截至 3 月,DeepSeek 的日活躍使用者量已超過 1650 萬,雖低於 ChatGPT 的 5 億周活躍使用者,但增長迅速。DeepSeek 的商業模式不明確,產品定價遠低於市場價值,且未接受風險投資。儘管模型非完全開源,但允許商業使用,這導致開發者在其平臺上建立了超過 500 個衍生模型,總下載量達 250 萬。 DeepSeek 的成功對行業產生了巨大衝擊,導致英偉達股價在 1 月下跌 18%,並
-
OpenAI 推出新代理購物系統與 Google、Amazon 競爭
美國 ChatGPT 使用者現在可在對話中直接購買 Etsy 商品,並即將支援 Shopify 購物,這標誌著線上購物未來的重大進展。OpenAI 推出的「即時結帳」功能目前開放給使用 Pro、Plus 及免費版登入的使用者,針對美國 Etsy 賣家,預計超過一百萬 Shopify 商家(包括 Glossier、Skims、Spanx 和 Vuori)將陸續加入。此功能讓使用者無需離開對話即可點選「購買」確認訂單、運費及支付細節,支援 Apple Pay、Google Pay、Stripe 或信用卡。去年 Perplexity 已推出類似功能,Microsoft 則透過 Copilot 商家計劃提供類似服務。這種無摩擦體驗可能推動購物模式從 Google 搜尋引擎和 Amazon 轉向具備策展推薦與簡易結帳的對話式代理。若更多交易在 AI 聊天機器人內完成,其背後的企業將掌握更多產品曝光與佣金定價權。Google 與 Amazon 長期作為零售發現的守門人,若 OpenAI 成為新門戶,可能面臨競爭壓力。OpenAI 表示其展示結果為「有機且未贊助」,僅依相關性排序,並向商家收取「小額費用」。此外,OpenAI 將開放原始碼其驅動即時結帳的代理商務協議(ACP),該技術由 Stripe 支援,旨在讓其他商家與開發者整合代理結帳。Stripe 執行長 Will Gaybrick 指出,Stripe 正構建 AI 的經濟基礎設施,重新架構現有商業系統。儘管使用者可能擔憂隱私,OpenAI 強調訂單、支付與配送由商家透過現有系統處理,ChatGPT 僅作為安全傳遞資訊的中介。開放 ACP 將擴大 AI 聊天機器人作為虛擬商店的採用率,並可能使 OpenAI 成為 AI 商業生態系統事實上的架構師,這將與 Google 近期推出的由 AI 代理啟動的購買協議(AP2)產生張力。
-
Anthropic 推出 Claude Sonnet 4.5,其最佳 AI 模型用於程式設計
安提洛普公司(Anthropic)於週一推出了名為 Claude Sonnet 4.5 的新前沿模型,宣稱其在程式設計基準測試中表現卓越。該公司表示,Claude Sonnet 4.5 能夠構建「生產級」應用程式,而不僅僅是原型,這代表了與以往 AI 模型相比在可靠性上的重大躍進。該模型將透過 Claude API 和 Claude 聊天機器人提供,開發者定價與 Claude Sonnet 4 相同,輸入 token 為每百萬 3 美元(約等於 75 萬字,超過《指環王》系列總字數),輸出 token 為每百萬 15 美元。過去一年,安提洛普的 AI 模型因在軟體工程任務上的強勁表現而成為開發者和企業的寵兒,蘋果和 Meta 據報在內部使用 Claude AI 模型,安提洛普也透過向 Cursor、Windsurf 和 Replit 等 AI 程式設計應用程式銷售 API 訪問權而取得顯著商業成功。近期,OpenAI 的 GPT-5 在多種程式設計基準測試中挑戰了安提洛普的優勢,表現優於 Claude 模型。然而,安提洛普表示 Claude Sonnet 4.5 在 SWE-Bench Verified 等幾個程式設計基準測試中提供行業領先的表現。安提洛普 AI 研究員 David Hershey 告訴 TechCrunch,僅靠基準測試難以完全捕捉 Claude Sonnet 4.5 的表現。Hershey 表示,在與部分企業客戶的早期測試中,他見證 Claude Sonnet 4.5 自主編碼長達 30 小時,不僅建立應用程式,還啟動資料庫服務、購買網域名稱並執行 SOC 2 審計以確保產品安全。Cursor 執行長 Michael Truell 表示 Claude Sonnet 4.5 在長遠任務上代表程式設計效能的頂尖水平,Windsurf 執行長 Jeff Wang 則稱其為「新一代程式設計模型」。安提洛普還宣稱 Claude Sonnet 4.5 是其迄今為止最對齊的前沿 AI 模型,具有較低的奉承和欺騙率,並改善了模型對提示注入攻擊的易感性。隨著 Claude Sonnet 4.5 的推出,安提洛普同時推出了 Claude Agent SDK,該基礎設施可幫助開發