實體: OpenAI
所有提到 OpenAI 的 AI 新聞與動態。
-
排行榜「你無法操控」,由其排名公司資助
人工智慧模型數量激增,競爭激烈,Arena 平臺(前身為 LM Arena)已成為前沿大語言模型(LLM)的公認排行榜,深刻影響資金、產品發布及公共關係週期。該起點僅在七個月內,從加州大學柏克萊分校的博士研究專案發展為估值達 17 億美元的創業公司。本集節目由 Equity 主持人 Rebecca Bellan 專訪 Arena 共同創辦人 Anastasios Angelopoulos 與 Wei-Lin Chiang,探討其平臺如何成為前沿 AI 模型的首選評測標準,以及如何在 OpenAI、Google 和 Anthropic 等巨頭支援下建立中立基準。兩人解析了 Arena 的運作機制,說明其相比靜態基準更難被操弄,並闡述了「結構中立」的含義。節目還分析了為何 Claude 目前在法律與醫療領域的專家排行榜中名列前茅,並介紹公司如何擴充套件至代理、程式碼撰寫及真實世界任務的評測,推出新的企業產品。觀眾可透過 YouTube、Apple Podcasts、Overcast、Spotify 等渠道訂閱 Equity,或關注其 X 和 Threads 帳號 @EquityPod。
-
取得博士學位的學生成為AI產業評審者
人工智慧模型迅速擴增,競爭激烈,Arena 前身為 LM Arena,已成為前沿大型語言模型(LLM)的公認排行榜,影響著資金、產品發布與公共關係週期。該起點僅在七個月內,從加州大學柏克萊分校的博士研究專案發展為估值達 17 億美元的創業公司。在 TechCrunch 的 Equity 播客節目中,Rebecca Bellan 與 Arena 共同創辦人 Anastasios Angelopoulos 及 Wei-Lin Chiang 探討瞭如何建立中立基準,即使被評測的公司也是他們的後盾。節目內容涵蓋 Arena 的運作機制、為何無法像靜態基準那樣被操弄、所謂「結構中立」的含義,以及接受 OpenAI、Google 和 Anthropic 資金是否構成利益衝突。此外,還介紹了 Arena 如何超越對話功能,將基準測試擴充套件至代理、程式碼撰寫及真實世界任務,並推出新企業產品。節目指出 Claude 目前在法律與醫療等專業領域的專家排行榜上領先。最後,討論了 Arena 對 LLM 之後技術路線的押注,認為代理(Agents)將是下一個測試重點。該播客可在 YouTube、Apple Podcasts、Overcast、Spotify 等平臺收聽,並可透過 X 和 Threads 關注 @EquityPod。
-
國防部表示,Anthropic 的「紅線」使其成為對國家安全的「不可接受風險
美國國防部於週二晚間表示,Anthropic 對國家安全構成「無法接受的風險」,這是該機構首次反駁 AI 實驗室針對國防部長皮特·海格塞斯上月將其標記為供應鏈風險所提起的訴訟。作為訴訟的一部分,Anthropic 曾請求法院暫時阻止國防部執行該標籤。國防部在加州聯邦法院提交的 40 頁檔案中指出,核心擔憂在於若公司認為其企業「紅線」被越界,可能會在或於「作戰行動」期間嘗試禁用其技術或預先改變模型行為。去年夏天,Anthropic 與五角大樓簽訂了 2 億美元的合約,用於在加密系統中部署其技術。隨後在合約條款談判中,Anthropic 表示不希望其 AI 系統用於對美國人進行大規模監控,且技術尚未準備好用於致命武器的目標鎖定或發射決策。五角大樓反駁稱,私人公司不應該規定軍隊如何使用技術。對此,Anthropic 發言人引用執行長達裡奧·阿莫迪二月底的宣告,強調國防部而非私人公司做出軍事決策,且公司從未對特定軍事行動提出異議或試圖以臨時方式限制技術使用。憲法權利律師克里斯·馬特伊指出,國防部缺乏證據支援其關於 Anthropic 可能在作戰行動中禁用或改變 AI 模型的擔憂,因此其論點無法充分解釋為何該公司的談判立場使其成為「敵對方」。馬特伊批評政府完全依賴臆測和推測來為採取的嚴肅法律步驟辯護,並未能提出可信的理由說明為何 Anthropic 拒絕同意「所有合法使用」條款會使其成為供應鏈風險,而非國防部單純不願合作的供應商。許多組織反對國防部對待 Anthropic 的方式,認為國防部本可以終止合約。多家科技公司及員工,包括來自 OpenAI、Google 和 Microsoft 的成員,以及法律權利團體已提交友方辯論書支援 Anthropic。在訴訟中,Anthropic 指控國防部侵犯其第一修正案權利,並基於意識形態基礎懲罰公司。馬特伊表示,政府無稽的論點本身就是行政機構行為明顯是報復性懲罰的證據,因為 Anthropic 拒絕同意政府條款屬於受保護的表達。關於 Anthropic 請求初步禁令的聽證會定於下週二舉行。Anthropic 發言人表示,尋求司法審查不
-
迷思特押注「自訂AI」以對抗開放AI與安第克拉在企業領域
許多企業人工智慧專案失敗並非因缺乏技術,而是因模型無法理解業務。Mistral 法國 AI 公司於 NVIDIA GTC 大會宣佈推出 Mistral Forge 平臺,讓企業能利用自有資料訓練自訂模型。與專注消費端競爭對手 OpenAI 和 Anthropic 不同,Mistral 鎖定企業客戶,預計今年年度經常性收入將超過 10 億美元。該平臺強調企業對資料和 AI 系統的掌控權,允許政府與企業針對特定需求自訂模型,而非僅透過檢索增強生成 (RAG) 或微調現有模型。Mistral 聲稱 Forge 能從頭訓練模型,以更好處理非英語或高度專業領域資料,並透過強化學習訓練代理系統,降低對第三方供應商的依賴。客戶可使用 Mistral 開放權重 AI 模型庫,包括新推出的 Mistral Small 4,並由 Mistral 前線部署工程師協助整合資料與評估。目前合作夥伴包括 Ericsson、歐洲太空總署、Reply、新加坡 DSO 與 HTX,以及荷蘭晶片製造商 ASML。ASML 於去年九月以 117 億歐元(約 138 億美元)估值完成 C 輪融資。Mistral 首席營收官 Marjorie Janiewicz 指出,主要應用場景涵蓋需針對語言文化調整的政府、高合規要求的金融機構、有自訂需求的製造商,以及需調整程式碼庫的科技公司。