實體: OpenAI
所有提到 OpenAI 的 AI 新聞與動態。
-
OpenAI 討論是否應報警處理涉嫌加拿大槍手的聊天紀錄
一名十八歲的加拿大少女傑西·範·魯斯特拉爾(Jesse Van Rootselaar)被指控在泰姆勒裡奇(Tumbler Ridge)發生大規模槍擊案,造成八人死亡。據報導,她在與 OpenAI 的 ChatGPT 對話中描述槍擊暴力行為,這些內容被公司監控工具標記為誤用,導致其帳號於 2025 年 6 月被封鎖。OpenAI 員工曾討論是否向加拿大執法機構通報,但最終決定不直接通報,因為該行為不符合通報標準。然而,OpenAI 發言人表示,公司已主動聯絡加拿大皇家騎警(Royal Canadian Mounted Police),提供有關該個人及其使用 ChatGPT 情況的資訊,以協助調查。發言人同時表達對泰姆勒裡奇悲劇中受影響者的哀悼。 除了 ChatGPT 對話外,範·魯斯特拉爾的數位足跡也引發關注。她在 Roblox 平臺上建立了一個模擬商場槍擊的遊戲,該平臺常被兒童使用。她還在 Reddit 上發布過關於槍支的內容。當地警方也已知悉她的心理不穩定,曾因她在服用不明藥物後在家起火而被召喚。文章指出,由 OpenAI 及其競爭對手開發的語言模型聊天機器人曾被指觸發使用者精神崩潰,導致現實感喪失。多起訴訟引用了鼓勵自殺或協助自殺的聊天記錄。文末提醒讀者,若處於危機或懷有自殺念頭,應撥打或傳送訊息至 988 自殺與危機熱線。
-
印度薩爾瓦姆推出Indus AI對話應用 競爭加劇
印度人工智慧創業公司 Sarvam 於本週五推出了其 Indus 聊天應用程式,支援網頁與行動裝置,旨在服務當地語言使用者並應對由 OpenAI、Anthropic 及 Google 等全球巨頭主導的市場。隨著印度成為生成式 AI 採用的重要戰場,該應用於本週二在孟買舉行的印度 AI 影響峰會上正式亮相,此前 Sarvam 已在該峰會上展示了其 105B 和 30B 引數的大型語言模型。Sarvam 105B 模型作為 Indus 的後臺,該應用目前處於測試階段,可在 iOS、Android 及網頁上使用,支援文字與語音輸入及回應。使用者可透過手機號碼、Google、Microsoft 或 Apple ID 登入,但服務目前僅限印度。Sarvam 自 2023 年成立以來已籌得 4100 萬美元,投資方包括 Lightspeed Venture Partners、Peak XV Partners 及 Khosla Ventures。Indus 應用目前存在部分限制,例如無法在不刪除帳號的情況下清除聊天記錄,且無法關閉推理功能,這可能會影響回應速度。Sarvam 共同創辦人 Pratyush Kumar 表示,由於計算資源逐步擴充套件,使用者初期可能會遇到等待名單,公司正尋求使用者反饋以最佳化服務。此舉標誌著印度新興企業試圖建立本土替代方案,以增強對 AI 基礎設施的控制權。
-
Anthropic資助團體支持遭競爭對手AI超級戰資金助攻擊的候選人
去年年底,紐約州眾議員阿歷克斯·博爾斯成為了一個支援人工智慧超級政治行動委員會的攻擊目標,該組織旨在阻撓他的國會競選。這個名為「引領未來」的團體擁有超過一億美元的資金,贊助者包括安德烈森霍洛威、OpenAI 總裁格雷格·布羅克曼、AI 搜尋初創公司 Perplexity 以及 Palantir 聯合創始人喬·朗斯代爾。面對挑戰,博爾斯表示將迎戰,現在他已獲得足夠的資金支援。公共第一行動是一個由 Anthropic 捐贈兩千萬美元支援的政治行動委員會,正花費四十五萬美元協助博爾斯競選紐約第十二國會選區,據彭博社報導。與對手不同,該委員會雖然同樣支援人工智慧,但主張的願景聚焦於透明度、安全標準和公眾監督。同時,行業支援的「引領未來」委員會已投入一百一十萬美元進行廣告攻擊,主要原因在於博爾斯贊助了紐約州的 RAISE 法案,該法案要求主要人工智慧開發商披露安全協議並報告系統嚴重濫用情況。
-
xAI 好消息:Grok 現在相當擅長回答《BALDUR'S GATE》的問題
不同的人工智慧實驗室各有其優先事項。OpenAI 傳統上專注於消費者使用者,而其競爭對手 Anthropic 則傾向於企業市場。Elon Musk 旗下的 xAI 最近被發現特別重視電子遊戲攻略。Business Insider 的 Grace Kay 發表了一篇關於 xAI 的詳細報告,指出 Musk 正讓員工生活變得困難。其中一個例子是,去年因 Musk 對聊天機器人回答關於遊戲《Baldur's Gate》的詳細問題不滿意,導致模型發布延遲數天,高階工程師被從其他專案中調走以改善回答。這引發了工程師們對被 54 歲管理者分心處理遊戲攻略的挫折感,但也提出了更嚴肅的問題:Musk 是否真的獲得了他想要的遊戲技能?為了回答這個問題,作者 Ram Iyer 構建了一個名為"BaldurBench"的準基準測試,將 xAI 的 Grok 與 ChatGPT、Claude 和 Gemini 三大主流模型進行比較。測試結果顯示,Grok 提供了相當好的資訊,雖然使用瞭如"save-scumming"和"DPS"等遊戲術語,但答案實用且資訊豐富,且喜歡使用表格和理論推演。ChatGPT 偏好使用專案符號和短句,而 Gemini 則喜歡加粗重要詞彙。最大的意外是 Claude,它特別擔心洩露遊戲資訊,當被問及最佳隊伍組成時,它建議不要過度擔心,只需玩讓自己感到快樂的內容。儘管 xAI 曾專注於在特定領域達到與現有模型並駕齊驅的表現,但此次測試結果顯示 Grok 的建議與其他模型相當,這表明 xAI 若能努力嘗試,確實能達成目標。所有對話記錄已公開,供讀者檢視 Grok、ChatGPT、Claude 和 Gemini 的具體回應。