實體: xAI
所有提到 xAI 的 AI 新聞與動態。
-
OpenAI 的努力讓 AI 做你想要的任何事情
2022 年,研究員 Hunter Lightman 加入 OpenAI 後,目睹了 ChatGPT 的爆發式成長,同時他領導的 MathGen 團隊專注於訓練模型解決高中數學競賽題目。該團隊被視為 OpenAI 開發具備人類般推理能力的 AI 代理的核心技術基礎。儘管 OpenAI 的最新系統仍存在幻覺問題,但其模型在數學推理方面已顯著進步,其中一個模型近期在國際數學奧林匹克(IMO)中奪得金牌。OpenAI 執行長 Sam Altman 在 2023 年 11 月 6 日的開發者會議上表示,未來的 AI 代理將能自動完成各種任務。 OpenAI 的推理模型突破與強化學習(RL)技術密切相關。2016 年,Google DeepMind 的 AlphaGo 利用 RL 擊敗人類棋手,啟發了 OpenAI 員工 Andrej Karpathy 的構想。2018 年,OpenAI 推出了 GPT 系列大語言模型,但初期在數學處理上表現不佳。直到 2023 年,OpenAI 結合大語言模型、強化學習及「測試時計算」技術,推出了代號「Q*」後更名為「Strawberry」的模型,並引入「鏈式思維」(Chain-of-thought)方法,使模型能像人類一樣進行推理、發現錯誤並回溯。這項突破直接促成了 2024 年秋季推出的 o1 推理模型的誕生。 o1 模型的研發動員了 21 名基礎研究員,其中部分人才隨後被 Meta 以超過 1 億美元的薪酬聘請。OpenAI 透過投入大量計算資源和人才,成功開發出 o1,該模型能同時生成多個代理並探索不同想法以選擇最佳答案。這種技術也被 Google 和 xAI 採用。目前,OpenAI 正致力於將這些推理能力應用於更具主觀性的任務,如網購或尋找停車位,並計劃在未來的 GPT-5 模型中實現更直觀的代理體驗。儘管面臨 Google、Anthropic 等競爭對手,OpenAI 仍希望透過持續的技術創新維持其行業領導地位。
-
Google推出Gemini Deep Think AI,一款能並行測試多種想法的推理模型
Google DeepMind 推出了 Gemini 2.5 Deep Think,宣稱這是其最先進的 AI 推理模型。該模型能同時探索並考慮多個想法,再根據輸出選擇最佳答案。訂閱 Google 每月 250 美元 Ultra 訂閱服務的使用者,可於本週五在 Gemini 應用程式中獲得訪問許可權。此模型於 2025 年 5 月在 Google I/O 首次亮相,是 Google 首款公開可用的多代理模型。系統會生成多個 AI 代理並行處理問題,雖然比單一代理消耗更多計算資源,但通常能產生更好的答案。Google 使用此模型的變體在今年國際數學奧林匹克(IMO)中獲得金牌,並向一組選定的數學家與學者開放了該模型。與大多數面向消費者的 AI 模型不同,此模型需要數小時進行推理。Google 希望該模型能增強研究努力,並收集反饋以改進多代理系統在學術場景中的應用。 Gemini 2.5 Deep Think 在「人類最後考試」(HLE)上達到最優效能,該測試衡量 AI 回答數學、人文與科學領域數千個眾包問題的能力。Google 聲稱其模型在無工具情況下得分為 34.8%,高於 xAI 的 Grok 4(25.4%)與 OpenAI 的 o3(20.3%)。在 LiveCodeBench 6 的競爭程式碼任務測試中,Gemini 2.5 Deep Think 得分 87.6%,優於 Grok 4 的 79% 與 o3 的 72%。該模型能自動與程式碼執行及 Google 搜尋等工具協作,並能產生比傳統 AI 模型更長、更詳細且美觀的回應。儘管表現強勁,多代理系統的服務成本較高,因此 Google 與 xAI 選擇將其限制在最高階別訂閱計劃中。Google 計劃在幾週內透過 Gemini API 向一組測試人員開放此模型,以瞭解開發者與企業如何應用該系統。
-
賈柏格暗示_Meta_將不會將其「超智慧」AI模型全部開放源碼
Meta 執行長馬克·祖克伯格於週三發表信件,闡述其關於「個人超級智慧」的願景,即人們應能利用 AI 達成個人目標。這封信件暗示 Meta 正調整其 AI 模型的發布策略,以追求超級智慧。祖克伯格表示,雖然超級智慧能廣泛造福世界,但也帶來新的安全挑戰,必須嚴格降低風險並謹慎選擇開放原始碼的專案。這與 Meta 過往將 Llama 系列開放模型視為與 OpenAI、xAI 及 Google DeepMind 等競爭對手差異化的關鍵策略形成對比。過去 Meta 曾承諾未來 Llama 模型將成為業界最先進者,但祖克伯格也保留彈性,若認為開放原始碼不合乎責任原則,則可能不執行。隨著 Meta 在 2025 年 6 月正式啟動人工通用智慧(AGI)競速,投入 143 億美元收購 Scale AI 並重組 AI 部門為 Meta Superintelligence Labs,公司開始專注於開發閉源模型。近期報導指出,Meta 暫停測試最新 Llama 模型 Behemoth,轉而發展閉源模型。祖克伯格強調,個人超級智慧將透過增強現實眼鏡和虛擬現實頭盔等自有產品交付,這些裝置將成為主要計算裝置。儘管 Meta 發言人重申對開放原始碼 AI 的承諾,並表示未來將混合發布開放與閉源模型,但 Meta 的優先順序似乎已從單純的開放原始碼轉向更重視商業控制與產品整合的策略。
-
川普的AI策略以成長取代防護欄 在對抗中國的競賽中
特朗普政府於週三發布了備受矚目的《AI 行動計劃》,該檔案標誌著與前總統拜登謹慎應對 AI 風險的態度的顯著轉變,轉而積極推進 AI 基礎設施建設、為科技企業減緩繁文縟節、鞏固國家安全並與中國競爭。此舉將對各行業及普通美國消費者產生深遠影響。計劃淡化了對 AI 潛在危害的緩解努力,優先發展資料中心以支撐 AI 產業,甚至可能使用聯邦土地或在關鍵能源電網期間保持供電。計劃的具體效果取決於執行細節,目前許多細節尚未明確。特朗普將此定位為 usher in a new golden age of human flourishing 的唯一途徑,旨在說服公眾將數十億美元用於建設資料中心符合其利益,並包含提升工人技能及與地方政府合作創造資料中心相關就業的建議。特朗普表示,為了確保未來,必須發揮美國創新力量,拒絕極端氣候教條和官僚繁文縟節,簡而言之就是「Build, Baby, Build!」。 該計劃由特朗普政府團隊中的科技和 AI 專家撰寫,成員包括科學與技術政策辦公室主任 Michael Kratsios、AI 與加密貨幣 czar David Sacks 以及國家安全事務助理 Marco Rubio。超過 10,000 個利益團體提交了公開意見供參考。計劃包含解除監管和恢復 AI 禁令的條款,參議院本月已移除預演算法案中禁止州對 AI 監管十年的爭議條款。特朗普政府威脅將根據各州的 AI 監管情況限制聯邦資金,並指示聯邦通訊委員會評估州級 AI 監管是否幹擾其職能,若涉及廣播、電視和網際網路則 FCC 可介入。聯邦層面,計劃指示科學與技術政策辦公室詢問企業和公眾關於妨礙 AI 創新和採用的現有聯邦法規。 在資料中心建設方面,特朗普呼籲解除監管以加速 AI 相關基礎設施建設,如資料中心、半導體工廠和電源。政府認為現有的環境法規,如國家環境政策法案、清潔空氣法和清潔水法,妨礙了美國滿足 AI 軍備競賽快速需求的需要。因此,計劃強調穩定美國能源電網,並要求聯邦政府確保大型電力消費者在關鍵電網期間能管理電力消耗。某些公司如 xAI 和 Meta 因將汙染集中在脆弱社群而受到批評,特別是 xAI 被指繞過環境保護