實體: Meta
所有提到 Meta 的 AI 新聞與動態。
-
Reflection AI 融資 20 億美元成為美國開放前沿 AI 實驗室,挑戰 DeepSeek
Reflection AI 是一家由前 Google DeepMind 研究人員米沙·拉斯金和伊奧尼斯·安東諾格盧於 2024 年 3 月創立的起點公司,近期以 80 億美元估值籌資 20 億美元,較七個月前 5.45 億美元的估值增長了 15 倍。該公司最初專注於自主編碼代理,現正定位為 OpenAI 和 Anthropic 等封閉前沿實驗室以及中國 AI 企業如 DeepSeek 的開源替代方案或西方對等夥伴。拉斯金曾領導 DeepMind Gemini 專案的獎勵建模,而安東諾格盧則共同創造了 2016 年擊敗世界冠軍的 AlphaGo。團隊目前約有 60 名成員,主要來自 DeepMind 和 OpenAI,並已建立先進的 AI 訓練堆疊,承諾對所有人開放。 公司宣稱已識別出一種可擴充套件的商業模式,與其開放智慧戰略一致。團隊計劃明年發布一個前沿語言模型,該模型將基於「數兆兆 token」進行訓練,並具備訓練大規模專家混合(MoE)模型的能力。MoE 架構此前僅大型封閉 AI 實驗室能訓練,但 DeepSeek、Qwen 等中國模型的突破讓拉斯金意識到,若美國不採取行動,全球智慧標準將由他人建立,美國將處於劣勢。由於企業和主權國家可能因法律後果而不使用中國模型,美國及其盟友面臨競爭劣勢或迎頭趕上的選擇。 美國技術界對 Reflection AI 的使命表示支援。白宮 AI 與加密事務負責人戴維·薩克斯在 X 上表示,開放源開源 AI 模型對全球市場有重要意義,美國希望在此類別中獲勝。Hugging Face 聯合創始人克萊姆·德朗格也稱讚此舉,但指出挑戰在於展示開放 AI 模型和資料集的高速度共享。Reflection AI 對「開放」的定義側重於訪問而非開發,類似 Meta 的 Llama 或 Mistral 策略。公司將公開模型權重供公眾使用,但保留資料集和完整訓練管道專有。 商業模式方面,研究人員可免費使用模型,但收入將來自大型企業基於 Reflection AI 模型開發產品,以及政府開發「主權
-
資料曲線籌集1500萬美元對抗Scale AI
隨著 AI 公司日益成熟,高品質資料的爭奪成為行業中最具競爭力的領域之一。Alexandr Wang 曾創立的 Scale AI 是其中的佼佼者,但隨著 Wang 轉任 Meta 負責 AI 業務,投資者看到了新的機會,願意資助擁有獨特資料收集策略的公司。Y Combinator 畢業生 Datacurve 便是其中之一,專注於軟體開發所需的高品質資料。該公司於週四宣佈完成由 Chemistry 領投、Mark Goldberg 主導的 1500 萬美元 A 輪融資,參與機構包括 DeepMind、Vercel、Anthropic 和 OpenAI 的員工。此輪融資緊接其獲得前 Coinbase CTO Balaji Srinivasan 投資的 270 萬美元種子輪之後。 Datacurve 採用「賞金獵人」系統,吸引具備技能的軟體工程師完成難以獲取的資料集,目前已分發超過 100 萬美元賞金。共同創辦人 Serena Ge 強調,財務回報並非最大動力,因為高價值服務如軟體開發的資料工作薪資遠低於傳統就業,因此公司最核心的優勢在於提供極佳的使用者體驗。Ge 表示,公司將此視為消費產品而非資料標記作業,投入大量時間最佳化平臺以吸引目標使用者。隨著後訓練資料需求日益複雜,早期模型使用的簡單資料集已無法滿足當前 AI 產品對複雜強化學習(RL)環境的構建需求。隨著環境日益精進,資料在數量與品質上的要求都大幅提升,這可能讓 Datacurve 這類高品質資料收集公司獲得競爭優勢。 目前 Datacurve 專注於軟體工程領域,但 Ge 指出其模式同樣可應用於金融、行銷甚至醫療等領域。公司正致力於建立一套基礎設施,用於吸引並留住各自領域中高度專業的人才,以滿足日益複雜的資料收集需求。
-
Anthropic 計畫開設印度辦公室,並尋求與億萬富翁安巴尼合作
安提克(Anthropic)共同創辦人兼執行長達裡奧·阿莫迪(Dario Amodei)本週造訪印度,計畫在班加羅爾設立辦公室,並探索與穆克什·安巴尼(Mukesh Ambani)旗下的雷利恩斯工業(Reliance Industries)建立合作關係。此舉標誌著該人工智慧創業公司致力於深化其在美國以外第二大市場的存在。阿莫迪預計將前往孟買,與安巴尼及其他雷利恩斯工業的高階主管會面,該公司是印度最有價值的企業,也是國家頂尖電信運營商雷利恩斯 Jio 的母公司。據知情人士透露,安提克已與雷利恩斯進行數月的討論,旨在擴大其 Claude 人工智慧助手在印度的可及性。 印度作為全球第二大線上市場,擁有超過十億網際網路使用者,已成為安提克的重要成長區域。數位智慧機構 Similarweb 的資料顯示,印度佔 Claude 網站流量的第二高比例,僅次於美國。雷利恩斯工業已在八月與包括 Google 和 Meta 在內的主要科技公司合作,透過新單位雷利恩斯智慧(Reliance Intelligence)建設人工智慧基礎設施。此前,雷利恩斯也曾探索與 OpenAI 的合作,但 OpenAI 執行長山姆·阿爾曼(Sam Altman)原定於上月訪印的行程最終被延後。 阿莫迪本週還將前往新德里,與頂級立法者及高階聯邦政府官員會面,並預計會見印度總理納倫德拉·莫迪(Narendra Modi)。本週晚些時候,阿莫迪將在班加羅爾宣佈安提克辦公室的開幕,其歐洲、中東及非洲地區負責人古爾維安·普林森(Guillaume Princen)及創業公司主管丹尼爾·德蘭尼(Daniel Delaney)將陪同前往。此外,知名風險投資基金如 Accel 和 Lightspeed 也舉辦了專門的會議,讓開發者和創業公司分享如何利用 Claude 的產品。 根據 Appfigures 的資料,安提克的 Claude 應用程式在九月的印度下載量同比增長 48%,達到約 767,000 次安裝,消費者支出同比激增 572%,單月生成 195,000 美元。儘管如此,印度資料仍低於美國
-
Meta Llama:你需知的開放生成式 AI 模型一切資訊
Meta 推出了其旗艦式生成式 AI 模型 Llama,該系列包含 Llama 3 及最新發布於 2025 年 4 月的 Llama 4。Llama 4 系列包含三個版本:Scout 擁有 170 億個活躍引數、1090 億總引數及 1000 萬 token 的上下文視窗;Maverick 擁有 170 億活躍引數、4000 億總引數及 100 萬 token 上下文;Behemoth 則擁有 2880 億活躍引數及 2 兆總引數,目前尚未發布。這些模型採用專家混合(MoE)架構,並具備原生多模態支援,訓練資料涵蓋 200 種語言及大量未標記的文字、影像與影片資料。Llama 4 Scout 適合長流程與大資料分析,Maverick 則在推理能力與回應速度間取得平衡,適用於程式碼與聊天機器人,Behemoth 則專為高階研究與 STEM 任務設計。 Meta 透過與 AWS、Google Cloud、Microsoft Azure 等廠商合作,提供雲端託管服務,並透過 Llama Cookbook 提供工具協助開發者微調模型。Llama 模型可整合 Brave Search、Wolfram Alpha API 及 Python 解譯器等第三方工具。目前 Llama 已支援在 Facebook Messenger、WhatsApp、Instagram 等 Meta 平臺運作,並透過 Llama.com 及 Hugging Face 提供下載。Meta 擁有超過 25 家合作夥伴託管 Llama,包括 Nvidia、Databricks 等。然而,Llama 授權條款限制開發者使用,月活躍使用者超過 7 億的應用程式開發者需申請特殊許可。 Meta 提供 Llama Guard、Prompt Guard、CyberSecEval 及 Code Shield 等安全工具,以檢測不當內容、防止提示注入攻擊及過濾不安全程式碼。儘管如此,Llama 仍存在限制,例如多模態功能目前僅支援英語,且訓練資料包含盜版電子書及社群媒體內容。在程式碼生成方面,Llama 4 Maverick 在 LiveCodeBench 測試中得分為 40%,低於 OpenAI 的 GPT-5(85%)及 xAI 的