實體: Llama
所有提到 Llama 的 AI 新聞與動態。
-
Reflection AI 融資 20 億美元成為美國開放前沿 AI 實驗室,挑戰 DeepSeek
Reflection AI 是一家由前 Google DeepMind 研究人員米沙·拉斯金和伊奧尼斯·安東諾格盧於 2024 年 3 月創立的起點公司,近期以 80 億美元估值籌資 20 億美元,較七個月前 5.45 億美元的估值增長了 15 倍。該公司最初專注於自主編碼代理,現正定位為 OpenAI 和 Anthropic 等封閉前沿實驗室以及中國 AI 企業如 DeepSeek 的開源替代方案或西方對等夥伴。拉斯金曾領導 DeepMind Gemini 專案的獎勵建模,而安東諾格盧則共同創造了 2016 年擊敗世界冠軍的 AlphaGo。團隊目前約有 60 名成員,主要來自 DeepMind 和 OpenAI,並已建立先進的 AI 訓練堆疊,承諾對所有人開放。 公司宣稱已識別出一種可擴充套件的商業模式,與其開放智慧戰略一致。團隊計劃明年發布一個前沿語言模型,該模型將基於「數兆兆 token」進行訓練,並具備訓練大規模專家混合(MoE)模型的能力。MoE 架構此前僅大型封閉 AI 實驗室能訓練,但 DeepSeek、Qwen 等中國模型的突破讓拉斯金意識到,若美國不採取行動,全球智慧標準將由他人建立,美國將處於劣勢。由於企業和主權國家可能因法律後果而不使用中國模型,美國及其盟友面臨競爭劣勢或迎頭趕上的選擇。 美國技術界對 Reflection AI 的使命表示支援。白宮 AI 與加密事務負責人戴維·薩克斯在 X 上表示,開放源開源 AI 模型對全球市場有重要意義,美國希望在此類別中獲勝。Hugging Face 聯合創始人克萊姆·德朗格也稱讚此舉,但指出挑戰在於展示開放 AI 模型和資料集的高速度共享。Reflection AI 對「開放」的定義側重於訪問而非開發,類似 Meta 的 Llama 或 Mistral 策略。公司將公開模型權重供公眾使用,但保留資料集和完整訓練管道專有。 商業模式方面,研究人員可免費使用模型,但收入將來自大型企業基於 Reflection AI 模型開發產品,以及政府開發「主權
-
Meta Llama:你需知的開放生成式 AI 模型一切資訊
Meta 推出了其旗艦式生成式 AI 模型 Llama,該系列包含 Llama 3 及最新發布於 2025 年 4 月的 Llama 4。Llama 4 系列包含三個版本:Scout 擁有 170 億個活躍引數、1090 億總引數及 1000 萬 token 的上下文視窗;Maverick 擁有 170 億活躍引數、4000 億總引數及 100 萬 token 上下文;Behemoth 則擁有 2880 億活躍引數及 2 兆總引數,目前尚未發布。這些模型採用專家混合(MoE)架構,並具備原生多模態支援,訓練資料涵蓋 200 種語言及大量未標記的文字、影像與影片資料。Llama 4 Scout 適合長流程與大資料分析,Maverick 則在推理能力與回應速度間取得平衡,適用於程式碼與聊天機器人,Behemoth 則專為高階研究與 STEM 任務設計。 Meta 透過與 AWS、Google Cloud、Microsoft Azure 等廠商合作,提供雲端託管服務,並透過 Llama Cookbook 提供工具協助開發者微調模型。Llama 模型可整合 Brave Search、Wolfram Alpha API 及 Python 解譯器等第三方工具。目前 Llama 已支援在 Facebook Messenger、WhatsApp、Instagram 等 Meta 平臺運作,並透過 Llama.com 及 Hugging Face 提供下載。Meta 擁有超過 25 家合作夥伴託管 Llama,包括 Nvidia、Databricks 等。然而,Llama 授權條款限制開發者使用,月活躍使用者超過 7 億的應用程式開發者需申請特殊許可。 Meta 提供 Llama Guard、Prompt Guard、CyberSecEval 及 Code Shield 等安全工具,以檢測不當內容、防止提示注入攻擊及過濾不安全程式碼。儘管如此,Llama 仍存在限制,例如多模態功能目前僅支援英語,且訓練資料包含盜版電子書及社群媒體內容。在程式碼生成方面,Llama 4 Maverick 在 LiveCodeBench 測試中得分為 40%,低於 OpenAI 的 GPT-5(85%)及 xAI 的
-
DeepSeek:關於這款AI對話應用的所有資訊
中國人工智慧實驗室 DeepSeek 近期因聊天機器人應用程式在 Apple App Store 及 Google Play 排名上升而引發全球關注。該實驗室由量化對沖基金高飛者資本管理(High-Flyer Capital Management)支援,該基金由梁文風於 2019 年創立,專注於開發人工智慧演演算法。DeepSeek 實驗室於 2023 年獨立成為公司,並自建立之初便自建資料中心叢集進行模型訓練。由於受美國出口管制影響,公司訓練模型時被迫使用較弱版本的英偉達 H800 晶片,而非 H100。 DeepSeek 技術團隊以年輕且高學歷為特色,積極招募來自中國頂尖大學的博士研究員,並聘請非電腦科學背景的人才以擴充套件知識領域。該公司在 2023 年 11 月推出首批模型,包括 DeepSeek Coder、DeepSeek LLM 和 DeepSeek Chat。2024 年春季推出的 DeepSeek-V2 系列模型在效能上表現優異且執行成本較低,迫使國內競爭對手如位元組跳動和阿里巴巴降低價格或免費提供服務。2024 年 12 月推出的 DeepSeek-V3 模型在內部測試中表現優於 Meta 的 Llama 和 OpenAI 的 GPT-4o。此外,其 R1 推理模型在關鍵測試指標上與 OpenAI 的 o1 模型相當,能夠自我事實核查,在物理、科學和數學領域更具可靠性。 然而,作為中國開發的人工智慧,DeepSeek 的模型需符合中國網際網路監管機構的要求,確保回應體現「社會主義核心價值觀」。例如,其聊天機器人不會回答關於天安門廣場或臺灣自治的問題。截至 3 月,DeepSeek 的日活躍使用者量已超過 1650 萬,雖低於 ChatGPT 的 5 億周活躍使用者,但增長迅速。DeepSeek 的商業模式不明確,產品定價遠低於市場價值,且未接受風險投資。儘管模型非完全開源,但允許商業使用,這導致開發者在其平臺上建立了超過 500 個衍生模型,總下載量達 250 萬。 DeepSeek 的成功對行業產生了巨大衝擊,導致英偉達股價在 1 月下跌 18%,並
-
杜克杜克Go將高階AI模型加入其訂閱方案
隱私導向的消費科技公司 DuckDuckGo 於去年推出訂閱計劃,整合了 VPN 服務、個人資訊移除及身分盜竊恢復功能。該公司於週四宣佈,此訂閱計劃現在讓使用者無需額外付費即可透過 Duck.ai 使用最新的 AI 模型。Duck.ai 聊天機器人免費使用,使用者可訪問包括 Anthropic 的 Claude 3.5 Haiku、Meta 的 Llama 4 Scout、Mistral AI 的 Mistral Small 3 24B 以及 OpenAI 的 GPT-4o mini 等模型。透過 DuckDuckGo 每月 9.99 美元的計劃,使用者將能訪問更新的模型,如 OpenAI 的 GPT-4o 和 GPT-5、Anthropic 的 Claude Sonnet 4 以及 Meta 的 Llama Maverick。公司表示,這些較大模型在遵循詳細指令、維持長對話中的上下文以及提供更深層、更細膩的回應方面表現更佳。DuckDuckGo 訂閱計劃提供了一種在享有更高隱私的情況下使用部分這些模型的方式。這為希望訪問最新模型而不必單一依賴某個供應商的使用者提供了機會。此外,Quora 的 Poe 也提供多種模型的訪問服務,其訂閱計劃起價為每月 5 美元。DuckDuckGo 表示,它將繼續在付費產品中新增更昂貴的計劃,以提供「更大且更先進的模型」。公司尚未說明當前計劃是否有任何使用限制。