實體: OpenAI
所有提到 OpenAI 的 AI 新聞與動態。
-
獨家探訪亞馬遜Trainium實驗室,這顆晶片讓Anthropic、OpenAI甚至蘋果都傾心
在亞馬遜執行長安迪·賈西(Andy Jassy)宣佈亞馬遜雲服務(AWS)與 OpenAI 達成高達 500 億美元的投資協議後,作者受邀前往亞馬遜位於奧斯汀的晶片開發實驗室進行私人導覽。此次造訪由實驗室主任克里斯托弗·金(Kristopher King)和工程總監馬克·卡羅爾(Mark Carroll)帶領,旨在探討亞馬遜自研的 Trainium 晶片對降低 AI 推理成本及挑戰英偉達壟斷地位的潛在影響。 AWS 與 OpenAI 的協議使亞馬遜成為該模型公司新 AI 代理構建工具 Frontier 的獨家供應商。據《金融時報》報導,微軟可能認為此協議違反了雙方關於讓雷德蒙德(Redmond)獲取所有 OpenAI 模型與技術的協議。作為協議的一部分,亞馬遜承諾向 OpenAI 提供 2 吉瓦的 Trainium 運算能力。目前,亞馬遜已部署 140 萬顆 Trainium 晶片,其中超過 100 萬顆用於執行 Anthropic 的 Claude 模型。雖然 Trainium 最初專注於模型訓練,但現在已廣泛用於推理,以解決行業內最大的效能瓶頸。 亞馬遜推出的 Trainium3 晶片及新 Neuron 開關組合,據稱執行成本比傳統雲端服務低達 50%,並能顯著降低延遲。2024 年,蘋果公司公開讚揚了亞馬遜的 Graviton、Inferentia 及 Trainium 晶片。為了降低開發者的轉換成本,Trainium 現在支援 PyTorch 框架,只需一行程式碼變更即可在該晶片上執行。此外,亞馬遜還與 Cerebras Systems 合作,將該公司的推理晶片整合至執行 Trainium 的伺服器中。 亞馬遜的晶片團隊自 2015 年收購以色列晶片設計商 Annapurna Labs 以來,已擁有超過 10 年的晶片設計經驗。該實驗室位於奧斯汀「The Domain」區,擁有先進的 3 奈米 Trainium3 晶片,由 TSMC 生產。實驗室展示了從晶片測試、焊接到液冷技術的完整流程,包括用於驗證晶片執行的「bring-up」過程。該團隊還設計了包含 Train
-
AI 核心技術是新簽約獎金還是業務成本?
本週,人工智慧 tokens 作為薪酬的一部分成為矽谷焦點。Nvidia 執行長 Jensen Huang 在年度 GTC 活動提出,工程師應獲得約一半基本薪資的 tokens,其頂尖人員每年可能消耗 25 萬美元的金額。投資組合管理師 Tomasz Tunguz 指出,根據 Levels.fyi 資料,頂部四分位軟體工程師薪資為 37.5 萬美元,若加上 10 萬美元 tokens,總薪酬達 47.5 萬美元,其中約五分之一為計算資源。OpenClaw 等自主執行工具的興起加速了此趨勢,工程師使用 tokens 的速度遠超一般使用者,甚至出現 Meta 與 OpenAI 工程師在內部排行榜競爭 tokens 消耗量的現象。然而,專家警告這可能並非單純福利。若公司為員工提供相當於第二個工程師的計算資源,隱含壓力是產出雙倍工作成果。此外,當計算成本接近或超過薪資時,財務團隊可能認為減少人力編制更具經濟效益。Jamaal Glenn 指出,tokens 不像薪資或股權那樣會累積增值,公司可能以此方式在不增加現金或股權的情況下提高薪酬包價值。因此,工程師需謹慎評估此趨勢是否真正有利於自身職業安全與長期利益。
-
多維度計算推動壓縮AI模型進入主流
美國私人公司違約率已飆升至 9.2%,創下數年新高,這促使風險投資機構 Lux Capital 建議依賴人工智慧的企業將計算資源承諾以書面形式確認。在金融不穩定波及人工智慧供應鏈的背景下,Multiverse Computing 這家西班牙新創公司提出另一種選擇,即完全停止依賴外部計算基礎設施。該公司透過壓縮來自 OpenAI、Meta、DeepSeek 和 Mistral AI 等主流實驗室的大型模型,推出了名為 CompactifAI 的應用程式,讓使用者能在裝置本地執行小型模型,無需資料中心或雲端供應商,從而消除對沖方風險。 CompactifAI 應用程式內嵌了名為 Gilda 的極小化模型,可在離線狀態下執行,但對裝置的記憶體和儲存空間有要求,若裝置無法滿足條件,系統會自動切換至雲端處理。此路由機制由 Multiverse 命名的「Ash Nazg」系統自動管理,但切換至雲端時會失去隱私優勢。目前該應用程式下載量不足 5000 次,主要目標是企業客戶。Multiverse 近日推出了自服務 API 門戶,讓開發者和企業能直接訪問壓縮模型,無需透過 AWS Marketplace。 隨著 Mistral AI 推出 Mistral Small 4 及 Forge 系統,小型模型在通用對話、程式碼編寫及推理方面的能力不斷提升。Multiverse 的最新壓縮模型 HyperNova 60B 2602 基於 OpenAI 的公開程式碼模型 gpt-oss-120b,宣稱能提供比原模型更快的回應速度和更低的成本,特別適合需要 AI 自主完成複雜多步驟程式碼任務的代理編寫工作流。雖然 Apple Intelligence 透過結合裝置本地模型與雲端模型來解決此類挑戰,但 Multiverse 更強調本地模型在隱私和韌性方面的優勢,這對於嵌入無人機、衛星等無法保證連線性的場景至關重要。Multiverse 目前已服務超過 100 家全球客戶,包括加拿大銀行、博世和伊比達羅拉,並傳聞正在籌資 5 億歐元,估值超過 15 億歐元。
-
Sam Altman 感謝程式設計師引發網紅圖像風潮
近期科技業面臨大規模裁員潮,Amazon 裁撤 16,000 名員工,Block 裁減近半數工作人力,Atlassian 縮減 10% 員工,Meta 亦被傳將進行另一輪大規模裁員,皆以發展 AI 為名。OpenAI 執行長 Sam Altman 於 2026 年 3 月 17 日在 X 平臺發文,感謝手寫複雜程式碼的開發者,稱其努力難以被記住,並表示感謝他們將公司帶到現狀。然而,Altman 的說法引發爭議,因其公司訓練 AI 時使用了大量傳統方式撰寫的程式碼,這些正是他現在感謝的物件。此舉被批評為將開發者視為過時工具,如同旋鈕電話般不再必要。社群反應強烈,許多網友以幽默方式回應,包括一段名為 JW Player 內嵌促銷測試的程式碼片段,被戲稱為「Sam 對軟體工程師的悼詞」。其他評論則諷刺 Altman 的感恩之情,例如稱其為「億萬富翁推文閱讀器」,或比喻其言論像瑪雅人在儀式前預言末日。整體而言,Altman 的言論被視為對開發者貢獻的誤解,並成為網路諷刺的素材。