Anthropic 本周表示,它限制了最新模型 Mythos 的發佈,因為該模型過於擅長找出全球用戶所依賴的軟體中的安全漏洞。而不是將 Mythos 對外公開,這家邊界實驗室將與一些大型企業和機構分享這個模型,這些機構運營著關鍵的線上基礎設施,從 Amazon Web Services 到 JPMorgan Chase。報導指出 OpenAI 也在考慮類似的計畫,用來推出其下一個網路安全工具。這個想法表面上是讓這些大型企業能先於惡意行為者,利用先進的 LLMs 來滲入安全軟體。但上文中的「e-word」則暗示這項發佈策略可能不只是網路安全,或只是吹噓模型能力。Irregular 這家 AI 網路安全實驗室的 CEO Dan Lahav 在三月份告訴 TechCrunch,在 Mythos 發佈前,他表示雖然 AI 工具發現漏洞很重要,但任何弱點對攻擊者而言的價值,取決於許多因素,包括這些弱點如何被單獨或結合使用。Lahav 說:「我總是會問自己,他們是否發現了可以被有效利用的東西,是單獨存在,還是作為一個鏈結的一部分?」Anthropic 表示 Mythos 能夠利用漏洞遠遠超過其前一個模型 Opus。但目前還不清楚 Mythos 是否真的是網路安全模型的最終答案。一家名為 Aisle 的 AI 網路安全新創公司表示,他們使用較小、開放權重的模型,已經成功複製了 Anthropic 所說 Mythos 所達成的成果。Aisle 的團隊認為這些結果顯示,並沒有單一的深度學習模型可以用來進行網路安全,而是根據任務的不同而有所差異。考慮到 Opus 本身已經被視為網路安全領域的革新,邊界實驗室可能還有另一個理由想要將模型的發佈限制在大型機構:這可以創造出一個讓大型企業簽約的飛輪效應,同時讓競爭對手難以透過蒸餾技術來複製他們的模型。蒸餾是一種利用邊界模型來便宜地訓練新 LLMs 的技術。軟體工程師兼 exe.dev 創辦人 David Crawshaw 在社交媒體上表示:「這其實是掩蓋一個事實,那就是頂端模型現在被企業協議所限制,不再對小型實驗室開放,讓他們透過蒸餾來複製。」Crawshaw 說:「等到你我都能使用 Mythos 時,會有一個新的頂端版本,只對企業開放。這種 treadmill 效應有助於讓企業資金持續流入(這也是大部分的資金),同時讓蒸餾公司退居第二位。」這番分析與我們在 AI 生態系統中所看到的情況相符:邊界實驗室在開發最大、最強大的模型,與 Aisle 這類公司之間有一場競爭,這些公司依賴多個模型,並視開放來源的 LLMs(經常來自中國,並被指控是透過蒸餾技術開發)為經濟優勢的途徑。邊界實驗室今年對蒸餾技術採取了更嚴厲的立場,Anthropic 公開表示有中國公司試圖複製其模型的嘗試,根據彭博社報導,Anthropic、Google 和 OpenAI 這三家領先實驗室已合作識別蒸餾公司並加以阻擋。蒸餾對邊界實驗室的商業模式是一大威脅,因為它消除了透過大量資金擴展所帶來的優勢。因此,阻擋蒸餾已經是有價值的行動,而選擇性發佈的方式則讓實驗室有機會將其企業產品與其他競爭者區隔開來,當這個領域成為獲利部署的關鍵時。Mythos 或任何新模型是否真的威脅到互聯網的安全,仍有待觀察,而謹慎地推出這項技術是一種負責任的做法。Anthropic 在發佈時未回應我們的問題,詢問這個決定是否也與蒸餾相關,但這家公司可能找到了一種巧妙的方法來保護互聯網——以及它的利潤。
Anthropic 是否限制發佈 Myths 以保護互聯網或自身?
分享這篇文章: