跳至內容
AI 新聞站
返回

微軟推出三款新基礎模型對抗AI競爭對手

微軟AI研究實驗室宣布於週四推出三個基礎AI模型,這些模型可以產生文字、語音與圖像。這項發佈顯示微軟持續擴展自家多模態AI模型堆疊的決心,並與競爭對手AI實驗室競爭,儘管微軟仍與OpenAI保持聯繫。MAI-Transcribe-1可將25種不同語言的語音轉換為文字,根據公司發佈的聲明,其速度是微軟Azure Fast提供的2.5倍。MAI-Voice-1是一個語音生成模型,這個語音模型讓用戶可在一秒內生成60秒的語音,並允許用戶建立自訂語音。MAI-Image-2是一個視訊生成模型。MAI-Image-2最初於3月19日透過MAI Playground(一個新的大型語言模型測試軟體)發佈。現在,這三個模型都已在Microsoft Foundry上發佈,並且轉錄與語音模型也同時在MAI Playground上提供。這些模型是由微軟MAI超智能團隊開發的,這個AI研究團隊由微軟AI首席執行長Mustafa Suleyman領導,該團隊於2025年11月成立並宣布。Suleyman在部落格文章中寫道:「在微軟AI,我們正在建立人本主義AI。在創造我們的AI模型時,我們有獨特的觀點——將人類置於中心,優化人們實際溝通的方式,並針對實用場景進行訓練。」「你會在Foundry以及微軟的產品與體驗中看到更多我們的模型。」在越來越競爭的LLM市場中,微軟希望這些模型的賣點在於它們的價格比Google與OpenAI的模型更低,公司部落格文章中寫道。MAI-Transcribe-1的起價為每小時0.36美元。MAI-Voice-1的起價為每100萬個字符22美元,MAI-Image-2的起價為文字輸入100萬個token為5美元,圖像輸出100萬個token為33美元。儘管推出了自家模型,Suleyman在與VentureBeat的採訪中重申微軟對與OpenAI合作承諾。雖然最近對該合作關係的重新協議讓微軟能夠真正進行這項超智能研究,Suleyman告訴The Verge。微軟已投資超過130億美元於該AI研究實驗室,並透過多年的合作關係在其各種產品中托管這些模型。微軟在晶片方面也採用相似的策略;它既生產自家晶片,也從外部廠商購入。


分享這篇文章:

上一篇
OpenAI收購備受關注的創始人帶領的商業談話節目TBPN
下一篇
Google 現在讓你透過提示詞直接操控 Vids 應用的虛擬形象