實體: Gemini
所有提到 Gemini 的 AI 新聞與動態。
-
YouTube Shorts 即將推出影像轉換為視訊的 AI 工具,新增 AI 特效
YouTube 於週三宣佈,將為 Shorts 創作者提供新的生成式 AI 功能,包括影象轉影片工具及新的 AI 特效。該影象轉影片功能允許使用者將相機滾動中的照片轉換為六秒長的影片,系統會根據上傳的照片提供相關建議,可用於為風景照新增動態、讓日常照片生動或讓群體照片活躍。YouTube 舉例說明,此功能可將靜態的行人訊號圖示轉化為縮放並呈現跳舞效果的短影片。此功能運作方式類似於 Gemini 中現有的功能,也與 Meta Edits 應用中的 Animate 工具相似。新工具將於未來一週在美國、加拿大、澳大利亞和紐西蘭推出,YouTube 計劃在今年晚些時候擴充套件至更多地區。值得注意的是,Google Photos 也獲得了類似的影象轉影片工具。新的 AI 特效允許創作者將塗鴉轉化為藝術影象,並將自拍轉化為水下游泳、與他人雙胞胎等影片。使用者可透過在 Shorts 相機中點選"Effects"圖示並選擇"AI"來瀏覽所有生成式特效。YouTube 指出,今日宣佈的功能由 Google 的影片生成 AI 模型 Veo 2 驅動。YouTube 表示使用 SynthID 水印和清晰標籤來標記這些由 AI 創作的內容。此外,YouTube 還宣佈 AI Playground 是其新的生成式 AI 創作工具、靈感示例、預填提示等內容的家園,創作者可透過點選建立按鈕右上角的閃電圖示進入,該功能目前在美國、加拿大、澳大利亞和紐西蘭對所有人開放。去年在 2025 年戛納獅子獎上,YouTube 執行長 Neal Mohan 宣佈 Google 的 Veo 3 影片生成器(可生成影片和音訊)將於今年晚些時候夏季推出,並透露 Shorts 目前平均每日觀看次數超過 2000 億次。
-
Anthropic 無預告縮減 Claude Code 使用上限
自本週一早晨起,Claude Code 使用者遭遇突發且嚴格的用量限制問題。這些問題主要集中在重度使用者身上,許多使用者訂閱的是每月 200 美元的 Max 計畫。使用者僅收到「Claude 用量限制已達上限」的提示,並被告知通常在數小時內限制將重置,但由於缺乏明確的變更公告,許多使用者推測其訂閱已被降級或用量追蹤不準確。有使用者抱怨追蹤方式改變且不再準確,指出在短短 30 分鐘內僅發出幾條請求卻觸發了 900 條訊息的限制。 當被要求評論時,Anthropic 代表確認了問題但拒絕進一步說明,僅表示已知部分使用者體驗到回應速度變慢,並正在解決中。此變化令使用者感到震驚,因為他們未收到任何預先通知或未來指引。一名不願具名的使用者表示,自限制生效後無法推進專案,並嘗試過 Gemini 和 Kimi 等替代方案,但認為目前無其他產品能與 Claude Code 的能力相比。 這些問題伴隨著 Anthropic 網路的廣泛問題。許多 API 使用者在同一時期報告了超載錯誤,公司狀態頁面顯示過去四天內有六個獨立問題。值得注意的是,網路在該週仍顯示 100% 的執行時間。雖然載入錯誤常見,但 Anthropic 對用量限制的新方法造成了顯著混亂。部分混亂源於其定價系統,該系統設定分級限制卻從未保證固定的訪問水平。最昂貴的 Max 計畫每月 200 美元,承諾的用量限制是 Pro 訂閱的 20 倍;Pro 計畫的用量限制則是免費計畫的五倍。然而,Anthropic 表示免費使用者的限制「將隨需求變化」,並未設定絕對值。這導致使用者無法規劃用量限制,因為他們無法清楚知道服務何時會受到限制。 每月 200 美元的 Max 計畫特別受重度使用者歡迎,部分使用者認為該計畫在長遠來看對 Anthropic 不可持續。一名受訪使用者表示,該計畫通常允許他在單日內進行超過 1000 美元價值(按 API 定價計算)的呼叫。因此,他並不驚訝用量限制會變得更加嚴格,但希望公司能更清晰地溝通變更。他強調,缺乏溝通會讓人失去對公司的信心,呼籲公司保持透明。
-
Mistral 的 Le Chat 聊天機器人推出新「深度研究」模式提升生產力
法國人工智慧實驗室 Mistral 於週四為其聊天機器人 Le Chat 推出了一系列新功能,使其能力更接近 OpenAI 和 Google 等競爭對手。此次更新包含全新的「深度研究」模式、原生多語言推理能力以及進階的圖片編輯功能。這是在 Mistral 數天前發布其首款開源 AI 語音模型 Voxtral 之後發生的,該模型支援多語言推理、轉錄等功能,且也可透過 Le Chat 使用。Mistral 表示,其新的深度研究模式能將 Le Chat 轉變為協同研究助理,可規劃需求、澄清疑問、搜尋並綜合資料。產品負責人 Elisa Salamanca 指出,該功能對消費者和企業使用者都極具相關性,消費者可用於規劃旅行並獲得詳盡分析,企業則可用於深入研究。 這些更新適用於所有層級,包括免費、專業、團隊和企業版。Mistral 強調此次發布重點在於將 Le Chat 與其生產力套件整合進企業生態系統,這主要取決於 Mistral 處理資料聯結器的不同方式。許多擁有敏感資料的客戶(如銀行、國防和政府部門)不使用雲端服務,或僅在虛擬私人雲上執行。為此,Mistral 的 Le Chat 和生產力套件可連線企業本地資料,讓公司無需上傳資料至雲端即可分析內部資料,這與 Azure 託管的 OpenAI 和基於 Google Cloud 的 Gemini 等雲端原生大型語言模型平臺形成顯著差異。此外,Mistral 還計劃推出更多生產力工具,使其與 Microsoft Excel 和 Google Docs 等辦公套件無縫協作。 除了深度研究,Le Chat 還獲得了其他更新。此前僅支援英文的複雜問題推理能力,現在已原生支援法語、西班牙語、日語等多種語言,並支援句子中切換語言。此次更新還新增了專案功能,幫助使用者將聊天、文件和想法分組到專注的空間中,每個專案可擁有獨立的預設庫並記住使用者啟用的工具和設定,適用於規劃搬家、設計新功能或追蹤工作專案。最後,Le Chat 獲得了改進的圖片編輯能力,允許使用者使用提示詞建立和編輯圖片,例如「移除物件」或「將我置於另一座城市」。這些新功能將 Mistral 置於更具競爭力的位置,使其不僅僅是模型演示,更成為全棧競爭對手。
-
谷歌推出AI驅動的商務電話功能,並推出Gemini 2.5 Pro至AI模式
Google 於週三宣佈將向美國所有使用者推出由代理式 AI 驅動的業務通話功能,並同時強化 Google 搜尋的 AI 模式。該新通話功能利用 AI 代表使用者撥打當地企業電話,收集關於服務可用性及價格的資訊,旨在讓使用者無需親自接聽電話即可獲取所需資訊。此功能最初於一月份在搜尋實驗室實驗中對自願參與的使用者進行測試。使用者在搜尋「附近的寵物美容師」等關鍵字時,可在結果中選擇「讓 AI 檢查價格」選項,並回答關於寵物種類、所需服務及時間等問題,從而獲得不同當地企業的預約與服務資訊。Google 發言人表示,每次通話開始時都會宣佈這是代表使用者從 Google 發出的自動化系統。針對數年前因類似模擬人類聲音的通話功能引發的誤導使用者爭議,Google 已承諾其 AI 在通話中會明確識別自己為機器人。目前該功能正逐步向美國所有搜尋使用者推出,Google AI Pro 及 AI Ultra 訂閱者享有更高的使用限制。 此外,Google 正將 Gemini 2.5 Pro 模型引入搜尋體驗,並增強 AI 模式以處理複雜的多部分問題。該模型在先進推理、數學及程式設計問題方面表現優異,訂閱者可在 AI 模式的下拉選單中選擇此模型。新的「深度搜尋」功能將為訂閱者節省數小時時間,透過進行數百次搜尋並整合不同資訊來源進行推理,在數分鐘內生成全面且附有完整引用的報告。此功能適用於深入研究工作、興趣或學習,亦可在購買房屋或進行財務分析等重大人生決策時提供協助。自今年初推出 AI 模式以來,Google 持續增加其功能以應對 Perplexity AI 及 OpenAI 的 ChatGPT Search 等熱門服務。例如,Google 上月推出了與 AI 模式進行來回語音對話的功能,並在五月引入了讓使用者在 AI 模式中檢視產品視覺效果及利用產品資料提供 AI 指導的購物體驗。