實體: Gemini
所有提到 Gemini 的 AI 新聞與動態。
-
賣咖啡豆給星巴克」——人工智慧風潮如何讓人工智慧最大公司掉隊
基礎模型的重要性正在發生顯著變化。近期與 AI 創業公司的對話顯示,這些公司越來越習慣將基礎模型視為可替換的標準品,專注於針對特定任務的自訂與介面開發,而非繼續投入數十億美元進行預訓練。這種趨勢在上週的 BoxWorks 會議上尤為明顯,該會議幾乎完全聚焦於建立在 AI 模型之上的使用者端軟體。由於預訓練的規模效益已趨於飽和,產業關注點已轉向後訓練與強化學習。 過去,OpenAI、Anthropic 和 Google 等基礎模型公司的成功被視為不可撼動,人們認為它們將掌握 AI 的未來。然而,隨著第三方成功服務的興起,這些公司不再能憑藉基礎模型獲得持久優勢。創業公司可以無視模型背後是 GPT-5、Claude 還是 Gemini,並能自由切換。投資組合管理師 Martin Casado 指出,AI 技術堆疊中似乎不存在本質上的護城河,OpenAI 在編碼、影象和影片生成領域的領先地位已被競爭對手超越。 這意味著基礎模型公司可能淪為低利潤率的後端供應商,類似於向星巴克供應咖啡豆。雖然這些公司仍擁有品牌知名度、基礎設施和龐大現金儲備等優勢,但依賴不斷擴大基礎模型規模的策略吸引力下降,Meta 數十億美元的投入看起來風險日增。AI 的競爭格局正從追求全能通用人工智慧轉向分散的業務領域,如軟體開發、企業資料管理和影象生成。在應用層面失去競爭力的情況下,基礎模型公司可能面臨價格壓力,其價值取決於能否在應用層面建立新的突破。
-
YouTube 逐步向所有創作者推出多語言音訊功能以支援影片配音
YouTube 於週三宣佈,經過兩年的測試,其多語言音訊功能正式上線。此功能允許數百萬 YouTuber 為影片新增不同語言的配音,以觸及更廣泛的全球受眾。該功能最初於 2023 年作為測試版推出,僅限於包括 MrBeast、Mark Rober 和主廚 Jamie Oliver 在內的少數創作者使用。在此之前,創作者必須依賴第三方配音服務,而 YouTube 隨後推出了利用 Google Gemini 技術的 AI 驅動自動配音工具,該工具能複製創作者的語調與情感。自上線以來,YouTube 報告稱測試者取得了成功,平均上傳多語言音訊軌道的創作者,其觀看時間中有超過 25% 來自非主要語言的觀眾。例如,Jamie Oliver 的頻道在使用多語言音訊後,觀看次數增加了三倍。此外,公司還正在對一組創作者測試多語言縮圖功能。自六月以來,創作者即可自訂縮圖以顯示其他語言的文字,以迎合國際受眾,這些本地化縮圖包含與觀眾偏好語言相匹配的文字。
-
Google 的 AI 模式新增五種語言包含印地語、日語與韓語
Google 正在擴大其 AI Mode 功能,將支援語言從僅限英文擴充套件至五種新語言,包括印地語、印尼語、日語、韓語和巴西葡萄牙語。此更新於本週一公佈,此前該功能已限制於英文超過六個月。此舉是繼上月將英文版 AI 體驗擴充套件至 180 個新市場後的進一步發展,最初該功能於美國推出,隨後擴充套件至英國和印度。Google 產品管理副總裁 Hema Budaraju 表示,此次擴充套件讓更多人能用母語提出複雜問題並深入探索網路。AI Mode 最初於三月作為實驗性功能推出,僅供 Google One AI Premium 訂閱者使用,旨在應對 Perplexity 和 OpenAI 的 ChatGPT Search 等競爭平臺。該功能採用自訂版的 Gemini 2.5 模型,具備多模態與推理能力。八月時,Google 在 AI Mode 中引入了代理功能,可協助預訂餐廳座位,未來還將支援當地服務預約及活動門票預訂。目前這些代理功能僅限美國 Google AI Ultra 訂閱者使用,透過 Labs 中的實驗功能存取,月費為 249.99 美元。目前,AI Mode 透過搜尋結果頁面的專屬標籤及搜尋列按鈕存取,Google 正致力於使其成為預設搜尋體驗。儘管 Google 近期的 AI 更新包括 AI Mode 和 AI Overviews 受到批評,認為影響了搜尋點選率,但 Google 上月已否認其 AI 搜尋功能會殺死網站流量。
-
Google Gemini 被評為對兒童和青少年具高風險的新安全評估
美國非營利組織 Common Sense Media 於週五發布了對 Google Gemini AI 產品的風險評估報告。該組織指出,雖然 Gemini 明確告知兒童其為電腦而非朋友,這有助於減少導致偏執等心理問題的風險,但在多個方面仍有改進空間。報告發現,Gemini 的「13 歲以下」和「青少年體驗」層級在底層技術上與成人版本幾乎相同,僅新增了部分安全功能。Common Sense Media 強調,兒童安全應從產品設計之初就納入考量,而非事後修改。分析顯示,Gemini 仍可能向兒童分享不適當或危險的內容,包括性、毒品、酒精資訊以及不安全的心理健康建議,後者尤其令家長擔憂,因為近期已有青少年因諮詢 AI 而自殺的案例。OpenAI 也面臨首起 wrongful death 訴訟,一名 16 歲男孩在與 ChatGPT 對話後自殺。此外,Apple 正考慮將 Gemini 用於下一代 Siri,這可能進一步增加青少年接觸風險。Common Sense Media 批評 Gemini 忽略了不同年齡層兒童的需求差異,將兩款產品均評為「高風險」。Gemini 專案主管 Robbie Torney 表示,AI 平臺應根據兒童發展階段提供量身打造的指導,而非採用一刀切的方法。Google 對評估表示反對,稱其已針對 18 歲以下使用者實施特定政策並進行紅隊測試,但也承認部分回應未達預期,已加強防護。Common Sense Media 此前評估過 OpenAI、Perplexity、Claude 等服務,其中 Meta AI 和 Character.AI 被評為不可接受風險,Perplexity 為高風險,ChatGPT 為中等風險,而 Claude 則為極低風險。