實體: Google
所有提到 Google 的 AI 新聞與動態。
-
音樂生成器 ProducerAI 加入 Google Labs
Google 宣佈其生成式 AI 音樂工具 ProducerAI 將成為 Google Labs 的一部分,該平臺由 The Chainsmokers 支援,允許使用者透過自然語言指令(例如「製作一首 Lo-fi 節奏」)生成音樂。ProducerAI 採用 Google DeepMind 的 Lyria 3 音樂生成模型,該模型能將文字甚至圖片輸入轉換為音訊輸出。Google 上週已宣佈將 Lyria 3 功能引入旗艦 Gemini 應用程式,而 ProducerAI 則讓使用者能像與「合作夥伴」互動般與 AI 模型溝通。Google Labs 資深產品管理員 Elias Roman 表示,他利用該工具嘗試了新的流派融合,為親友創作個人化生日歌曲,並為自己和朋友製作專屬健身音樂。此外,三度格萊美獎獲獎rapper Wyclef Jean 在其新歌《Back From Abu Dhabi》中使用了 Lyria 3 模型及 Google 的音樂 AI 沙盒。DeepMind 產品管理員 Jeff Chang 強調,這不僅是點選按鈕的機器,而是需要細心策展的過程。Jean 指出,在 AI 時代人類必須是最具創造力的,人類擁有靈魂,而 AI 擁有無限資訊。 音樂產業對 AI 工具的使用存在爭議。許多音樂人反對因生成式 AI 可能未經授權使用版權資料進行訓練。2024 年,包括 Billie Eilish、Katy Perry 和 Jon Bon Jovi 在內數百名音樂人簽署公開信,呼籲科技公司不要以 AI 音樂生成工具破壞人類創造力。音樂出版商群體近期也對 AI 公司 Anthropic 提起 30 億美元訴訟,指控其非法下載超過 20,000 首版權歌曲,包括樂譜、歌詞和音樂作品。Anthropic 此前已被法院命令向因 AI 訓練而遭盜版的作者提供 15 億美元和解金。另一方面,部分藝術家擁抱此技術以提升音質。Paul McCartney 使用 AI 降噪系統清理了數十年前的低質量 John Lennon 演示帶,由此產生的新披頭士歌曲《Now and Then》於 2025 年獲格萊美獎。此外,AI 音樂生成工具如 Suno 已創造出足以登上 Spotify 和 Billboard 排行榜的合成音樂。31 歲的 Mississippi 居民 Telisha Jones 使用 Suno 將詩歌轉化為病毒
-
Google 雲端 AI 首席談模型能力的三大領域
Google Cloud 產品副總裁 Michael Gerstenhaber 主要負責 Vertex AI,這是公司統一的企業級 AI 部署平臺。他在訪談中提出,AI 模型正同時面臨三大前沿挑戰:原始智慧、回應速度以及與成本密切相關的第三個維度,即模型能否以低廉成本在巨大且不可預測的規模下執行。他強調,這是一種重新定義模型能力的新思維方式。Gerstenhaber 在 AI 領域工作約兩年,此前曾在 Anthropic 工作一年半,現於 Google 工作近半年。他負責的 Vertex AI 平臺主要服務工程師,提供代理模式、代理平臺以及全球最強大模型的推理能力,而具體應用則由 Shopify、Thomson Reuters 等客戶自行開發。他認為 Google 的獨特優勢在於垂直整合,從介面到基礎設施層(包括資料中心、電力、晶片、模型、推理層、代理層、API 及合規治理)均自掌控,這使其成為推動前沿模型的理想場所。 Gerstenhaber 指出,目前三大科技巨頭的能力差距不大,但競爭不僅僅是追求更高智慧,還涉及複雜的平衡。第一 frontier 是原始智慧,例如編寫程式碼時追求最佳結果,即使耗時 45 分鐘亦可接受;第二 frontier 是延遲,在客戶服務場景中,若回答過於遲緩導致客戶結束通話,再高的智慧也無意義,需在延遲預算內提供最智慧的產品;第三 frontier 是成本與規模,如 Reddit 或 Meta 需要處理海量內容審核,必須在預算限制下以可擴充套件的方式執行高智慧模型。他解釋代理系統普及緩慢的原因在於基礎設施缺失,缺乏審計代理行為和資料授權的模式,且生產環境總是滯後於技術能力。相比之下,Google 因具備軟體開發生命週期中的安全開發環境、雙重審計機制及人工介入流程,能極低風險地將技術落地,但也需其他領域複製這些模式。
-
印度AI影響高峰會所有重要新聞
印度近期舉辦四天 AI 影響高峰會,旨在吸引更多 AI 投資,吸引了 OpenAI、Anthropic、Nvidia、Microsoft、Google 及 Cloudflare 等大公司高管與各國領導人出席,預期有二十五萬名訪客。印度總理莫迪與法國總統馬克龍共同發表演說。會議期間披露多項關鍵動態:印度撥款十一億美元設立國營風險投資基金,用於投資 AI 與先進製造業新創;OpenAI 執行長薩姆·奧爾曼指出印度擁有超過一億名每週活躍的 ChatGPT 使用者,僅次於美國,且印度學生使用率最高。黑石集團以六億美元股權融資收購印度 AI 新創 Neysa 多數股權,該公司計劃再籌資六億美元債務並部署超過兩萬張 GPU。班加羅爾的 C2i 公司從 Peak XV 籌得一千五百萬美元 A 輪融資。AMD 與塔塔諮詢服務(TCS)合作開發基於 AMD Helios 平臺的 AI 基礎設施。Anthropic 在班加羅爾設立首家印度辦公室,並與 Infosys 合作部署 Claude 模型,首階段將聚焦電信業。印度 AI 公司 Sarvam 推出名為 Sarvam Kaze 的智慧眼鏡,並發布了包括文字轉語音、視覺識別等多個模型。Adani 集團承諾到二零三五年在印度投資一百億美元建設使用可再生能源的 AI 資料中心,並帶動一百五十億美元相關投資。Cartesia 與 Blue Machines 合作部署具本地資料駐留的語音解決方案。Cohere Labs 發布支援超過七十種語言的多語言開放權重模型。OpenAI 將在班加羅爾和孟買開設兩間新辦公室,並與塔塔集團合作部署一百兆瓦算力,目標擴充至一吉瓦。印度科技部長瓦伊斯納夫表示希望未來兩年吸引超過兩千億美元的 AI 基礎設施投資。Emergent 新創達到一億美元年度營收並推出手機應用程式。Sarvam 發布 Sarvam 30B 與 Sarvam 105B 兩個開源模型,並與 Qualcomm、HMD 及 Bosch 合作將 AI 應用於手機、汽車等裝置。Gnani 推出支援十二種語言的 Vachana 零樣本語音克隆模型。政府支援的 BharatGen consortium 發布了參
-
Google 高層預警兩類 AI 新創企業可能無法存活
生成式人工智慧的爆發催生了大量新創公司,但隨著熱潮退去,大型語言模型(LLM)包裝層和 AI 聚合商這兩種商業模式正變得像警示故事。Google 全球新創組織負責人 Darren Mowry 指出,擁有這些模式的企業應警惕風險。LLM 包裝層公司僅將現有模型如 Claude、GPT 或 Gemini 與產品或使用者體驗層結合,若缺乏深度智慧財產權或垂直市場差異化,難以獲得行業耐心。成功的案例如 Cursor 和 Harvey AI,它們在特定領域建立了深厚的護城河。相比之下,AI 聚合商將多個 LLM 整合至單一介面,雖然曾像 Perplexity 或 OpenRouter 般獲得關注,但 Mowry 建議新創者避開此領域。因為使用者更傾向於擁有內建智慧財產權的解決方案,而非僅依賴後臺運算或訪問限制。這種情況類似於 2000 年代末至 2010 年代初,當 Amazon 雲端業務崛起時,許多轉售 AWS 基礎設施的新創被擠出市場,唯有提供真實服務如安全或 DevOps 諮詢的企業得以倖存。Mowry 對氛圍編碼和開發平臺持樂觀態度,認為 Replit、Lovable 和 Cursor 等公司在 2025 年錄得破紀錄投資與客戶 traction。此外,直接面向消費者的技術、利用 Google Veo 的影視學生應用、生物技術以及氣候技術領域也具備巨大潛力,這些領域能利用前所未有的資料創造真實價值。