實體: Google
所有提到 Google 的 AI 新聞與動態。
-
AI影片創業公司Runway以53億美元估值籌得3億1500萬美元資金,目光聚焦於更強大的世界模型
美國 AI 影片生成新創公司 Runway 近日完成 E 輪融資,籌得 3.15 億美元,估值幾乎翻倍至 53 億美元。根據公司部落格公告,新資金將用於預訓練下一代世界模型(World Models),並將其應用於醫療、氣候、能源及機器人等領域。世界模型是一種能構建環境內部表示以規劃未來事件的 AI 系統,被認為是突破大型語言模型限制的關鍵。Runway 最知名於其物理感知 AI 影片生成模型,並於去年十二月推出首個世界模型。儘管該公司傳統上在媒體、娛樂及廣告領域擁有強大客戶基礎,包括近期與 Adobe 的合夥關係,但發言人表示,Runway 正逐漸在遊戲與機器人領域看到採用趨勢。 此次融資背景是競爭日益激烈,對手包括費飛飛(Fei-Fei Li)領導的世界實驗室(World Labs)以及 Google DeepMind,後者近期已公開其模型。資金到位前,Runway 推出了最新影片生成模型 Gen 4.5,該模型支援從文字提示生成高畫質影片,並引入原生音訊、長格式、多鏡頭生成、角色一致性及進階編輯工具。Gen 4.5 在多個指標上優於 Google 與 OpenAI 的影片生成方案,為 Runway 在 AI 產業贏得顯著信譽。此外,Runway 近期與 CoreWeave 簽訂協議擴充運算能力,有助於增強投資者信心。 未來,Runway 計劃利用新資金快速擴張約 140 人的團隊,涵蓋研究、工程及市場推廣部門。本輪融資由 General Atlantic 主導,參與機構包括 Nvidia、Fidelity Management & Research、AllianceBernstein、Adobe Ventures、Mirae Asset、Emphatic Capital、Felicis、Premji Invest 及 AMD Ventures。
-
前Google員工正在建立基礎設施協助企業理解其視頻數據
企業正產生前所未有的大量影片,從廣播檔案到商店攝影機,這些未使用的「黑暗資料」蘊藏巨大價值。前 Google 員工 Aza Kai 與 Hiraku Yanagita 於 2024 年共同創立東京起家的 InfiniMind,旨在將未檢視的影片與音訊轉化為結構化商業資料。該公司近期獲得 580 萬美元種子資金,由 UTEC 領投,並加入 CX2、Headline Asia 等機構。InfiniMind 的首款產品 TV Pulse 於 2025 年 4 月在日本推出,協助媒體與零售業者追蹤產品曝光與品牌影響力。其旗艦產品 DeepFrame 是一項長形影片智慧平臺,能處理 200 小時影片以定位特定場景或事件,預計於 2026 年 3 月進行測試版發布,4 月正式上線。該公司正將總部遷往美國,同時保留日本辦公室。InfiniMind 利用 2021 至 2023 年間視覺語言模型的進步,結合 GPU 成本下降與每年約 15% 至 20% 的效能提升,解決了現有技術無法追蹤敘事或理解因果關係的痛點。其解決方案無需程式碼,整合音訊與語音理解,並能處理不限長度的影片,以成本效益作為主要差異化優勢。此種子資金將用於深化 DeepFrame 模型開發、擴充工程基礎設施及招募更多工程師,以服務日本與美國市場。
-
亞馬遜與谷歌領先AI資本支出競賽 但勝利的獎勵是什麼?
科技業似乎正陷入一場競賽,爭相投入最多資金建設資料中心,認為擁有最多運算能力的公司就能製造最佳 AI 產品並確保未來勝利。然而,這種思維方式存在侷限,傳統上企業成功在於賺更多錢且花更少錢,但大型科技公司卻被此邏輯說服。Amazon 在週四的財報中宣佈,預計 2026 年資本支出將達 2000 億美元,涵蓋 AI、晶片、機器人及近地軌道衛星,較 2025 年的 1318 億美元顯著增加。Google 在週三財報中預測 2026 年資本支出為 1750 億至 1850 億美元,較上年的 914 億美元大幅增長。Meta 預測 2026 年支出為 1150 億至 1350 億美元,Oracle 則僅為 500 億美元。Microsoft 雖無官方 2026 年預測,但最新季度資料顯示約 375 億美元,若維持此速度,全年約為 1500 億美元,使其排名第三。 業界邏輯認為,AI 的革命性潛力將使高階運算成為未來稀缺資源,唯有控制自身供應的公司才能倖存。然而,投資者並不買單。各公司股價均隨投資者對數百億美元承諾的猶豫而下跌,支出較高的公司跌幅更大。這不僅影響尚未釐清 AI 產品策略的 Meta,連 Microsoft 和 Amazon 等擁有強大雲端業務的公司也面臨壓力,因為數字對投資者而言過高。儘管投資者情緒可能無法改變產業心態,若相信 AI 將改變一切,則不應因 Wall Street 的反應而改變方向。未來,大型科技公司將面臨巨大壓力,必須淡化其 AI 野心的實際成本。
-
ElevenLabs CEO:聲音是AI的下一階介面
ElevenLabs 共同創辦人兼執行長 Mati Staniszewski 在杜哈舉行的 Web Summit 上表示,語音正成為人工智慧下一個主要的介面,人們將透過語音與機器互動,而非僅限於文字與螢幕。他指出,ElevenLabs 開發的語音模型已超越單純模仿人類聲音,開始結合大型語言模型的推理能力,改變人與科技的互動方式。他預言未來手機將重新放回口袋,人們可沉浸於現實世界,以語音控制技術。此願景推動 ElevenLabs 本週以十一億美元估值籌資五億美元,且該觀點在 AI 產業日益普及。OpenAI 與 Google 均將語音列為下一代模型核心,Apple 則透過收購 Q.ai 等公司低調建構語音相關技術。隨著 AI 滲透穿戴裝置與汽車等新硬體,控制方式從觸控螢幕轉向語音,語音成為 AI 發展下一階段的重要戰場。 Iconiq Capital 合夥人 Seth Pierrepont 也支援此觀點,認為雖然螢幕對遊戲與娛樂仍具重要性,但鍵盤等傳統輸入方式已顯陳舊。隨著 AI 系統變得更具代理性,互動方式將改變,模型將獲得防護機制、整合功能與情境資料,減少使用者明確提示的需求。Staniszewski 指出,未來語音系統將依賴長期累積的持續記憶與情境,使互動更自然且減少使用者負擔。ElevenLabs 正推動混合架構,結合雲端與裝置端處理,以支援耳機等穿戴裝置,讓語音成為常伴隨的夥伴而非需主動啟用的功能。ElevenLabs 已與 Meta 合作將技術應用於 Instagram 及 Horizon Worlds 虛擬實境平臺,並表示願意合作開發 Ray-Ban 智慧眼鏡等新型態語音介面。然而,語音技術日益嵌入日常硬體也引發隱私、監控及個人資料儲存等嚴重擔憂,Google 等公司已因濫用資料而受指責。