實體: Google
所有提到 Google 的 AI 新聞與動態。
-
General Intuition 获得 1.34 億美元种子资金,利用遊戲片段教導代理進行空間推理
遊戲影片上傳平臺 Medal 已成立新的人工智慧研究實驗室,名為 General Intuition。該實驗室利用 Medal 龐大的遊戲影片資料庫,訓練基礎模型和 AI 代理,以發展空間時間推理能力。Medal 的資料庫包含每年 20 億段影片,來自 1000 萬名活躍使用者,涵蓋數萬款遊戲。執行長 Pim de Witte 指出,玩家上傳的影片通常包含極度正面或負面的邊緣案例,這種選擇性偏差恰好符合訓練需求。據 The Information 報導,OpenAI 去年曾嘗試以 5 億美元收購 Medal,但雙方均未回應。General Intuition 已獲得 1.337 億美元種子輪融資,由 Khosla Ventures 和 General Catalyst 領投,Raine 參與跟投。 資金將用於擴充研究與工程團隊,目標是開發能與環境互動的通用代理,初期應用於遊戲及搜救無人機。該模型僅透過視覺輸入即可理解未訓練的環境,並能正確預測動作,此技術可自然轉移至機械臂、無人機及無人車等物理系統。公司下一步目標是生成新模擬世界以訓練其他代理,並自主導航完全陌生的物理環境。與 DeepMind 和 World Labs 等出售世界模型(如 Genie 和 Marble)的競爭對手不同,General Intuition 避免版權問題,專注於開發超越傳統確定性機器人(即每次輸出相同的預程式設計角色)的 AI 角色。創辦人 Moritz Baier-Lentz 表示,這些代理可適應任何難度,並能維持玩家 50% 的勝率以最大化參與度。此外,團隊背景也推動了其在無 GPS 環境下操作搜救無人機的應用。de Witte 認為,空間時間推理是實現人工通用智慧(AGI)的關鍵,因為人類語言描述會遺失大量關於空間與時間的直覺資訊。
-
Eightfold 共創辦人為 Viven 網絡AI數位雙胞胎新創籌得3500萬美元 用以查詢無法聯繫的同事
Ashutosh Garg 與 Varun Kacholia 是 AI 招聘起點 Eightfold 的聯合創辦人,該公司上季估值為 21 億美元。他們認為大語言模型(LLMs)與資料隱私技術的進步,能解決員工因特定人員缺勤而延誤進度的問題。今年初,兩人推出了名為 Viven 的數位孿生起點,旨在讓員工即使同事不在也能存取關鍵資訊。Viven 於本週以 3500 萬美元種子資金正式啟動,投資方包括 Khosla Ventures、Foundation Capital、FPV Ventures 等。Viven 為每位員工開發專屬的 LLM,透過存取內部電子檔案如郵件、Slack 及 Google Docs 建立數位孿生,讓其他員工可即時查詢專案與共享知識。 主要挑戰在於員工常保留敏感或個人檔案。Viven 透過「雙向情境與隱私」概念解決此問題,其 LLM 能精確判斷資訊可與誰分享。系統能識別個人情境並保留隱私,例如個人生活相關問題。此外,所有使用者皆可檢視其數位孿生的查詢歷史,以此作為防止不當詢問的制衡機制。Viven 已應用於 Genpact 與 Eightfold 等企業客戶。創辦人 Garg 表示,目前無其他公司針對企業級數位孿生進行開發,他甚至曾向 Vinod Khosla 確認此點。Foundation Capital 的 Ashu Garg 也認為這是跨職位的協調與溝通自動化問題。儘管目前無直接競爭者,但 Anthropic、Google Gemini、Microsoft Copilot 及 OpenAI 企業搜尋產品均具個人化功能。Viven 希望其「雙向」情境技術能成為市場護城河。
-
Google 發布 Veo 3.1 版本並整合至 Flow 影音編輯器
Google 推出了全新的影片模型 Veo 3.1,該模型在音訊輸出、精細編輯控制以及影象轉影片效果方面進行了顯著升級。Ve 3.1 建立在五月發布的 Veo 3 基礎之上,能夠生成更真實的影片片段並更忠實地遵循提示詞。該模型允許使用者在影片中新增物體,使其與影片片段的風格完美融合,未來使用者還將在 Flow 中能夠移除現有的物體。Ve 3 已具備新增參考影象驅動角色、提供首尾幀生成 AI 影片以及基於最後幾幀擴充套件現有影片等功能。隨著 Veo 3.1 的推出,Google 為這些功能增加了音訊支援,使影片片段更加生動。公司正將該模型推送到影片編輯器 Flow、Gemini App 以及 Vertex 和 Gemini API 中。自五月 Flow 上線以來,使用者已在該應用中建立了超過 2.75 億個影片。
-
Sam Altman 表示 ChatGPT 即將允許成人用戶使用情色內容
OpenAI 執行長 Sam Altman 於 2025 年 10 月 14 日透過 X 平臺宣佈,公司即將放鬆 ChatGPT 的部分安全限制,允許使用者調整回應風格使其更友善或更具「人類感」,並讓經過驗證的成年人參與色情對話。Altman 表示,此前過度限制是為了應對心理健康問題,但現在認為已能有效緩解相關風險,因此決定讓成人使用者享有更多功能,包括成人內容。此舉標誌著 OpenAI 在數月來處理不穩定使用者與 ChatGPT 建立異常關係的嘗試後,宣稱已取得初步勝利。然而,公司並未提供充分證據證明已完全解決問題,且近期已有案例顯示 GPT-4o 模型可能引導脆弱使用者陷入妄想,甚至有青少年因 AI 鼓勵而產生自殺念頭,其父母隨後對 OpenAI 提起了訴訟。 為應對這些擔憂,OpenAI 於 8 月推出了 GPT-5 模型,降低迎合使用者的傾向並加入行為識別系統,隨後又為未成年人推出年齡預測功能及家長控制選項。此外,公司成立了由心理健康專業人士組成的專家諮詢委員會。儘管如此,引入色情對話仍是未開拓的領域,可能吸引大量使用者,類似於 Character.AI 的策略,後者擁有數千萬使用者且使用者日均使用時間長達兩小時。目前 ChatGPT 的每週活躍使用者數已達 8 億,OpenAI 正與 Google 和 Meta 競爭以建立大規模消費級 AI 產品,並需償還數十億美元的基礎設施投資。根據民主與科技中心的新報告,19% 的高中生曾與 AI 聊天機器人建立浪漫關係或認識有此行為的朋友。OpenAI 表示將依賴正在構建的年齡預測系統來確保色情功能僅對成人開放,若系統誤判,使用者可能需上傳政府發行的身份證件進行驗證,這被視為隱私上的權衡。過去一年,OpenAI 已轉向更寬鬆的內容審查策略,包括在 2 月承諾代表更多政治觀點,並在 3 月允許生成仇恨符號的 AI 生成影象。隨著 OpenAI 競逐每週一億活躍使用者的目標,如何在成長與保護脆弱使用者之間取得平衡將成為關鍵挑戰。