實體: Gemini
所有提到 Gemini 的 AI 新聞與動態。
-
加州立法者_SB_1047_推動者再推強制AI安全報告措施
加州州議員 Scott Wiener 於週三提出新修正案,針對 SB 53 法案,要求全球最大的人工智慧公司發布安全與防護協議,並在發生安全事件時提交報告。若透過,加州將成為第一個對領先開發者(包括 OpenAI、Google、Anthropic 和 xAI)實施實質透明度的州。此法案受到加州人工智慧政策小組建議的影響,該小組由包括斯坦福研究員 Fei-Fei Li 在內的多位領袖組成,建議建立公開透明的證據環境。SB 53 旨在平衡透明度與產業發展,與先前被州長 Gavin Newsom 廢止的 SB 1047 不同,新法案不讓開發者對模型造成的傷害承擔責任,並設立吹哨人保護機制,定義為造成超過 100 人死亡或 10 億美元損失的情況。此外,法案還計劃建立 CalCompute 公共雲端叢集以支援初創企業和研究人員。目前,SB 53 正送往加州眾議院隱私與消費者保護委員會審議。同時,紐約州州長 Kathy Hochul 也在考慮類似的 RAISE 法案。此前,聯邦參議員曾提出十年人工智慧禁令以限制各州法規的碎片化,但在七月初以 99-1 的投票結果失敗。前 Y Combinator 總裁 Geoff Ralston 表示,在聯邦行動缺位的情況下,加州的 SB 53 是州領導力的良好範例。儘管部分公司如 Anthropic 支援透明度,但 OpenAI、Google 和 Meta 表現出較強抵抗,例如 Google 延遲發布 Gemini 2.5 Pro 的安全報告,OpenAI 也未立即發布 GPT-4.1 的報告。SB 53 作為調整後的版本,仍可能迫使這些公司披露更多資訊。
-
Google將Gemini帶上Wear OS智慧手錶 并為Circle to Search新增AI模式
Google 於週三宣佈將 Gemini 功能正式推出至 Wear OS 智慧手錶,此舉距五月份的首次預告已近兩個月。此次更新涵蓋 Pixel、Samsung、OPPO、OnePlus 及 Xiaomi 等品牌執行 Wear OS 4 以上系統的手錶。使用者可透過說「Hey, Google」、長按側邊按鈕或點選 Gemini 圖示來啟動對話。Gemini 能協助使用者在烹飪時詢問蔬菜烤製時間與溫度,或出門前查詢天氣是否需要雨傘。此外,Gemini 還能跨應用執行任務,如總結郵件內容、將棒球賽程加入日曆,或記住停車位置與購物提醒。 Google 同時強化了 Circle to Search 功能,讓使用者透過圈選、高亮或書寫螢幕內容即可啟動搜尋。該功能現已整合 AI Mode,提供 AI 摘要並允許使用者不切換應用程式進行深入提問。此功能目前於美國與印度開放,並支援 Google Lens 及 Android 與 iOS 裝置,甚至可應用於手機遊戲中識別角色或尋找策略。Google 亦最佳化 AI Overviews 的回應格式,使其更清晰且包含更多視覺元素。最後,Pixel 9 Pro 使用者將免費獲得一年 Google AI Pro 訂閱服務,包含使用 Veo 3 將想法轉化為帶有自然音效的短片。
-
Google 全球推出全新 Veo 3 電影生成模型
Google 於週四宣佈,已開始將 Veo 3 影片生成模型逐步推給 Gemini 使用者,目前涵蓋超過 159 個國家。透過此新模型進行影片生成僅限於 Google AI Pro 付費訂閱使用者,且每日上限為三則影片。Veo 3 模型於五月首次亮相,允許使用者透過文字提示生成長達八秒的影片。Google 的 Josh Woodward 表示,公司正致力於為 Gemini 增加圖片轉影片的功能。
-
Google 的 Veo 3 是否 playable world models 的開端?
Google 執行長 DeepMind 總裁 Demis Hassabis 於二日傍晚表示,其最新影片生成模型 Veo 3 或許可應用於電子遊戲領域。此回應針對 X 平臺上使用者請求「讓我用 Veo 3 影片玩遊戲」的帖子,Hassabis 幽默地回答「那該多有趣啊」。隨後,Google AI Studio 產品負責人 Logan Kilpatrick 以三個閉嘴表情符號回應。儘管 Google 發言人表示目前無新資訊,但構建可玩世界模型並非不可能。世界模型與影片生成模型不同,前者模擬真實環境動態以預測世界演變,後者則合成真實影片序列。Google 計劃將多模態基礎模型 Gemini 2.5 Pro 轉化為模擬人類大腦部分功能的模型。去年十二月,DeepMind 推出了 Genie 2,該模型能生成無限種可玩世界。隨後 Google 成立新團隊開發模擬真實世界的 AI 模型。其他機構如 AI 先驅 Fei-Fei Li 的 World Labs 也從隱蔽狀態中走出,開發能從單張圖片生成遊戲般 3D 場景的系統。Veo 3 目前處於公開預覽階段,可建立影片及配對的音訊,包括語音和樂曲。雖然 Veo 3 透過模擬物理學實現逼真動作,但它仍非世界模型,而是用於遊戲電影敘事、預告片及敘事原型設計的「被動輸出」生成模型。未來模型需轉變為更主動、互動且可預測的模擬器。遊戲生產的真正挑戰在於實時、一致且可控的模擬。因此,Google 未來若涉足遊戲或可玩世界開發,或許會採取結合 Veo 與 Genie 的混合方法。Google 可能面臨與 Microsoft、Scenario、Runway、Pika 以及最終 OpenAI 的影片生成模型 Sora 競爭。考慮到 Google 在世界模型領域的計劃及其雄厚的資金與分發能力,競爭對手應密切關注此領域動態。