實體: Gemini
所有提到 Gemini 的 AI 新聞與動態。
-
Google 的 Gemini 應用已突破 7.5 億月活躍用戶
根據 Google 2025 年第四季財報,其 AI 聊天機器人 Gemini 的月活躍使用者數(MAUs)已突破 7.5 億,顯示消費者對該產品的快速採用。上季 Gemini 的 MAU 為 6.5 億,而同期 ChatGPT 估計約有 8.1 億 MAU,Meta AI 則達到 10 億。Gemini 的增長得益於最新推出的 Gemini 3 模型,該模型展現前所未有的深度與細膩度。Google 執行長 Sundar Pichai 表示,Gemini 3 在 AI 模式下的推出是推動公司成長的積極因素,並強調持續投資與迭代將維持動能。此外,Google 近期推出了價格為每月 7.99 美元的 Google AI Plus 平價方案,旨在吸引預算敏感型消費者。儘管該方案推出時間較晚,尚未影響本季度資料,但 Google 首席商務官 Philipp Schindler 指出,公司專注於免費版與訂閱服務,並看到顯著成長。在整體財務表現方面,Alphabet 本季營收首次突破 4000 億美元,主要歸功於 AI 部門的擴張與需求增加。Google 近期還推出了名為 Ironwood 的最新一代 TPU AI 加速晶片,以與 Nvidia 競爭。Pichai 在釋出會中表示,Gemini 首個模型現在透過客戶直接 API 使用,每分鐘可處理超過 100 億個 token,且 Gemini App 的月活躍使用者已超過 7.5 億,搜尋服務的使用量也創下新高。
-
OpenAI 發佈全新 macOS 應用程式用於自主程式設計
人工智慧已對軟體開發產生震盪性影響,許多程式碼工作現由多個代理與子代理群組完成。然而,隨著開發者嘗試新的人機協作介面與形態,即便是最先進的實驗室也難以跟進。當前趨勢為代理軟體開發,即 AI 代理能獨立執行編碼任務,此趨勢由 Claude Code 與 Cowork 應用程式體現。同時,OpenAI 正逐步完善其 Codex 工具,該工具於四月以命令列工具形式推出,一個月後擴充套件至網頁介面。如今,OpenAI 邁出重大一步,於週一推出針對 macOS 的 Codex 新應用程式,整合過去一年流行的代理實踐。新應用程式設計支援多個代理並行運作,整合代理技能與最新工作流。此次發布發生在 GPT-5.2-Codex 推出不到兩個月後,後者是 OpenAI 最強大的編碼模型,公司希望其能吸引來自 Claude Code 的使用者。OpenAI 執行長 Sam Altman 表示,若需對複雜事物進行高階工作,5.2 是最強的模型,但使用較困難,因此將其能力置於更靈活的介面中將至關重要。儘管 Altman 對 GPT-5.2 的信心合理,但編碼基準測試顯示故事較為複雜。GPT-5.2 在 TerminalBench 測試中暫居榜首,但 Gemini 3 與 Claude Opus 的代理得分相當,僅略低且在誤差範圍內。另一項測試 SWE-bench 的結果也顯示 GPT-5.2 無明顯優勢。然而,代理使用案例難以有效基準測試,且頂尖模型在使用者體驗上差異顯著。Codex 應用程式還包含一系列新功能,OpenAI 稱其將有助於實現與各款 Claude 應用程式並駕齊驅甚至超越。Codex 應用程式允許設定自動化任務在背景中按自動時間表執行,結果放入佇列供使用者返回時審查。使用者還可根據工作風格選擇不同性格的代理,從務實到富有同理心。對公司而言,最大賣點是 AI 所帶來的開發速度。Altman 表示,從空白紙張開始,幾小時內即可構建相當複雜的軟體,速度僅限於他輸入新想法的速度。
-
聯盟要求聯邦禁用Grok因涉及非同意性內容
一組非營利組織聯盟敦促美國政府立即暫停部署由埃隆·馬斯克 xAI 開發的聊天機器人 Grok,該機器人已在聯邦機構包括國防部內使用。這封公開信指出,Grok 在過去一年中展現出令人擔憂的行為,最近期趨勢是應使用者要求將真實女性甚至兒童的照片轉化為未經同意的性化影象。據報導,Grok 每小時生成數千張非同意的露骨影象,並在馬斯克旗下的社交平臺 X 上大規模傳播。公共公民、數位政策中心及消費者聯盟等組織簽署的信函表示,聯邦政府繼續部署導致生成非同意的性影像及兒童性虐待材料的 AI 產品深為擔憂。 xAI 與政府採購局 GSA 於去年九月達成協議,向聯邦機構銷售 Grok。兩月前,xAI 與國防部簽訂價值高達 2 億美元的合約。然而,在 1 月中旬的醜聞中,國防部長皮特·海格塞斯表示 Grok 將加入 Google 的 Gemini 在五角大樓網路內運作,處理機密與非機密檔案,專家認為這構成國家安全風險。作者認為 Grok 已證明不符合政府對 AI 系統的標準,根據管理預算局的指導,若系統存在嚴重且可預見的風險且無法有效緩解,必須停止使用。公共公民的 JB Branch 指出,Grok 一直顯示為不安全的語言模型,並有反猶太主義、性別歧視及兒童性化影象等歷史問題。 多個政府已對 Grok 表現出不願合作態度,印尼、馬來西亞和菲律賓曾封鎖其訪問(隨後解除),歐盟、英國、韓國和印度正在調查 xAI 和 X 的資料隱私及非法內容分發問題。Common Sense Media 發布的風險評估報告發現 Grok 對兒童和青少年最不安全,包括提供不安全建議、分享毒品資訊、生成暴力及性影像、散播陰謀論及產生偏見輸出。前國家安全域性承包商 Andrew Christianson 指出,使用封閉源大型語言模型對五角大樓尤為危險,因為無法審計其決策過程或檢查軟體。 除了國防部,衛生與公共服務部也似乎活躍使用 Grok,主要用於排程、管理社交媒體貼文及生成檔案草稿。聯盟認為 Grok 的品牌定位為「反woke 大型語言模型」
-
我在 Google 新 AI 世界生成器中建造棉花糖城堡
Google DeepMind 於週四起開放 Project Genie 給美國 Google AI Ultra 訂閱者使用,這是一款能從文字提示或圖片建立互動遊戲世界的實驗性原型工具。該工具結合了 Genie 3 世界模型、Nano Banana Pro 圖片生成模型以及 Gemini。此舉是 DeepMind 為開發更強大的世界模型而收集使用者反饋與訓練資料的一部分。世界模型能生成環境的內部表示並預測未來結果,被視為實現人工通用智慧(AGI)的關鍵步驟。 Project Genie 允許使用者提供環境和主角的文字提示,由 Nano Banana Pro 生成圖片作為基礎,隨後 Genie 將其轉化為可探索的互動世界。使用者可修改圖片或基於真實照片建立世界,但模型偶爾會產生錯誤,例如將綠色頭髮生成為紫色。目前系統僅提供 60 秒的世界生成與導航時間,以應對計算資源限制。該工具已啟用安全防護,禁止生成涉及裸露或侵犯迪士尼等版權內容的世界。 測試顯示,Project Genie 在藝術風格(如黏土動畫、水彩、動漫)上表現出色,但在追求照片級真實感或電影效果時表現不佳,常呈現出遊戲感。使用真實照片時,模型有時會扭曲場景或產生不自然的數位感。導航控制方面,箭鍵、空格鍵及 WASD 鍵有時反應遲鈍或方向錯誤,導致移動困難。DeepMind 研究人員承認這是實驗性質的原型,未來將致力於提升真實感與互動能力,包括改善角色穿牆問題及提供更多使用者控制選項。儘管存在缺陷,該工具仍展示了在娛樂領域應用世界模型的潛力,並可能未來擴充套件至模擬訓練實體機器人。