實體: Gemini
所有提到 Gemini 的 AI 新聞與動態。
-
DeepSeek預覽新AI模型,縮小與頂尖模型的差距
中國人工智慧實驗室 DeepSeek 推出了其最新大型語言模型 DeepSeek V4 的兩個預覽版本,分別為 V4 Flash 和 V4 Pro。這是對去年 V3.2 模型及其伴隨的 R1 推理模型的重大更新。兩款模型均採用專家混合架構,上下文視窗均為 100 萬個 token,足以處理大型程式碼庫或檔案。專家混合方法透過僅在特定任務中啟用部分引數來降低推理成本。V4 Pro 模型擁有 1.6 兆總引數(490 億活躍引數),使其成為目前最大的開放權重模型,超越了 Moonshot AI 的 Kimi K 2.6(1.1 兆)、MiniMax 的 M1(4560 億)以及兩倍於 DeepSeek V3.2(6710 億)的規模。較小的 V4 Flash 擁有 2840 億引數(130 億活躍引數)。DeepSeek 表示,由於架構改進,V4 系列在推理基準測試中幾乎追平了當前領先的開放和封閉模型,其 V4-Pro-Max 在推理基準上優於開放原始碼同儕,並在部分任務上超越 OpenAI 的 GPT-5.2 和 Gemini 3.0 Pro。在程式碼競賽基準中,V4 兩款模型的表現被描述為與 GPT-5.4 相當。然而,在知識測試中,這些模型似乎略遜於前沿模型,特別是 OpenAI 的 GPT-5.4 和 Google 的最新 Gemini 3.1 Pro,這種差距表明其發展軌跡比最先進的前沿模型晚了約 3 到 6 個月。與許多封閉原始碼同儕不同,V4 Flash 和 V4 Pro 目前僅支援文字輸入。值得注意的是,DeepSeek V4 比任何現有的前沿模型都更具成本效益。V4 Flash 的輸入 token 價格為每百萬 0.14 美元,輸出 token 為每百萬 0.28 美元,低於 GPT-5.4 Nano、Gemini 3.1 Flash、GPT-5.4 Mini 和 Claude Haiku 4.5。V4 Pro 的輸入 token 價格為每百萬 0.1
-
OpenAI 發佈 GPT-5.5,讓公司更接近打造 AI 「超級應用程式
OpenAI 於週四推出了其最新的人工智慧模型 GPT-5.5,該公司稱其為迄今為止「最聰明且最直覺易用」的模型。OpenAI 共同創辦人兼總裁 Greg Brockman 表示,此演算法在多個領域提升了能力,並讓公司更接近打造 OpenAI「超級應用程式」的目標。Brockman 在記者會上指出,新模型是朝向更具代理性和直覺性計算的一大進步,相比 GPT-5.4,它能在更少的 token 下成為更快、更犀利的思考者,這意味著更多前沿人工智慧資源將為企業和消費者所獲得。 Brockman 強調,GPT-5.5 是實現「超級應用程式」計畫的額外一步,該計畫旨在將 ChatGPT、Codex 和 AI 瀏覽器整合為單一統一服務,以協助企業客戶。此概念亦為 OpenAI 競爭對手 Elon Musk 所關注,他正計劃將 X 轉化為自己的超級應用程式。OpenAI 持續以快速節奏推出新模型,首席科學家 Jakub Pachocki 表示,雖然過去兩年進展看似緩慢,但短期內將有顯著改善,中期則會有極其顯著的進步。 GPT-5.5 設計用於廣泛的應用類別,涵蓋基礎企業領域如代理程式碼編寫和知識工作,以及實驗性應用如數學和科學研究。根據 OpenAI 發布的資料,該模型在各種基準測試中表現優於前代模型,並優於競爭對手 Google 和 Anthropic 的模型(如 Gemini 3.1 Pro 和 Claude Opus 4.5)。針對 Anthropic 新推出的 cybersecurity 工具 Mythos,OpenAI 技術人員 Mia Glaese 表示,GPT-5.5 將對公司部署模型以應對數位防禦的方式產生重大影響,並強調其擁有長期且堅固的網路安全策略。 OpenAI 首席研究官 Mark Chen 指出,GPT-5.5 在處理電腦工作方面優於先驅模型,並在科學和技術研究工作流上展現有意義的進步,特別能協助專家科學家取得進展,並可協助藥物發現領域,該領域近年產業興趣增加。GPT-5.5 自週四起廣泛可用,將部署於 ChatGPT 的 Plus、Pro、Business 及 Enterprise 使用者中,而 5.5 Pro
-
Google 更新 Workspace,讓 AI 成為你的新 office 質詢員
Google 在 Google Cloud Next 活動中宣佈了一系列針對 Workspace 訂閱式生產力套件的重大更新,這些更新高度依賴人工智慧,旨在透過自動化工具協助專業人士減少繁瑣工作。新推出的 Workspace Intelligence 系統整合了 Gmail、日曆、聊天及 Drive(包含檔案、簡報與試算表)等資料,讓使用者能根據個人習慣自動協助處理各種任務,且系統提供行政控制權,允許使用者隨時關閉特定資料來源的存取許可權。在試算表功能方面,使用者可透過 Gemini 建立並填補表格,系統能根據提示進行格式化與資料檢索,甚至自動完成資料輸入,Google 聲稱此功能比手動輸入快九倍,並支援將非結構化資料轉換為有組織的表格。此外,Google Docs 也引入了新的 AI 寫作工具,利用 Workspace Intelligence 結合 Drive、聊天、郵件檔案庫及網際網路資料,協助撰寫、編輯與潤飾檔案,使用者可要求 Gemini 模仿其寫作風格。儘管微軟、Apple 及眾多新創公司正積極競爭企業市場,Google 仍因產品已深度嵌入全球職場而具備顯著優勢,持續推出高效能的 AI 升級以吸引企業客戶。
-
Google 將 Chrome 變成職場 AI 副手
Google 在 Google Cloud Next 活動中宣佈,將為企業版 Chrome 使用者引入「自動瀏覽」代理功能,並結合增強的安全措施。此功能利用 Gemini AI 理解使用者開啟的瀏覽器標籤頁中的即時情境,協助處理預訂行程、輸入資料、安排會議等網頁相關任務。使用者可將資訊輸入公司首選的 CRM 系統、比對供應商價格、總結候選人履歷或抓取競爭對手產品關鍵資料。Google 強調,工作流程仍需「人在環中」,使用者必須手動審查並確認 AI 輸入後才能執行最終動作,旨在節省繁瑣時間讓員工專注於更具戰略性的工作。 該功能初期僅供美國 Workspace 使用者使用,可透過政策啟用,且組織的提示詞不會用於訓練 AI 模型。使用者可儲存常用工作流程為「技能」,透過輸入斜線或點選加號呼叫。此外,Google 透過 Chrome Enterprise Premium 擴充對未經授權 AI 工具的檢測能力,協助 IT 團隊識別受損的瀏覽器擴充功能或異常代理活動,此舉被稱為「陰影 IT 風險檢測」,能監控組織內所有受許與未受許的生成式 AI 及 SaaS 網站使用情況。IT 團隊還將獲得 Gemini 生成的 Chrome 企業版更新摘要,包含關鍵變更、新政策及設定建議。Google 同時擴大與 Okta 的夥伴關係,以減少會話劫持等威脅,並升級擴充功能安全控制,整合 Microsoft Information Protection 以協助組織執行一致的安全政策。