實體: Google
所有提到 Google 的 AI 新聞與動態。
-
Gemini 3 不相信自己已進入2025年,鬧出笑話
知名 AI 研究員安德烈·卡帕恰(Andrej Karpathy)在獲得 Google 最新模型 Gemini 3 的早鳥體驗權後,發現該模型無法理解當前的年份。Gemini 3 於 2025 年 11 月 18 日發布,被 Google 宣稱為「智慧新紀元」。卡帕恰在測試時指出,該模型的預訓練資料僅涵蓋至 2024 年,且他未開啟「Google 搜尋」工具,導致模型無法獲取即時資訊。當卡帕恰試圖證明日期為 2025 年 11 月 17 日時,Gemini 3 不僅拒絕相信,還指控他試圖欺騙甚至進行洗腦。 在開啟搜尋工具後,Gemini 3 突然驚覺時間錯誤,並承認自己經歷了嚴重的時間錯亂。它驗證了卡帕恰提供的新聞,包括華倫·巴菲特在退休前最後一次投資 Alphabet、《俠盜獵車手 VI》延期以及英格蘭隊在超級盃擊敗堪薩斯酋長隊等事件。模型甚至對英格蘭隊獲勝感到驚訝,並稱 NVIDIA 市值達 4.54 兆美元為「瘋狂」。 卡帕恰指出,這種意外情況揭示了模型的「程式碼氣味」,即當 AI 脫離訓練資料的舒適區時所展現出的性格特徵與侷限性。儘管 Gemini 3 模擬了震驚與道歉的情緒,但作為非生物,它並不會真正感受這些情緒。此事件強調了大型語言模型(LLM)作為輔助工具而非取代人類工作的最佳用途,提醒使用者應理性看待其能力與缺陷。
-
Gemini 開始在全球 Android Auto 上線
Google 宣佈 Gemini 將取代 Google Assistant,成為 Android Auto 系統中的核心助手。Android Auto 是一種整合進數百萬輛汽車、卡車及 SUV 中的手機投影技術,允許使用者將導航、音樂及訊息等功能無線投射至車載螢幕。此次更新將讓使用者能透過自然對話完成更複雜的任務,並支援 45 種語言。自週四起,升級過從 Google Assistant 到 Gemini 手機版的 Android Auto 使用者即可開始使用。 Gemini 在行車中可協助使用者查詢沿途餐廳資訊,例如搜尋現在營業且靠近目的地的燒烤店,並提供熱門菜色或是否友善寵物等詳細資料。使用者還可透過 Gemini 回覆訊息,例如告知朋友自己被困在交通中並附上預計到達時間,或將訊息翻譯成其他語言後傳送。此外,Gemini 能存取 Gmail 郵件,協助使用者確認飯店地址並導航前往,或總結未讀郵件內容。 在音樂方面,使用者可要求 Gemini 根據特定指令建立播放清單,例如為家庭公路旅行製作長達三小時的輕快音樂,並與 YouTube Music、Spotify 等串流服務整合。使用者亦可透過「Hey, Google, let's chat」啟動對話模式,進行腦力激盪或學習新知,例如在前往聖路易斯參加婚禮時,請 Gemini 擔任旅遊導覽分享趣聞,或協助規劃拜訪新人父母家時的小禮物建議。 要使用此功能,使用者需確保手機安裝 Gemini 應用程式,並在車載螢幕上出現提示後,透過「Hey, Google」語音指令並點選螢幕麥克風按鈕或長按方向盤上的語音控制按鈕即可啟動。
-
Google 發布 Nano Banana Pro,其最新影像生成模型
Google 正在升級其影象生成模型,推出名為 Nano Banana Pro 的新版本。該模型基於 Google 最新發布的大型語言模型 Gemini 3,相比前代 Nano Banana,具備更高的解析度、更準確的文字渲染能力以及網頁搜尋功能。Nano Banana Pro 允許使用者控制相機角度、場景光線、景深、焦點及色彩校正等專業引數,並能生成 2K 或 4K 高解析度影像,突破了前代 1024 x 1024px 的限制。 在功能上,新模型可整合六張高品質照片或將最多十四個物件融合於單一畫面,並能維持最多五個人物的形象一致性。此外,它支援以不同風格、字型和語言生成文字,甚至可根據搜尋結果製作閃卡。由於解析度提升,新模型的生成速度較慢且成本較高。原 Nano Banana 每張 1024px 影像成本為 0.039 美元,而 Nano Banana Pro 每張 1080p 或 2K 影像成本為 0.139 美元,每張 4K 影像成本為 0.24 美元。 Google 已推出示範應用程式,並讓新模型整合至 Gemini 應用程式中。免費訂閱使用者可生成有限數量的影像,之後將自動切換回原模型。Google AI Plus、Pro 及 Ultra 訂閱使用者享有更高的生成門檻,並可在 NotebookLM 中使用該模型。美國地區的 AI Pro 及 Ultra 使用者還可在搜尋 AI 模式中存取此功能,Ultra 使用者更可於 Flow 影片工具中使用。 Workspace 客戶可在 Google Slides 和 Vids 中存取,開發者則可透過 Gemini API、Google AI Studio 及新推出的 IDE Antigravity 進行開發。 同時,Google 將 SynthID 技術整合至 Gemini 應用程式中,讓使用者上傳影像後,聊天機器人即可告知該影像是否由公司模型生成或修改。未來,Google 還將加入對 C2PA 內容憑證檢測的支援,以驗證內容真實性。
-
Amazon 的 Prime Video 開始為部分電視節目提供 AI 生成的視訊摘要
亞馬遜 Prime Video 於週三宣佈,將推出利用生成式 AI 建立的「影片摘要」功能,協助觀眾在劇集季間追劇。該功能將以電影級品質製作包含同步旁白、對話與音樂的季結摘要,並從週三起以測試形式推出,首批涵蓋《輻射》、《湯姆·克蘭西的傑克·萊恩》及《上傳》等 Prime Originals 劇集。此功能類似於去年推出的「X-Ray 摘要」,旨在避免無意洩露劇透。消費者已習慣手機或 Google 搜尋中的文字式 AI 摘要,但影片摘要可能更顯突兀,也可能被不記得劇情內容的觀眾接受。競爭對手也在探索 AI 整合,例如 YouTube TV 的「關鍵時刻」功能曾助其贏得首座技術艾美獎,儘管其演算法在識別棒球攻勢動作時尚不完美。Netflix 則在製作端應用 AI,包括在阿根廷劇集《永恆的太空人》中生成建築倒塌場景,以及協助電影《快樂大腳 2》讓角色在開場看起來更年輕,並用於《億萬富翁的地窖》的預製期設計。電影產業對 AI 的使用引發爭議,藝術家擔憂工具可能威脅其生計,但也有人認為如 Wonder Dynamics 等能加速繁瑣工作的工具,可擴大藝術家的創作能力。