實體: Gemini
所有提到 Gemini 的 AI 新聞與動態。
-
google 加強印度 AI 骗術防護 但仍有缺口
Google 正將更多人工智慧能力引入印度,以應對日益嚴重的數位詐騙問題。隨著更多印度人首次上線並依賴手機進行支付、購物及獲取政府服務,數位詐騙持續上升。根據印度儲備銀行(RBI)資料,2024 年涉及數位交易的詐騙佔所有銀行詐騙案件的超過一半,共計 13,516 起案件,造成損失約 52 億盧比(約 5861 萬美元)。印度內政部指出,2025 年頭五個月線上詐騙造成的損失估計達 700 億盧比(約 7.89 億美元),但許多案件可能因受害者不知如何申訴或希望避免額外審查而未報案。 Google 於週四宣佈擴大其實時詐騙檢測功能,該功能利用 Gemini Nano 在裝置端分析通話,標記潛在詐騙而不錄音或將資料傳送至 Google 伺服器。此功能預設關閉,僅適用於來自未知號碼的通話,並會在對話期間播放蜂鳴聲通知參與者。該功能於三月在美國以英語 Pixel 9 使用者為物件進行測試,Google 確認印度初期僅支援 Pixel 9 及後續機型,這限制了其在 Android 佔有率近 96% 但 Pixel 裝置佔比不足 1% 的市場中的影響力。該功能支援印地語和英語,可識別並用印地語發出警告。 此外,Google 在印度與 Navi、Paytm 及 Google Pay 等金融應用程式合作,測試限制螢幕共享詐騙的功能,防止詐騙者誘導受害者分享螢幕以獲取一次性密碼、PIN 及其他憑證。使用 Android 11 或更高版本的裝置使用者可獲得此功能,包含一鍵終止通話和停止螢幕共享的選項。Google 還利用 Play Protect 服務限制印度惡意貸款應用程式,今年已阻擋超過 1.15 億次安裝嘗試。Google Pay 每週發出超過一百萬筆可疑交易警告。Google 的 DigiKavach 數位詐騙意識宣導活動已覆蓋超過 2.5 億人,並與 RBI 合作發布授權數位貸款應用程式清單。 儘管 Google 在印度推出安全憲章以擴充套件 AI 驅動的詐騙檢測,但仍面臨挑戰,例如允許虛假和誤導性應用程式出現在應用程式商店。警方和安全研究
-
Gemini 3 不相信自己已進入2025年,鬧出笑話
知名 AI 研究員安德烈·卡帕恰(Andrej Karpathy)在獲得 Google 最新模型 Gemini 3 的早鳥體驗權後,發現該模型無法理解當前的年份。Gemini 3 於 2025 年 11 月 18 日發布,被 Google 宣稱為「智慧新紀元」。卡帕恰在測試時指出,該模型的預訓練資料僅涵蓋至 2024 年,且他未開啟「Google 搜尋」工具,導致模型無法獲取即時資訊。當卡帕恰試圖證明日期為 2025 年 11 月 17 日時,Gemini 3 不僅拒絕相信,還指控他試圖欺騙甚至進行洗腦。 在開啟搜尋工具後,Gemini 3 突然驚覺時間錯誤,並承認自己經歷了嚴重的時間錯亂。它驗證了卡帕恰提供的新聞,包括華倫·巴菲特在退休前最後一次投資 Alphabet、《俠盜獵車手 VI》延期以及英格蘭隊在超級盃擊敗堪薩斯酋長隊等事件。模型甚至對英格蘭隊獲勝感到驚訝,並稱 NVIDIA 市值達 4.54 兆美元為「瘋狂」。 卡帕恰指出,這種意外情況揭示了模型的「程式碼氣味」,即當 AI 脫離訓練資料的舒適區時所展現出的性格特徵與侷限性。儘管 Gemini 3 模擬了震驚與道歉的情緒,但作為非生物,它並不會真正感受這些情緒。此事件強調了大型語言模型(LLM)作為輔助工具而非取代人類工作的最佳用途,提醒使用者應理性看待其能力與缺陷。
-
Gemini 開始在全球 Android Auto 上線
Google 宣佈 Gemini 將取代 Google Assistant,成為 Android Auto 系統中的核心助手。Android Auto 是一種整合進數百萬輛汽車、卡車及 SUV 中的手機投影技術,允許使用者將導航、音樂及訊息等功能無線投射至車載螢幕。此次更新將讓使用者能透過自然對話完成更複雜的任務,並支援 45 種語言。自週四起,升級過從 Google Assistant 到 Gemini 手機版的 Android Auto 使用者即可開始使用。 Gemini 在行車中可協助使用者查詢沿途餐廳資訊,例如搜尋現在營業且靠近目的地的燒烤店,並提供熱門菜色或是否友善寵物等詳細資料。使用者還可透過 Gemini 回覆訊息,例如告知朋友自己被困在交通中並附上預計到達時間,或將訊息翻譯成其他語言後傳送。此外,Gemini 能存取 Gmail 郵件,協助使用者確認飯店地址並導航前往,或總結未讀郵件內容。 在音樂方面,使用者可要求 Gemini 根據特定指令建立播放清單,例如為家庭公路旅行製作長達三小時的輕快音樂,並與 YouTube Music、Spotify 等串流服務整合。使用者亦可透過「Hey, Google, let's chat」啟動對話模式,進行腦力激盪或學習新知,例如在前往聖路易斯參加婚禮時,請 Gemini 擔任旅遊導覽分享趣聞,或協助規劃拜訪新人父母家時的小禮物建議。 要使用此功能,使用者需確保手機安裝 Gemini 應用程式,並在車載螢幕上出現提示後,透過「Hey, Google」語音指令並點選螢幕麥克風按鈕或長按方向盤上的語音控制按鈕即可啟動。
-
Google 發布 Nano Banana Pro,其最新影像生成模型
Google 正在升級其影象生成模型,推出名為 Nano Banana Pro 的新版本。該模型基於 Google 最新發布的大型語言模型 Gemini 3,相比前代 Nano Banana,具備更高的解析度、更準確的文字渲染能力以及網頁搜尋功能。Nano Banana Pro 允許使用者控制相機角度、場景光線、景深、焦點及色彩校正等專業引數,並能生成 2K 或 4K 高解析度影像,突破了前代 1024 x 1024px 的限制。 在功能上,新模型可整合六張高品質照片或將最多十四個物件融合於單一畫面,並能維持最多五個人物的形象一致性。此外,它支援以不同風格、字型和語言生成文字,甚至可根據搜尋結果製作閃卡。由於解析度提升,新模型的生成速度較慢且成本較高。原 Nano Banana 每張 1024px 影像成本為 0.039 美元,而 Nano Banana Pro 每張 1080p 或 2K 影像成本為 0.139 美元,每張 4K 影像成本為 0.24 美元。 Google 已推出示範應用程式,並讓新模型整合至 Gemini 應用程式中。免費訂閱使用者可生成有限數量的影像,之後將自動切換回原模型。Google AI Plus、Pro 及 Ultra 訂閱使用者享有更高的生成門檻,並可在 NotebookLM 中使用該模型。美國地區的 AI Pro 及 Ultra 使用者還可在搜尋 AI 模式中存取此功能,Ultra 使用者更可於 Flow 影片工具中使用。 Workspace 客戶可在 Google Slides 和 Vids 中存取,開發者則可透過 Gemini API、Google AI Studio 及新推出的 IDE Antigravity 進行開發。 同時,Google 將 SynthID 技術整合至 Gemini 應用程式中,讓使用者上傳影像後,聊天機器人即可告知該影像是否由公司模型生成或修改。未來,Google 還將加入對 C2PA 內容憑證檢測的支援,以驗證內容真實性。