實體: Google
所有提到 Google 的 AI 新聞與動態。
-
亞馬遜AI助手登陸網頁透過Alexa.com提供服務
亞馬遜於 2026 年 1 月 2 日在拉斯維加斯舉行的 CES 2026 活動上正式宣佈推出 Alexa.com 網站,標誌著其 AI 助手 Alexa+ 的線上版本全面上線。該網站向所有 Alexa+ 早期訪問客戶開放,允許使用者像使用 ChatGPT 或 Google Gemini 等 AI 聊天機器人一樣,在瀏覽器中與 Alexa+ 互動。亞馬遜希望將 Alexa+ 的應用範圍從家庭裝置擴充套件至手機和網路,以增強其競爭力。目前全球已有超過 6 億臺 Alexa 裝置售出,包括 Echo 智慧音箱和顯示器。 亞馬遜正在更新其手機應用程式,使其更具「代理」導向,首頁將採用聊天機器人風格的介面,強調對話功能而非其他特性。在 Alexa.com 網站上,使用者可以處理複雜主題探索、內容創作及行程規劃等任務。亞馬遜致力於區分於其他助手,專注於家庭需求,例如控制智慧家居裝置、更新家庭日曆和待辦事項、預訂晚餐、將商品加入 Amazon Fresh 或 Whole Foods 購物車、尋找並儲存食譜,以及根據個人推薦規劃家庭電影之夜。近期整合的服務包括 Angi、Expedia、Square 和 Yelp,與 Fodor's、OpenTable、Suno、Ticketmaster、Thumbtack 和 Uber 等現有應用程式並列。 網站側邊欄提供快速訪問常用功能的導航,方便使用者繼續進行設定溫控、檢查日曆、檢視購物清單等任務。亞馬遜希望使用者能分享個人檔案、電子郵件和日曆訪問許可權,使 Alexa+ 成為管理家庭事務的樞紐,涵蓋學校假期、足球賽程、醫生預約及寵物疫苗等細節。由於亞馬遜缺乏自有生產力套件,目前依賴工具上傳檔案,但此功能將透過 Alexa.com 提供,且資訊可顯示在 Echo Show 螢幕上管理。亞馬遜 Alexa 和 Echo 副總裁 Daniel Rausch 表示,76% 的 Alexa+ 使用案例是其他 AI 無法完成的,例如透過照片與亞馬遜分享舊家庭食譜並在烹飪時進行對話和替換食材。另有 24% 的使用案例顯示使用者正將更多 AI 使用轉移至亞馬遜。 Alexa.com 初期僅對使用 Amazon 帳戶登入的早期
-
Google預告新款Gemini功能於CES 2026電視應用
Google 於十一月將 Gemini AI 引入 Google TV 裝置,旨在提升電視觀看體驗。在拉斯維加斯舉行的 CES 2026 展會上,Google 展示了即將上線的一系列新 Gemini 功能,讓觀眾能深入探討主題、利用 AI 搜尋並重構個人照片與影片,甚至透過語音指令直接控制電視操作,無需複雜的設定導航。這些功能將先於選定的 TCL 電視推出,隨後逐步擴充套件至其他 Google TV 裝置。專為大螢幕設計的 Gemini for Google TV 允許使用者透過自然語言對話尋找節目、獲取劇情摘要或獲得推薦,例如詢問適合兩人口味的影片、回憶不起片名但能描述劇情或提及演員,或是查詢熱門醫院劇集。Gemini 透過新的視覺豐富框架回應問題,結合文字、影像、影片背景及即時體育更新。此外,電視螢幕不僅限於娛樂,還可用作教育工具,提供敘述式互動概覽以簡化概念,並允許使用者提出後續問題深入學習。使用者還能查詢 Google 照片庫中特定人物或時刻,運用 Gemini AI 為照片和影片套用藝術風格,將回憶轉化為電影風格的動態影集。最實用的功能之一是透過語音最佳化電視設定,使用者可指示「畫面太暗」或「聽不清對白」,Gemini 將自動調整相關設定,無需離開當前節目。Google 表示,新 Gemini 功能需要裝置執行 Android TV OS 14 或更高版本,並需連線網路。並非所有語言、國家或裝置在發售時皆支援,且使用者必須擁有 Google 帳號才能存取 Gemini for TV 體驗。
-
2026年AI將從熱潮轉向務實應用
2026 年被視為 AI 技術從追求規模轉向務實應用的關鍵轉折年。隨著產業開始冷靜,焦點不再僅限於堆疊引數,而是轉向部署更適合場景的小型模型、將智慧嵌入實體裝置以及設計能順暢融入人類工作流的系統。專家認為,2026 年將見證從暴力擴充套件到研究新架構的轉變,從花哨演示轉向目標導向的部署,以及從承諾自主的代理轉向真正增強人類工作的工具。 在模型架構方面,隨著開源模型 Mistral 及 OpenAI 的 GPT-3 等驗證了規模效應的極限,Yann LeCun 及 Ilya Sutskever 等專家指出,未來五年將出現比 Transformer 更優的新架構。企業端將更依賴經過微調的小型語言模型(SLM),如 AT&T 首席資料官 Andy Markus 所言,SLM 在企業應用中能提供與大型模型相當的準確性,同時具備更佳的成本效益與速度。此外,世界模型(World Models)成為重要趨勢,Meta 前首席 AI 科學家 Yann LeCun 已創立實驗室,Google DeepMind 推出 Genie 模型,Fei-Fei Li 的 World Labs 則發布了商業世界模型 Marble。PitchBook 預測,世界模型在遊戲市場規模將從 2025 年的 12 億美元增長至 2030 年的 2760 億美元。 在代理(Agent)領域,Anthropic 推出的模型上下文協議(MCP)被視為連線 AI 代理與外部工具(如資料庫、搜尋引擎)的關鍵標準,OpenAI、Microsoft 及 Google 均已採用。這將推動代理工作流從演示進入日常實踐,並承擔系統核心角色,應用於客服、銷售及醫療等領域。儘管曾有自動化取代人力的擔憂,但 Workera 創辦人 Kian Katanforoosh 預測 2026 年將是「人類之年」,AI 將主要用於增強人類工作流,而非完全替代,預計失業率將維持在 4% 以下。 最後,隨著小型模型、世界模型及邊緣運算的進步,實體 AI 將在 2026 年進入主流。AT&T Ventures 負責人 Vikram Taneja 指出,機器人、無人機及穿戴裝置將開始普及
-
OpenAI 賭注聲音未來 硅谷對螢幕宣戰
OpenAI 正大力押注音訊人工智慧,不僅是為了讓 ChatGPT 聽起來更好,而是為了為一年後預計推出的音訊優先個人裝置做準備。根據 The Information 的新報導,OpenAI 在過去兩個月內整合了多個工程、產品和研發團隊,全面重構其音訊模型。這一舉動反映了整個科技產業的趨勢,即螢幕將成為背景噪音,而音訊將成為核心。目前,智慧音箱已讓語音助手成為美國三分之一家庭的常設設施。Meta 最近推出了其雷拜恩智慧眼鏡的功能,利用五個麥克風陣列幫助使用者在嘈雜環境中聽清對話,本質上將臉部轉化為定向聆聽裝置。Google 自六月起開始實驗「音訊摘要」功能,將搜尋結果轉化為對話式總結,而 Tesla 則將 xAI 的聊天機器人 Grok 整合進車輛,打造能處理導航和空調控制等各項任務的對話式語音助手。 除了科技巨頭,一群創業公司也持同樣信念,儘管成功程度不一。Humane AI Pin 的製造商在無螢幕可穿戴裝置成為警示案例前耗費了數億美元。Friend AI 項鍊聲稱能記錄使用者生活並提供陪伴,卻同時引發了隱私擔憂和存在主義恐懼。現在至少兩家公司,包括 Sandbar 和由 Pebble 創辦人 Eric Migicovsky 領導的公司,正在開發預計於 2026 年推出的 AI 戒指,讓佩戴者能與手對話。雖然外形可能不同,但核心論點一致:音訊是未來的介面。每個空間——家、車甚至臉部——都正在成為控制表面。OpenAI 的新音訊模型預計於 2026 年初推出,據稱將聽起來更自然,能像真正的對話夥伴一樣處理中斷,甚至能在使用者說話時回應,這是今日模型無法做到的。公司還 envision 一組裝置,可能包括眼鏡或無螢幕智慧音箱,它們將更像伴侶而非工具。這並不令人驚訝,正如 The Information 所指出的,前 Apple 設計總監 Jony Ive 透過 OpenAI 五月以 65 億美元收購其公司 io 加入硬體團隊,將減少裝置依賴視為優先事項,認為音訊優先設計是糾正過去消費電子產品錯誤的機會。