實體: Gemini
所有提到 Gemini 的 AI 新聞與動態。
-
Google Workspace 內 Gemini 優化功能值得使用的特色
Google 正持續將 Gemini 整合進 Google Workspace,涵蓋 Docs、Gmail、Sheets、Slides、Drive、Meet 及 Calendar 等多個應用。以下為各應用中 Gemini 的實用功能摘要。在 Google Docs 中,Gemini 擅長自動摘要長文與報告,並提供「Help me create」工具,根據 Drive、Gmail 及 Chat 的上下文生成文章初稿,另有「Help me write」用於潤飾文字、「Match writing style」統一文風,以及「Match the format」複製檔案結構,這些功能目前仍在測試階段。Gmail 方面,「AI Inbox」能過濾非重要郵件並高亮關鍵訊息,如醫療預約或體育練習提醒;Gemini 可摘要長郵件串,並提供「Help me write」生成不同語氣的回覆,以及「AI Overview」功能,可透過提問搜尋過去郵件中的特定資訊,例如查詢去年浴室裝修的報價單。在 Google Sheets 中,Gemini 能透過單一提示整合 Gmail、Chat 及 Drive 資訊生成結構化表格,並自動繪製圖表,還有「Fill with Gemini」功能加速表格填補。Google Slides 的 Gemini 優勢在於格式化,可快速建立符合主題的簡報初稿,並支援「refine text」縮短段落或調整格式,此外還可使用 Nano Banana 編輯圖片。Google Meet 的自動筆記功能可捕捉會議重點、決策與行動專案,並協助延遲加入者快速瞭解內容,同時具備實時翻譯字幕、改善音質等升級功能。Google Drive 允許快速搜尋檔案、摘要行銷計畫或生成更新內容,並提供「AI Overview」整合多檔案資訊,新測試工具「Ask Gemini in Drive」則可跨日曆、檔案、郵件及網路提問。Google Calendar 的「Help me schedule」能根據所有人時程建議最佳會議時間,並考慮個人偏好,還能自動建立事件與調整重排時間以減少衝突。Google Chat 可摘要對話串、提取行動專案並撰寫回覆,同時能連結檔案進行提問。Google Vids 中,Gemini 可根據主題生成影片粗剪、撰寫指令碼與旁白,並透過 transcript trimming 移除口語贅字,甚至利用 Gemini Veo 3 將圖片轉為影片或輸入指令碼使用 AI 虛擬人。最後,Google Forms 的 Gemini 能根據描述
-
為何蓋瑞·坦的 Claude Code 設置受到如此多的喜愛與憎恨
Y Combinator 執行長加瑞·坦(Garry Tan)在 SXSW 活動中表示,因對 AI 代理的興奮而陷入「網路精神病」,每晚僅睡四小時。他幽默地表示,這可能是他認識的三分之一 CEO 的共同症狀,並提到自己曾服用莫達非尼(modafinil)等抗嗜睡藥物來維持創業時的精力。坦透露,他目前正利用 AI 代理重構其部落格平臺 Posterous 及其他專案,包括 Posthaven 和政治行動網站 GarrysList.org。 坦於 2026 年 3 月 12 日公開了他的 Claude Code(CC)設定,名為"gstack"。這是一個包含六個預設技能的開源套件,允許使用者將提示詞儲存於特定檔案中以指導 AI 扮演不同角色,如 CEO、工程師或安全審查員。該套件在 GitHub 上獲得近 20,000 個星星和 2,200 個分叉,並迅速在 X 和 Product Hunt 上走紅。坦曾宣稱其設定能像「神模式」般發現跨站指令碼攻擊等安全漏洞,並預測超過 90% 的新專案將採用此工具。 然而,該專案也引發爭議。部分開發者批評這只是簡單的提示詞集合,且已有類似工具存在,質疑若非 Y Combinator 的 CEO 不會有此專案。儘管受到批評,包括 Claude、ChatGPT 和 Gemini 在內的專家仍給予正面評價,認為"gstack"模擬了工程組織結構,有助於提升程式碼的正確性與成熟度。坦強調,他使用 AI 程式設計的體驗讓他能將腦中的構想轉化為程式碼,認為這是前所未有的強大體驗。
-
Google 的個人智能功能將擴展至所有美國用戶
Google 於週二宣佈將擴充套件其「個人智慧」功能,該功能允許 AI 助手透過連結 Gmail、Google 照片等生態系統來為使用者量身打造回應,此舉將惠及美國所有使用者。此前該功能僅限付費使用者使用,現已開放於搜尋引擎的 AI 模式、Gemini 應用程式以及 Chrome 中的 Gemini。Google 表示,無論使用者是尋找之前購買的特定品牌運動鞋,還是根據飯店確認單和過去旅行回憶規劃家庭度假,個人智慧都能協助使用者無需提供所有背景資訊即可找到所需內容。該功能預設為關閉狀態,使用者可選擇是否及何時將 Google 應用程式與這些服務連結。若使用者在輪胎店忘記車輛輪胎尺寸,Gemini 可透過識別 Google 照片中的家庭公路旅行照片,進一步建議適合所有天氣的輪胎。在規劃假期時,AI 模式可結合 Gmail 中的訂房記錄與 Google 照片中的過往旅行回憶,推薦包含適合每位家人喜好的客製化行程,例如基於照片中許多冰淇淋自拍而推薦一家老式冰淇淋店。另一例子是尋找新包包以搭配剛購買的鞋子,Chrome 中的個人智慧會根據近期購買記錄和偏好的品牌風格提供選項,甚至推薦與新金色鞋子配飾相符的包袋細節。Google 強調,Gemini 不會直接訓練於 Gmail 收件箱或 Google 照片庫,而是基於 Gemini 或 AI 模式中的特定提示及模型回應進行訓練。個人智慧今日已在美國的搜尋引擎 AI 模式中可用,並開始向美國免費層級使用者在 Gemini 應用程式和 Chrome 中推出。Google 指出,這些體驗僅適用於個人 Google 帳戶,不適用於 Workspace 企業、企業或教育使用者。
-
Memories AI 正在為穿戴裝置與機器人建立視覺記憶層
Shawn Shen 認為人工智慧若要成功應用於實體世界,必須具備記憶視覺資訊的能力。他創立的 Memories.ai 公司正與半導體巨頭 Nvidia 合作,利用 Nvidia Cosmos-Reason 2 推理視覺語言模型及 Metropolis 參考架構,開發穿戴裝置與機器人所需的視覺記憶基礎設施。Shen 與共同創辦人兼技術長 Ben Zhou 在開發 Meta Ray-Ban 眼鏡背後的 AI 系統時,意識到若使用者無法回溯錄影資料,技術將難以真正融入生活,因此決定從 Meta 獨立出來專注於此領域。目前 OpenAI 於 2024 年更新 ChatGPT 以開始記憶過往對話,並在 2025 年進行微調,Elon Musk 的 xAI 與 Google Gemini 也於過去兩年推出記憶工具,但這些進展多聚焦於結構化且易索引的文字記憶,對於主要透過視覺互動的實體 AI 應用幫助有限。Memories.ai 於 2024 年成立,截至 2025 年 7 月已籌資 1600 萬美元,其中包括由 Susa Ventures 領投的 800 萬美元種子輪及另一筆 800 萬美元融資,參與機構包含 Seedcamp、Fusion Fund 及 Crane Venture Partners 等。公司於 2025 年 7 月推出大型視覺記憶模型(LVMM),其功能類似於 Gemini Embedding 2,並自製名為 LUCI 的硬體裝置供資料收集者佩戴以錄影訓練模型。雖然公司不打算銷售該硬體,但認為現有的高畫質且耗電的錄影裝置不適合其需求。Memories.ai 已推出 LVMM 第二代,並與 Qualcomm 合作,預計今年晚些時候將執行於 Qualcomm 處理器上。儘管目前已有部分穿戴裝置公司表達合作意願,Shen 表示公司尚未透露具體物件,並認為穿戴裝置與機器人市場潛力巨大,但商業化時機可能尚未完全成熟,公司目前更專注於模型與基礎設施的建設。