實體: Codex
所有提到 Codex 的 AI 新聞與動態。
-
亞馬遜預覽三款AI代理,包括能連續數日自主編程的「Kiro
亞馬遜雲服務(AWS)於週二宣佈推出三款名為「邊界代理」的新 AI 代理,其中包括一個能學習使用者工作習慣並獨立運作數天的代理。這些代理分別負責編寫程式碼、安全流程如程式碼審查,以及自動化 DevOps 任務,例如在推送新程式碼時預防事故。目前已有預覽版本可供使用。AWS 最大的宣稱是其名為「Kiro 自主代理」的產品,該代理基於 AWS 七月宣佈的現有 AI 編碼工具 Kiro 開發。雖然現有工具可用於原型開發,但旨在產生可上線的營運程式碼。為了確保程式碼可靠,AI 必須遵循公司的編碼規範,Kiro 透過「規範驅動開發」概念實現此目標,在編碼過程中由人類指導、確認或糾正其假設,從而建立規範。Kiro 自主代理透過掃描現有程式碼等方式觀察團隊在各工具中的工作模式,隨後即可獨立運作。AWS 執行長 Matt Garman 在週二 AWS re:Invent 大會上表示,使用者只需將複雜任務指派給代理,它便能獨立完成工作,並隨著時間推移加深對程式碼、產品及團隊標準的理解。Kiro 能維持跨會話的持續上下文,不會因記憶體限制而遺忘任務,因此可接受任務並獨立工作數小時甚至數天,僅需極少的人類幹預。Garman 舉例說明,Kiro 可一次性接收指令修復影響十五個企業軟體元件的關鍵程式碼,無需逐一驗證。為了自動化編碼任務,AWS 還開發了 AWS Security Agent,能獨立識別編碼中的安全問題、進行測試並提供修正建議;DevOps Agent 則負責自動測試新程式碼的效能問題或與其他軟體、硬體或雲端設定相容性。儘管 OpenAI 上月也宣稱其 GPT-5.1-Codex-Max 模型支援長達二十四小時的連續執行,但專家指出,大型語言模型仍面臨幻覺和準確性問題,導致開發者需像「保姆」般監督。因此,在代理能真正成為同事之前,上下文視窗仍需擴大,而 AWS 的技術是邁向這一目標的重要一步。
-
PayPal 與 OpenAI 合作讓用戶能在 ChatGPT 內支付購物金額
PayPal 於週二宣佈,將採用 OpenAI 開發的「代理商務協議」(Agentic Commerce Protocol,ACP),並結合其「即時結帳」功能,讓使用者能在 ChatGPT 內直接完成購物付款,此合作預計於 2026 年啟動。ACP 是一項開源規格,旨在讓商家將產品置入 AI 應用程式中,使使用者能透過 AI 代理進行購物。OpenAI 的「即時結帳」功能自九月推出後,允許使用者在 ChatGPT 內確認訂單、運費及付款細節並完成購買,無需離開對話介面。使用者可使用 PayPal 錢包進行結帳,此舉將為買家與賣家提供保護及爭議解決服務。此外,PayPal 還將提供技術支援,透過獨立的付款 API 在 ChatGPT 內處理卡片支付。明年起,使用 PayPal 產品的商家,其商品將可在 ChatGPT 中被發現,首批涵蓋服飾、時尚、美容、家居改善及電子產品等類別。商家無需自行建立整合,PayPal 將處理商家路由與付款流程。PayPal 同時推出代理商務套件,讓商家能在 AI 應用程式中展示目錄、接受不同 AI 平臺的付款,並獲取消費者行為洞察。PayPal 正努力成為企業 AI 購物體驗的付款夥伴,特別針對日益使用 AI 應用程式處理日常任務的使用者。今年五月,PayPal 與 Perplexity 合作,讓使用者可在該 AI 搜尋工具內結帳;九月則宣佈採用 Google 的 Agent Payments 協議,將其產品整合至 Google 各產品中。PayPal 表示,除商業合作外,還將向所有員工開放 ChatGPT 企業版訪問許可權,並允許工程師更有效地使用 OpenAI 的編碼工具 Codex。PayPal 執行長 Alex Chriss 指出,數億人每週使用 ChatGPT 協助日常任務,包括尋找商品,而超過四億人使用 PayPal 購物。透過與 OpenAI 合作並採用 ACP,PayPal 將為雙方客戶提供從對話到結帳僅需幾下點選的支付與商務體驗。
-
Google如何透過開發工具管理員推動AI程式設計
Google 資深產品管理主管 Ryan J. Salva 分享了他對 AI 工具如何改變程式開發的觀察。他前身為 GitHub 與 Microsoft 員工,現負責 Gemini CLI 與 Gemini Code Assist 等工具,推動開發者進入代理程式開發的新世界。Google 於週二發布新研究,探討開發者實際使用 AI 工具的情況及剩餘進步空間。研究發現開發者開始使用 AI 工具的介數時間為 2024 年 4 月,這與 Claude 3 和 Gemini 2.5 的推出時間吻合,標誌著推理模型與工具呼叫能力的成熟。工具呼叫讓模型能自行修正,例如搜尋、編譯、執行單元測試或整合測試。 Salva 個人使用 Gemini CLI、Claude Code 及 Codex 等命令列工具,並混合使用 Zed、VS Code、Cursor 與 Windsurf 等 IDE。在專業工作中,他利用 AI 撰寫需求檔案,通常將 GitHub 問題轉化為約 100 行的技術規格檔案,再讓 AI 根據團隊規範撰寫程式碼。過程中,AI 會更新需求檔案並產生各自的提交與拉取請求,讓他能隨時回退。他估計 70% 至 80% 的工作是在終端機使用自然語言與 Gemini CLI 互動,由 AI 撰寫大部分程式碼,他則負責審查。 關於未來,Salva 認為 IDE 仍將存在,但開發者將花費更多時間處理需求,而在 IDE 中的時間會逐漸減少。十年後若不再直接檢視程式碼,開發者的角色將更像架構師,專注於將複雜問題拆解為可解決的小任務,並從整體視角思考產出成果,而非關注表達機器碼的中介語言。
-
OpenAI 升級 Codex 經過 GPT-5 新版本
OpenAI 於週一宣佈推出 GPT-5 的新版本 GPT-5-Codex,專門用於其 AI 編碼助手 Codex。該模型在執行編碼任務時,其「思考」時間比先前版本更具動態性,可從數秒到七小時不等,從而提升了在代理編碼測試中的表現。此更新已對所有 ChatGPT Plus、Pro、Business、Edu 及 Enterprise 使用者開放,並可透過終端機、IDE、GitHub 或 ChatGPT 訪問,未來將開放給 API 客戶使用。此次更新旨在讓 Codex 在競爭激烈的 AI 編碼工具市場中更具競爭力,面對如 Claude Code、Cursor 及 GitHub Copilot 等強勁對手。Cursor 的年度經常性收入(ARR)在 2025 年初已超過 5 億美元,而 Windsurf 則經歷了被 Google 與 Cognition 分拆的混亂收購嘗試。OpenAI 表示,GPT-5-Codex 在 SWE-bench Verified 編碼能力測試及大型倉庫程式碼重構任務測試中均優於 GPT-5。此外,該模型還接受了經驗豐富的軟體工程師對程式碼審查評論的評估,結果顯示其提交的錯誤評論更少,且增加了更多高影響力的評論。Codex 產品負責人 Alexander Embiricos 指出,效能提升主要歸功於 GPT-5-Codex 動態調整任務時長的「思考能力」。與 ChatGPT 中根據任務複雜度將查詢分發至不同模型的路由機制不同,GPT-5-Codex 內部無路由器,能實時調整投入時間,甚至可在進行五分鐘後決定額外花費一小時,部分案例中耗時甚至長達七小時。