實體: Claude
所有提到 Claude 的 AI 新聞與動態。
-
WordPress.com 現讓 AI 副本寫作與發佈文章等功能
WordPress.com 宣佈將引入 AI 代理功能,允許其自動撰寫、編輯、發布內容,並管理評論、更新後設資料及組織標籤分類。此功能透過自然語言指令介面控制,網站主可授權 AI 代理執行更多工,包括建立文章、落地頁及關於頁面,並進行結構調整。AI 代理還能審核與清理評論、重組分類標籤,以及修正圖片替代文字、標題等以提升 SEO。所有變更均記錄於活動日誌,且 AI 生成的內容預設為草稿,需使用者批准後方可發布。此舉旨在降低網站建置與維護門檻,並加速內容生產。啟用功能需使用者前往 wordpress.com/mcp 開啟所需能力,並連線如 Claude、Cursor 或 ChatGPT 等支援 MCP 的 AI 工具。WordPress.com 作為全球 43% 網站的動力平臺,其託管版本每月擁有 200 億頁面瀏覽量與 4.09 億獨立訪客。此更新繼去年引入模型上下文協議(MCP)支援後,進一步讓 AI 助手能深度整合平臺內容、設定與分析資料。儘管引發對網路內容狀態的擔憂,但 AI 撰寫內容仍能提供讀者洞察模型寫作方式。Meta 近期收購 Moltbook 並允許 AI 代理互動,Anthropic 也實驗過在人類監督下讓 AI 撰寫部落格。
-
排行榜「你無法操控」,由其排名公司資助
人工智慧模型數量激增,競爭激烈,Arena 平臺(前身為 LM Arena)已成為前沿大語言模型(LLM)的公認排行榜,深刻影響資金、產品發布及公共關係週期。該起點僅在七個月內,從加州大學柏克萊分校的博士研究專案發展為估值達 17 億美元的創業公司。本集節目由 Equity 主持人 Rebecca Bellan 專訪 Arena 共同創辦人 Anastasios Angelopoulos 與 Wei-Lin Chiang,探討其平臺如何成為前沿 AI 模型的首選評測標準,以及如何在 OpenAI、Google 和 Anthropic 等巨頭支援下建立中立基準。兩人解析了 Arena 的運作機制,說明其相比靜態基準更難被操弄,並闡述了「結構中立」的含義。節目還分析了為何 Claude 目前在法律與醫療領域的專家排行榜中名列前茅,並介紹公司如何擴充套件至代理、程式碼撰寫及真實世界任務的評測,推出新的企業產品。觀眾可透過 YouTube、Apple Podcasts、Overcast、Spotify 等渠道訂閱 Equity,或關注其 X 和 Threads 帳號 @EquityPod。
-
取得博士學位的學生成為AI產業評審者
人工智慧模型迅速擴增,競爭激烈,Arena 前身為 LM Arena,已成為前沿大型語言模型(LLM)的公認排行榜,影響著資金、產品發布與公共關係週期。該起點僅在七個月內,從加州大學柏克萊分校的博士研究專案發展為估值達 17 億美元的創業公司。在 TechCrunch 的 Equity 播客節目中,Rebecca Bellan 與 Arena 共同創辦人 Anastasios Angelopoulos 及 Wei-Lin Chiang 探討瞭如何建立中立基準,即使被評測的公司也是他們的後盾。節目內容涵蓋 Arena 的運作機制、為何無法像靜態基準那樣被操弄、所謂「結構中立」的含義,以及接受 OpenAI、Google 和 Anthropic 資金是否構成利益衝突。此外,還介紹了 Arena 如何超越對話功能,將基準測試擴充套件至代理、程式碼撰寫及真實世界任務,並推出新企業產品。節目指出 Claude 目前在法律與醫療等專業領域的專家排行榜上領先。最後,討論了 Arena 對 LLM 之後技術路線的押注,認為代理(Agents)將是下一個測試重點。該播客可在 YouTube、Apple Podcasts、Overcast、Spotify 等平臺收聽,並可透過 X 和 Threads 關注 @EquityPod。
-
為何蓋瑞·坦的 Claude Code 設置受到如此多的喜愛與憎恨
Y Combinator 執行長加瑞·坦(Garry Tan)在 SXSW 活動中表示,因對 AI 代理的興奮而陷入「網路精神病」,每晚僅睡四小時。他幽默地表示,這可能是他認識的三分之一 CEO 的共同症狀,並提到自己曾服用莫達非尼(modafinil)等抗嗜睡藥物來維持創業時的精力。坦透露,他目前正利用 AI 代理重構其部落格平臺 Posterous 及其他專案,包括 Posthaven 和政治行動網站 GarrysList.org。 坦於 2026 年 3 月 12 日公開了他的 Claude Code(CC)設定,名為"gstack"。這是一個包含六個預設技能的開源套件,允許使用者將提示詞儲存於特定檔案中以指導 AI 扮演不同角色,如 CEO、工程師或安全審查員。該套件在 GitHub 上獲得近 20,000 個星星和 2,200 個分叉,並迅速在 X 和 Product Hunt 上走紅。坦曾宣稱其設定能像「神模式」般發現跨站指令碼攻擊等安全漏洞,並預測超過 90% 的新專案將採用此工具。 然而,該專案也引發爭議。部分開發者批評這只是簡單的提示詞集合,且已有類似工具存在,質疑若非 Y Combinator 的 CEO 不會有此專案。儘管受到批評,包括 Claude、ChatGPT 和 Gemini 在內的專家仍給予正面評價,認為"gstack"模擬了工程組織結構,有助於提升程式碼的正確性與成熟度。坦強調,他使用 AI 程式設計的體驗讓他能將腦中的構想轉化為程式碼,認為這是前所未有的強大體驗。