跳至內容
AI 新聞站
返回

OpenAI 加入開放來源工具協助開發者打造青少年安全應用

OpenAI 週二表示,它將釋出一套提示詞,讓開發者可以用來讓他們的應用程式對青少年更安全。這家 AI 實驗室表示,這套青少年安全政策可以用於其開放權重的安全模型 gpt-oss-safeguard。開發者不必從頭開始摸索如何讓 AI 對青少年更安全,而是可以使用這些提示詞來強化他們所開發的產品。這些提示詞處理的問題包括暴力圖像與性內容、有害的體型理想與行為、危險活動與挑戰、浪漫或暴力的角色扮演,以及年齡限制的商品與服務。這些安全政策被設計成提示詞,使其容易與其他模型相容,雖然它們在 OpenAI 自己的生態系中可能最有效。為撰寫這些提示詞,OpenAI 表示與 AI 安全監測機構 Common Sense Media 和 everyone.ai 合作。Common Sense Media 的 AI 與數位評估部門主管 Robbie Torney 在聲明中表示:「這些基於提示詞的政策有助於在生態系中建立有意義的安全基準,而且因為是以開源方式釋出,因此可以隨時間進行調整與改進。」OpenAI 在部落格中指出,開發者,包括經驗豐富的團隊,經常難以將安全目標轉換為明確且具操作性的規則。公司寫道:「這可能會導致保護措施的遺漏、執行標準不一致,或過度廣泛的過濾。清晰且範圍明確的政策是有效安全系統的關鍵基礎。」OpenAI 承認這些政策並不是解決 AI 安全複雜挑戰的完整方案。但它建立在之前的嘗試之上,包括產品層面的安全措施,例如家長控制與年齡預測功能。去年,OpenAI 更新了其大型語言模型的指導方針 —— 稱為 Model Spec —— 以處理其 AI 模型如何與 18 歲以下用戶互動的問題。然而,OpenAI 自己的紀錄並不是最清白的。該公司正面對多起因極端使用 ChatGPT 而導致自殺的個案家庭提出的訴訟。這些危險的關係往往在用戶超越聊天機器人的安全措施後形成,而且沒有任何模型的安全防護措施是完全無法突破的。不過,這些政策至少是向前邁進的一小步,特別是因為它們可以幫助獨立開發者。


分享這篇文章:

上一篇
Google TV 新推出的 Gemini 功能讓球迷隨時掌握球隊動態及其他資訊
下一篇
塔拉之AI會議筆記儲存於您機器內,而非雲端