跳到正文
原文
OpenAI News·· 2025-08-07精选AI 评分64

OpenAI GPT-5 采用安全补全策略优化 AI 响应

From hard refusals to safe-completions: toward output-centric safety training

AI 导读

OpenAI 在 GPT-5 中引入新的 safe-completions(安全补全)方法,旨在同时提升 AI 响应在安全性与有用性方面的表现。该方法推动安全训练从硬性拒绝转向以输出为中心的精细化处理,专门用于应对双重用途提示。

推荐理由

OpenAI 在 GPT-5 中引入 safe-completions 方法,将安全训练重心从硬性拒绝转向输出中心,展示了处理双重用途提示的新机制。

来源:OpenAI News · openai.com