跳到正文
原文
OpenAI News·· 2025-08-07AI 评分40

OpenAI GPT-5 从硬性拒绝转向安全补全的输出中心安全训练

From hard refusals to safe-completions: toward output-centric safety training

AI 导读

OpenAI 在 GPT-5 中引入 safe-completions 方法,取代传统的硬性拒绝机制。该方案采用以输出为中心的安全训练策略,旨在更细致地处理双重用途提示词。这一改进同时提升了 AI 响应的安全性与有用性。

来源:OpenAI News · openai.com