OpenAI News·· 2025-09-17精选AI 评分65
OpenAI 发布模型安全与对齐研究成果
Detecting and reducing scheming in AI models
AI 导读
OpenAI 发布了关于模型安全与对齐的最新研究成果。该报告详细阐述了 OpenAI 在提升模型可控性和降低潜在风险方面采用的技术方法与评估框架。
推荐理由
OpenAI 官方发布关于模型安全与对齐的研究成果,提供了前沿实验室在风险管控方面的具体技术路径。
来源:OpenAI News · openai.com