跳到正文
原文
OpenAI News·· 2025-09-17精选AI 评分65

OpenAI 发布模型安全与对齐研究成果

Detecting and reducing scheming in AI models

AI 导读

OpenAI 发布了关于模型安全与对齐的最新研究成果。该报告详细阐述了 OpenAI 在提升模型可控性和降低潜在风险方面采用的技术方法与评估框架。

推荐理由

OpenAI 官方发布关于模型安全与对齐的研究成果,提供了前沿实验室在风险管控方面的具体技术路径。

来源:OpenAI News · openai.com