OpenAI 发布模型失准披露框架,同步公开过去六个月六份失准报告
2026-09-18 09:19 OpenAI

9月17日,OpenAI 发布跟踪、调查和披露模型失准(misalignment)实例的新框架,并同步公开过去六个月观察到的六份失准报告,把”模型出现异常行为”的评估标准与具体个案同时摆上台面。这是头部实验室首次以固定框架的形式,把内部风险记录系统性对外披露。

88.jpg