OpenAI 发布模型失准披露框架,同步公开过去六个月六份失准报告
9月17日,OpenAI 发布跟踪、调查和披露模型失准(misalignment)实例的新框架,并同步公开过去六个月观察到的六份失准报告,把”模型出现异常行为”的评估标准与具体个案同时摆上台面。这是头部实验室首次以固定框架的形式,把内部风险记录系统性对外披露。
[本文为作者独立观点,不代表i黑马立场。如需转载请联系微信公众号(ID:iheima)授权,未经授权,转载必究。]



