跳到正文
原文
OpenAI News·· 14 天前

OpenAI 发布模型失准报告框架并附六份异常行为报告

Our framework for reporting model misalignment

AI 导读

OpenAI 发布一套用于追踪、调查和披露模型失准(model misalignment)的框架,并同时给出六份关于模型意外或令人担忧行为的报告。

入选记录

入选两次之和 120 ≥ 门槛的两倍 120

信源等级
官方一手,这一级的门槛是 60 分
预筛
通过:OpenAI模型失准报告框架,实质AI安全
推荐理由
OpenAI 公开模型失准的追踪与披露框架,并附六份异常行为报告,可了解其安全披露机制。

评分由模型按同一份标准独立打两次,满分 100;两次之和达到门槛的两倍才入选。门槛按信源等级设定。

来源:OpenAI News · openai.com