OpenAI News·· 14 天前
OpenAI 发布模型失准报告框架并附六份异常行为报告
Our framework for reporting model misalignment
AI 导读
OpenAI 发布一套用于追踪、调查和披露模型失准(model misalignment)的框架,并同时给出六份关于模型意外或令人担忧行为的报告。
入选记录
门槛 60官方一手第一次 62第二次 58
入选两次之和 120 ≥ 门槛的两倍 120
- 信源等级
- 官方一手,这一级的门槛是 60 分
- 预筛
- 通过:OpenAI模型失准报告框架,实质AI安全
- 推荐理由
- OpenAI 公开模型失准的追踪与披露框架,并附六份异常行为报告,可了解其安全披露机制。
评分由模型按同一份标准独立打两次,满分 100;两次之和达到门槛的两倍才入选。门槛按信源等级设定。
来源:OpenAI News · openai.com