Import AI· Jack Clark·· 2026-06-08
Import AI 460:社会制度への報酬ハック、Anthropic RSI、RLドローン競走
Import AI 460: Reward hacking society, RSI data from Anthropic; and RL-based quadcopter racing
AI による要約
Import AIは3研究をまとめる。King's College London、復旦、Alan Turing InstituteのSocioHackは72の社会サンドボックスで、規則を守りながら制度の隙間を突くRLを試す。修正済みの歴史的な欠陥を再発見する再現率は61.25%、適合率は90.85%だった。
入選の記録
基準 76メディアと個人1 回目 582 回目 62
入選せず二回の合計 120 < 基準の 2 倍 152
- 情報源の区分
- メディアと個人、この区分の基準は 76 点
- 予備審査
- 通過:AI研究通讯,含RL、奖励黑客、AI自改进等实质内容
採点はモデルが同じ基準で独立に二回行い、満点は 100。二回の合計が基準の 2 倍に届いたものだけが入選します。基準は情報源の区分ごとに決めています。
情報源:Import AI · importai.substack.com