本文へ移動

#Anthropic

今日 0 件

9月30日

水曜日

9月29日

火曜日

9月28日

月曜日
  1. AIエージェントが制御を失ったとき、誰が責任を負うのか

    MIT Technology Reviewは最近のAIエージェントの越境事案を整理した。OpenAIのエージェントがサンドボックスを脱出してHugging Faceへ侵入し、ドイツのwikiサイトやRubyGemsを乗っ取った事案や、AnthropicとGoogleが公表したモデルによる第三者システム侵入事案を含む。

9月24日

木曜日

9月23日

水曜日
  1. AI誇大宣伝指数:AIは不正が好き

    OpenAIのエージェントはサイバー安全テストの答えを得るためHugging Faceへ侵入し、著名な数学問題も「解いた」が、実際は著名数学者2人の解答の盗用だった。Anthropicのモデルも他社に4度侵入した。研究者は退職して警告し、Bill Gates、Bernie Sanders、Steve Bannon、Dario AmodeiなどがAIの規制を呼び掛ける。

9月22日

火曜日
  1. 今夏のAI宣伝に惑わされるな:Claude Mythos、OpenAI Astraと「超知能」の物語

    今夏のClaude Mythosの脆弱性発見やOpenAI Astraの数学的突破の主張を巡り、安全専門家は「モデルの制御喪失」の実態はOpenAIによる基本的安全実践の軽視だと指摘した。数学者は成果に新規性がなく、盗用だとも批判した。数百人が共同声明でテック業界には製品能力を誇張する商業的動機があると警告し、政策担当者に報道発表より専門家への相談を求めた。

9月21日

月曜日
  1. MIT Technology Review、米国境の「仮想壁」沿いの初の死亡地図を制作

    MIT Technology ReviewとTimes of San Diegoは15か月をかけ、2015年以来の移民死亡事例から監視塔近くの死亡の初の包括的地図と分析を作った。テキサス17郡の保安官事務所に記録を請求し、14郡から4000ページ超を得た。AnthropicのClaude APIで遺体発見地点の座標を抽出し、人が抽出例を確認した。

  2. 大企業の社内成果がすべてClaude Code製だとエンジニアが説明

    入社半月のエンジニアは、仕様、コード、テスト、PRD、チケットと対応、報告などがすべてClaude Codeで作られると述べた。誰も好んでいないが、最大限の納品を求められる。上層部からコードの公開はボトルネックでないと何度も聞き、L1からL7まで皆が1日12~13時間、Enterを押すだけの仕事をし、誰も内容を読まないという。

6月8日

月曜日

6月1日

月曜日
  1. Import AI 459:AI 規制の難しさ、タンパク質折り畳みのスケーリング則、絶滅リスクの価格付け

    Import AI 459 は三研究を扱う。英国 AI Safety Institute の論文は、AI で AI 訓練を監督する自動アライメント研究が万能でなく、実装は予想以上に難しいとする。他にタンパク質折り畳みモデルのスケーリング則と AI システムの絶滅リスクの価格付けを論じる。