本文へ移動

すべての AI 動向

今日 31 件

9月22日

火曜日
  1. TypeSafe AI、System One の意思決定モデル Jev を公開

    TypeSafe AI は先週 Jev を公開し、新しい「System One モデル」の最初の例としたが、筆者は「意思決定モデル」の呼び名を好む。文字を入力し、分類、はい・いいえ、点数に対応する浮動小数と信頼度を返す。入力だけに課金し、初モデルは100万トークン当たり0.042ドル。筆者は迷惑メール検出、タグ付け、順位付けに適すると考え、検索の再ランキングにも試した一方、数字、日付、敵対的内容は苦手と指摘する。

  2. NVIDIAのエジプトAIが本番規模へ、開発者は1年で10倍超

    NVIDIAは大エジプト博物館でAIイベントを開き、Deep Learning Instituteのエジプト参加者は1年で10倍超となった。Hassan Allamは国家通信規制局のデータセンター許可を得て、A15と投資予定4億ドルの新施設を開発する。NVIDIAによるとアフリカでAI工場4か所が発表・稼働し、さらに656MWが建設中だ。

9月21日

月曜日
  1. Microsoft、逆合成モデル RetroChimera を公開、Nature に掲載

    Microsoft は Nature で逆合成予測フレームワーク RetroChimera を発表し、実装とウェイトを公開した。Transformer の R-SMILES 2 と GNN ベースの NeuralLoc を組み合わせ、学習型アンサンブルで両者の予測を再順位付けする。盲検試験では化学者がその一段階反応予測を好んだ。

  2. NVIDIA:AIの安全は工学の問題、エージェント各層での対処方法

    NVIDIAはAIの安全を工学の問題として扱い、明確な安全要件、実行可能な制御、責任者、保護の有効性の証拠を求める。オープンソースのNVIDIA OpenShellは推論範囲の外で方針を強制し、サンドボックス実行を提供する。Cisco DefenseClawが統制層を追加し、JFrogはOpenShellによるエージェント技能の走査と検証を統合する。

  3. Import AI 473:米国の超知能戦略、人の脳組織を持つマウス、機械解釈学

    RANDの長文は、不確実な超知能への道で米国が「行動の自由」戦略を採るよう提案した。AI安全への投資、安全構造、国家安全保障の再編、市民の対応力で全選択肢を残す。共存、拒否、加速の3分類・7原型と、危険の近さ、共存可能性、制約可能性、決定的戦略優位、抑制可能性の5不確実性を整理する。

  4. MIT Technology Review、米国境の「仮想壁」沿いの初の死亡地図を制作

    MIT Technology ReviewとTimes of San Diegoは15か月をかけ、2015年以来の移民死亡事例から監視塔近くの死亡の初の包括的地図と分析を作った。テキサス17郡の保安官事務所に記録を請求し、14郡から4000ページ超を得た。AnthropicのClaude APIで遺体発見地点の座標を抽出し、人が抽出例を確認した。

  5. 大企業の社内成果がすべてClaude Code製だとエンジニアが説明

    入社半月のエンジニアは、仕様、コード、テスト、PRD、チケットと対応、報告などがすべてClaude Codeで作られると述べた。誰も好んでいないが、最大限の納品を求められる。上層部からコードの公開はボトルネックでないと何度も聞き、L1からL7まで皆が1日12~13時間、Enterを押すだけの仕事をし、誰も内容を読まないという。

  6. MCP は時代遅れか、Simon Willison は価値が過小評価と反論

    Simon Willison は「MCP はもう悪い案」との見方に反論し、無制限のネット接続を持つ Claude Code や Codex などの端末エージェント以外では代替できない価値があるとした。外部サービスへのアクセス制限、API キーに直接触れさせない運用、接続・認証の UI、強い監査ログを提供しやすくする。完全なコーディングエージェントが不要とするだけで時代遅れと断じると、他の用途を見落とすとする。

  7. Simon Willison、Codex RemoteのAPIキー設定画面llm-keys-ui 0.1を公開

    Simon Willisonは遠隔機でAPIキーを設定するプラグインllm-keys-ui 0.1を公開した。uvx --with llm-keys-ui llm keys-ui --allで画面を起動し、ローカルネットワークかTailscale端末のIPでキーを保存できる。ChatGPTやエージェントの会話へ直接貼る必要がない。

9月20日

日曜日

9月19日

土曜日

9月18日

金曜日
  1. GitHub Podcast、5つのAI論争を検討:コードを読むべきか、RAGは終わりか、SkillsはMCPをなくすか

    GitHub Podcastの最新回はAI開発の5つの話題を検討する。AIコードは読み、責任を持つ必要があるが、確認の度合いはリスクに応じる。Skillsはチームの経験を包装したもの、MCPはツールとデータをつなぐ標準で、組み合わせられる。RAGは終わっておらず、学習外の情報を提供し、エージェント、Skills、MCPと同じワークフローに共存できる。

  2. AINews:Claude Code Projects、Jev 分類モデルなどエージェントの進展

    Anthropic は Claude Code に Projects を導入した。一つの会話から並列クラウドセッションを派生し、スレッド間で文脈を渡し、ユーザーが離れた後も動く。Google は Gemini の管理エージェントに Antigravity ベースのハーネスを更新し、Credentials API と Files API を追加した。費用は最大30%減り、キャッシュヒット率は22%向上するとする。

9月17日

木曜日

9月16日

水曜日