本文へ移動

すべての AI 動向

今日 31 件

9月8日

火曜日

9月7日

月曜日

9月6日

日曜日

9月5日

土曜日
  1. GitHub、複数モデルの編成で最先端のコーディング品質を実現するProject HydraFusionを公開

    GitHubはProject HydraFusionの研究プレビューを公開した。実行時の複数モデルの編成でCopilotに最先端のコーディング能力を提供する。Copilot CLIで/experimentalから有効化でき、各モデルが実際に使うトークンの標準料金で課金される。

9月4日

金曜日
  1. Google Research、集団をまたぐポリジェニックリスクスコアの転移学習を研究

    Google Research は UK Biobank の欧州系集団と Biobank Japan の約20万人の日本人データで、八つの臨床指標について PRS の集団間転移を評価した。対象集団が15,000人以上では、その集団専用モデルが欧州データとの混合訓練を上回る。一方、遺伝的相関が強い形質では、対象が25,000~40,000人超になるまで欧州データの利点が続く。

  2. GitHub Copilot app入門:複数エージェントを同時に動かす方法

    Copilot appは独立したGit worktreeで複数セッションを同時に動かし、干渉せず各文脈を保つ。sessions viewで名前と進捗を見て、いつでも切り替え、中断から再開でき、依頼を説明し直す必要はない。tailspin-toysでfunded sort機能、アクセシビリティー確認、テストを同時進行する例を示す。

  3. GoogleとHHMI Janeliaら、雄ショウジョウバエの完全な脳コネクトームを公開

    Google ResearchはHHMI Janelia、ケンブリッジ大学などと協力し、Cellに論文を発表して、雄ショウジョウバエの脳と中枢神経系の完全なコネクトームを公開した。166,000超のニューロンと1.25億のシナプス結合を含み、ニューロン数ではこれまでで最大の脳地図である。

9月3日

木曜日
  1. Google DeepMind、Fairwind Programで政府と企業にGemini 3.8 Flash Cyberの防御能力を限定公開

    GoogleはFairwind Programを開始し、Google Cloud顧客、政府機関、サイバーセキュリティのパートナーに防御能力へのアクセスを限定提供する。第1弾としてGemini 3.8 Flash CyberモデルとCodeMenderツールチェーンを提供し、脆弱性の自律的な発見、検証、修正に用いる。

9月2日

水曜日
  1. Hugging Face、LLMベンチマークが何を測るか監査するBenchMIRTを公開

    Hugging Faceは多次元項目反応理論(MIRT)で個別プロンプト単位のベンチマークを監査するBenchMIRTを公開した。安全性と汎用推論の2主要次元を分離する。100モデル、16ベンチマーク、34K超の設問で学習し、評価対象を教えずとも安定して2次元を再現した。BBQやWMDPなどの安全性の得点は汎用推論との関係が強く、単一得点が複数の信号を混ぜる可能性を示す。

9月1日

火曜日
  1. Hugging Face、@huggingface/kernelsを公開:207のWebGPUカーネルとFleetベンチマーク

    Hugging FaceのWebAIチームは、Hubから最適化済みWebGPUカーネルを読み込み実行する軽量ライブラリ@huggingface/kernelsを公開した。初期の207カーネルも、それぞれ独立したリポジトリでApache-2.0ライセンスにより公開した。

8月31日

月曜日

8月28日

金曜日
  1. Google Earth AI、地理空間モデリング全工程を自動化するPPEを導入

    Google ResearchはGoogle Earth AIに実験的研究機能Planetary Prediction Engine(PPE)を導入した。自然言語の質問に基づき、地理空間データの発見、特徴量設計、モデル学習と評価を自律的に進め、報告を生成する。数週間の手作業を要したデータ処理を数分に縮める。

8月27日

木曜日
  1. Google DeepMind、世界初の二重盲検AI評価を試行

    Google DeepMindは、専有のフロンティア級AIモデルを対象とする世界初の二重盲検評価を発表した。外部評価を暗号技術で隔離した環境に限定し、モデルが事前に試験問題へ接触することを防ぐ。シンガポールのAI安全研究所、OpenMined、AVERI、MLCommonsと協力し、プライバシーを保護した環境で非公開ベンチマークを使いGemini Flash Liteを評価する。

8月26日

水曜日
  1. Google、XRエージェントの会話に空間的ジェスチャーを加えるAgentHandsを公開

    GoogleはCHI 2026論文の研究試作AgentHandsを公開した。LLMの推論をXRヘッドセット内の音声と同期する手の動きに変え、3D空間で指示や物の操作を実演する。環境認識、ジェスチャー事象庫、埋め込み推論、ローカル同期実行の4モジュールで、指示、形の表現、感情表現に対応する。N=12の利用者研究では、音声だけより空間的な参照が有意に改善した。

8月25日

火曜日

8月24日

月曜日
  1. Import AI 470:機械に権利は不要、SPADE の訓練環境生成、Hawkeye の GPU カーネル

    METR の研究では、AI の科学的発見への影響は一様でない。2026年の脆弱性報告は2025年より大幅に速く、数学はわずかな加速にとどまり、AI 研究自体のアルゴリズム進歩には有意な加速がない。複数大学のチームは LLM が実行可能な訓練環境の生成と解法を交互に行う SPADE を提案した。Qwen3-30B-A3B のゲーム環境平均点は58.3で、基準より8.1上がった。

8月22日

土曜日
  1. Google、ウェアラブルデータから候補を選ぶBiomarker Discovery Frameworkを公開

    Googleは、人の監督の下で候補バイオマーカーの優先付けを反復研究として進める複数エージェントのBiomarker Discovery Frameworkを公開した。3コホートの計9279観測から、精神的健康の候補41件と代謝の候補25件を自動発見した。睡眠時間の変動とPHQ-8重症度の関係(ρ = 0.252)などを含む。