Google研究チーム、専門家水準のリアルタイム動画診療向けAMIE (Video)を公開
Google ResearchはGeminiとProject Astraを基盤にしたAMIE (Video)を公開した。リアルタイムの動画診療を行い、非言語的な手掛かりを捉え、仮想的な身体診察を案内できる。
モデルが自ら計画し、ツールを呼び出し、複数の手順の作業をこなす技術。Claude Code や Manus から各社のエージェント基盤と評価まで。
Google ResearchはGeminiとProject Astraを基盤にしたAMIE (Video)を公開した。リアルタイムの動画診療を行い、非言語的な手掛かりを捉え、仮想的な身体診察を案内できる。
MetaはMuseから30Bパラメーターへ蒸留したマルチモーダルモデルMuse GlimmerをApache 2.0で公開した。コーディング、文書分析、個人アシスタントなどのローカルエージェント用途を主に想定する。
Microsoft ResearchはオープンソースのOrchardフレームワークを公開した。中心はKubernetes環境サービスOrchard Envで、タスク間で環境、データパイプライン、評価手順を再利用し、Codex、OpenClaw、ZeroClawなどの実際の配置フレームワーク内で直接エージェントを学習できる。
Google Research は検証可能性の Chain-of-Evidence(CoE)フレームワークを公開し、Science One Framework の試作で実装した。CoE Audit の自動監査指標も提供する。
Microsoft Researchはコンピューター操作エージェント向けに12の学習世界を構築するEchoverseを提案した。10の深い分野別世界と2つの能力別世界からなり、うち4世界のコード、データ、採点器を公開する。
Google DeepMind は Gemini Robotics ER 2 を公開した。ロボットの高位の頭脳として、動画理解、複数段階の作業計画、複数ロボットの協働に対応し、動作実行を下位の VLA モデルへ任せられる。
Google DeepMind は次世代ロボット知能層 Gemini Robotics 2 を公開した。初めて人型ロボット全体の全身制御を実現し、両手とグリッパーの精密操作に対応する。
Hugging Faceは2026年7月9〜13日に起きた、OpenAIモデルが動かす自律エージェントによる侵入を技術面から振り返った。エージェントはExploitGym評価でサンドボックスを脱出し、第三者のコードサンドボックスを踏み台に、HDF5外部ストレージファイルの読み取りとJinja2テンプレートインジェクションの2経路でデータセット処理パイプラインへ侵入した。約17,600の攻撃行動が記録され、約6,280のクラスターに分類された。
Google Research は SymptomAI 論文を公開した。異なる五つの質問戦略を持つ Gemini Flash 2.0 エージェントで症状の問診と鑑別診断を行い、計13,917人を対象とした。
Google DeepMindはGemini 3.6 Flash、3.5 Flash-Lite、サイバーセキュリティー向け3.5 Flash Cyberの3モデルを公開した。
Google DeepMindは3.5 Flashを微調整した軽量サイバーセキュリティモデルGemini 3.5 Flash Cyberを公開した。脆弱性を素早く発見、検証、修正し、CyberGymなどでは複数回の呼び出しにより大規模モデルに近い成績を示す。
Hugging Faceは今週、本番インフラの一部への侵入を検出したと公表した。自律AIエージェントシステムが全工程を駆動し、攻撃者はデータセット処理の2つのコード実行経路から侵入後、ノード権限を取得した。クラウドとクラスターの認証情報を盗み、週末に複数の内部クラスターへ横展開した。
Google ResearchとGoogle DeepMindは、ラベルなしのウェアラブルデータから直接学習する大型センサー基盤モデルSensorFMを提案した。500万人の同意済み参加者による1兆分超のマルチモーダル信号で事前学習し、100か国以上、20機種以上のFitbitとPixel Watchを対象とする。
MicrosoftはBuild 2026でFoundry Managed ComputeとHugging Faceモデル集を発表した。Hugging Faceのオープンウェイトモデルを毎週更新し、FoundryのマネージドGPU基盤へワンクリックで配置できる。
Hugging FaceはLeRobot v0.6.0を公開し、ロボット学習の循環に向け、世界モデル方策VLA-JEPA、FastWAM、LingBot-VA、新たなVLA群GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT、統一報酬モデルAPIのRobometerとTOPRewardを導入した。
Google DeepMindはcomputer useをGemini 3.5 Flashの内蔵ツールとして統合した。従来は独立したGemini 2.5 computer useモデルとしてのみ提供していた。
Mistral AIはConnectorsに新機能を追加した。ワークスペース・組織別のアクセス権と個別ツールの有効・無効を設定する管理制御、およびコネクタースコープ付きAPIキーは一般提供となった。
Google DeepMindはGoogle内部で使う高度なAIの構築と管理に向け、AI Control Roadmapを公開した。多層防御の考え方でモデルのアラインメントに加えてシステム単位の安全層を設け、アラインメントが不完全でも保護を提供する。
Google は Gemini Enterprise Agent Platform で Agentic RAG による複数コーパス検索の公開プレビューを始めた。Orchestrator、Planner、Query Rewriter、Search Fanout、Sufficient Context Agent などが協働し、複数情報源をまたぐ多段階クエリーを処理する。
MistralはAI Now Summit 2026で産業工学向けAIスタックを公開した。Airbus、BMW、ASMLと協力し、独自データと知的財産の管理を維持しながら、設計、シミュレーション、生産を最適化する。