OpenAI、クラウドエージェント構築向けAgents APIを公開
OpenAIはクラウドエージェントの構築と運用開始に向け、Codexハーネスを基盤とするマネージドサービスAgents APIを公開した。オーケストレーション、長時間セッション、ツール呼び出しに対応する。
OpenAIはクラウドエージェントの構築と運用開始に向け、Codexハーネスを基盤とするマネージドサービスAgents APIを公開した。オーケストレーション、長時間セッション、ツール呼び出しに対応する。
MITの研究者がGPT-5.6 SolとCodexを使い、量子計算実験を自律実行し、結果の分析と量子ビットの校正を行った。
OpenAIはChatGPT Images 2.5を公開した。アイデア、スケッチ、参考写真を、より個性的で洗練された画像に変換でき、ユーザーの考えをよりよく表す画像になるという。
1Passwordの技術者はCodexで新機能と社内ツールを迅速に作り、厳格な安全方針を保って本番利用可能にし、開発効率を21%高めた。
GitHubはProject HydraFusionの研究プレビューを公開した。実行時の複数モデルの編成でCopilotに最先端のコーディング能力を提供する。Copilot CLIで/experimentalから有効化でき、各モデルが実際に使うトークンの標準料金で課金される。
Copilot appは独立したGit worktreeで複数セッションを同時に動かし、干渉せず各文脈を保つ。sessions viewで名前と進捗を見て、いつでも切り替え、中断から再開でき、依頼を説明し直す必要はない。tailspin-toysでfunded sort機能、アクセシビリティー確認、テストを同時進行する例を示す。
Hugging FaceはClaude Code、Codex、pi、Hermesなどに永続メモリーを提供するfunesを公開した。ローカルの既存セッションから索引を作り、既定では埋め込みと再ランキングもローカルで行う。
GoogleはFairwind Programを開始し、Google Cloud顧客、政府機関、サイバーセキュリティのパートナーに防御能力へのアクセスを限定提供する。第1弾としてGemini 3.8 Flash CyberモデルとCodeMenderツールチェーンを提供し、脆弱性の自律的な発見、検証、修正に用いる。
Google DeepMindはGemini 3.7 Flash、3.6 Flash、3.5 Flash-Liteにエージェント型動画理解を導入した。動画分析のトークン消費を最大88%、費用を最大66%削減し、正確さを最大7%高める。
Hugging FaceのWebAIチームは、Hubから最適化済みWebGPUカーネルを読み込み実行する軽量ライブラリ@huggingface/kernelsを公開した。初期の207カーネルも、それぞれ独立したリポジトリでApache-2.0ライセンスにより公開した。
Hugging FaceはGradioにgr.Workflowを導入した。複数段階のAIパイプラインを型付きノードのグラフで表し、ドラッグ可能な画面を提供する。各ノードを実行でき、中間結果もすべて見える。
Mistralは複数段階の検索ループで情報を探し、調べ、検証する検索層Agentic Searchを公開した。Mistral Search Toolkitで提供し、StudioとVibeのLibrariesにも組み込む。
OlmoEarth Studioは埋め込みの計算と出力に対応した。UIかAPIで地域、時期、エンコーダー版、解像度を選び、Cloud-Optimized GeoTIFF(COG)を得られる。
MistralはAI主権を進める3施策を発表した。Regional Endpointsは正式提供となり、欧州か米国で推論するか選べる。Priority Tierは公開プレビューで、重要業務向けに確約サービス水準、独自の速度制限、稼働率SLAを提供する。
BasetenがHugging Face HubのInference Providerに加わった。初期は会話と文字生成に対応し、Kimi K3、DeepSeek V4 Flash、GLM-5.2などのオープンウェイトモデルを利用できる。
Microsoft ResearchはオープンソースのOrchardフレームワークを公開した。中心はKubernetes環境サービスOrchard Envで、タスク間で環境、データパイプライン、評価手順を再利用し、Codex、OpenClaw、ZeroClawなどの実際の配置フレームワーク内で直接エージェントを学習できる。
Hugging FaceはDiffusersにNunchaku Liteを導入した。from_pretrained()で量子化チェックポイントを直接読み込み、独自パイプラインやローカルのCUDAコンパイルを必要としない。
Hugging Face は Grabette を公開した。手持ちグリッパーと2台のカメラで操作の手本を記録し、ロボットや遠隔操作装置なしでロボットに使えるデータセットを作る。手持ち機の部材費は約490ユーロ、対応する電動グリッパー Gripette は約120ユーロ。ハードウェア CAD、Raspberry Pi の収集ソフト、ブラウザー処理の手順をすべて公開する。
Google DeepMindはインドでATL Saathiの試行を始めた。GeminiによるウェブアプリがAtal Tinkering Labsの教育者に24時間365日の授業準備・研修助手を提供し、当初は100校を対象とする。
Mistral Studio は Prompts と Skills の集中管理を顧客に提供した。各資産には版の履歴、明確な責任者、追跡可能性がある。不変版、ロールバック、分類タグ、監査ログで AI の行動を管理・発見でき、Observability で本番出力を該当版まで追える。Skills は Studio から MCP サーバーとして直接呼び出せ、本番で同じ管理対象資産が実行される。
Hugging Faceは、vLLMのtransformersモデリングバックエンドが複数のLLM構造で、vLLMの手書きネイティブ実装と同等以上の処理速度に達したと発表した。torch.fxによる静的グラフ解析とastによるソース書き換えで、推論向けの層融合を実行時に動的適用し、専用コードと同等の性能を実現する。
Hugging FaceとAmazon SageMaker AIはディープリンク連携を導入した。対応モデルのページでCustomize on SageMaker AIかDeploy on SageMaker AIを押すと、モデルの事前読み込みと環境設定を済ませたSageMaker Studioへ直接入れる。
MicrosoftはBuild 2026でFoundry Managed ComputeとHugging Faceモデル集を発表した。Hugging Faceのオープンウェイトモデルを毎週更新し、FoundryのマネージドGPU基盤へワンクリックで配置できる。
Hugging FaceはLeRobot v0.6.0を公開し、ロボット学習の循環に向け、世界モデル方策VLA-JEPA、FastWAM、LingBot-VA、新たなVLA群GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT、統一報酬モデルAPIのRobometerとTOPRewardを導入した。
Hugging Face と SkyPilot は連携を公開した。hf:// URL と既存の HF_TOKEN で Hugging Face Bucket または任意のモデル・データセット・Space リポジトリーを SkyPilot の作業にマウントし、20超のクラウド、Kubernetes、Slurm、ローカル環境で実行できる。
Hugging Face は Kernels に「kernel」という新リポジトリー型と、信頼できる公開者・コード署名を導入した。既定では信頼できる公開者の kernel のみ読み込み、他の出典には trust_remote_code=True の明示設定が必要だ。
Hugging Face と Cerebras はリアルタイム音声対音声パイプラインを共同で実演した。Cerebras で Gemma 4 31B の推論を加速し、Nvidia Parakeet の音声認識と Alibaba Qwen3TTS の音声合成をつなぐ。
Google Researchは建物別の屋根反射率(albedo)データを2024年の14都市から9か国50都市超へ広げ、新しいHeat Resilience Earth Engine Appで公開した。
Every Eval Ever(EEE)と Hugging Face Community Evals は相互接続し、評価結果を双方に公開して完全な記録へリンクできる。EEE には31の報告形式から、22,000超のモデルと2,200基準にまたがる約229,000の結果がある。
Google DeepMindはcomputer useをGemini 3.5 Flashの内蔵ツールとして統合した。従来は独立したGemini 2.5 computer useモデルとしてのみ提供していた。
Mistral AIはConnectorsに新機能を追加した。ワークスペース・組織別のアクセス権と個別ツールの有効・無効を設定する管理制御、およびコネクタースコープ付きAPIキーは一般提供となった。
Google は Gemini Enterprise Agent Platform で Agentic RAG による複数コーパス検索の公開プレビューを始めた。Orchestrator、Planner、Query Rewriter、Search Fanout、Sufficient Context Agent などが協働し、複数情報源をまたぐ多段階クエリーを処理する。
Google Researchは水文モデリング枠組みをGitHubでApache 2.0として公開した。各国の気象・水文機関がAI洪水予測を業務に組み込める。PyTorchを使うPythonパッケージで、LSTMを採用し、Caravanデータで学習・微調整できる。対話型のチュートリアルnotebookと動画も付属する。
Google ResearchはI/O 2026でGemini for Scienceの実験ツール群を公開した。ERAとAlphaEvolveのComputational Discovery、Co-ScientistのHypothesis Generation、NotebookLMのLiterature Insightsを含む。
MistralはAI Now Summit 2026で産業工学向けAIスタックを公開した。Airbus、BMW、ASMLと協力し、独自データと知的財産の管理を維持しながら、設計、シミュレーション、生産を最適化する。
Mistral は Le Chat を仕事とコーディング向けの統合 AI エージェント Vibe に更新した。従来の会話、設定、サブスクリプションプランはすべて維持する。
Mistral AIはSearch Toolkitを公開プレビューで提供した。AIアプリの本番用検索パイプライン向けの組み合わせ可能な枠組みで、取り込み、検索、評価を共通インターフェースに統合する。オープンソースで、クラウド、ローカル、エッジに配置できる。
Mistral は Emmi AI を統合後、AI ネイティブ産業設計向けの物理 AI 基盤を公開した。ASML、Airbus、Safran、Siemens Energy が協力する。形状と境界条件から物理場を直接予測し、単一 GPU の1回の順伝播で数秒で終える。従来の CFD/FEM は設計ごとに数時間から数週間かかる。設計反復を速める用途で、検証や特殊条件には従来ソルバーを残す。
MistralはStudioにConnectorsを公開した。内蔵コネクターと独自MCPをAPI/SDK経由で全モデルとエージェント呼び出しに使える。現在は公開プレビューだ。
Co-Scientistは数万の論文を調べ、試験可能な新しい遺伝要因を20以上提案して細胞老化逆転の研究を加速している。一部は実験室で細胞を若い状態へ導き、全体的な機能を改善すると確認された。従来6か月かかったスクリーニングデータの分析も数日に縮める。