Hugging Face モデルページに Every Eval Ever の評価結果
Every Eval Ever(EEE)と Hugging Face Community Evals は相互接続し、評価結果を双方に公開して完全な記録へリンクできる。EEE には31の報告形式から、22,000超のモデルと2,200基準にまたがる約229,000の結果がある。
Every Eval Ever(EEE)と Hugging Face Community Evals は相互接続し、評価結果を双方に公開して完全な記録へリンクできる。EEE には31の報告形式から、22,000超のモデルと2,200基準にまたがる約229,000の結果がある。
Google DeepMindはcomputer useをGemini 3.5 Flashの内蔵ツールとして統合した。従来は独立したGemini 2.5 computer useモデルとしてのみ提供していた。
Mistral AIはConnectorsに新機能を追加した。ワークスペース・組織別のアクセス権と個別ツールの有効・無効を設定する管理制御、およびコネクタースコープ付きAPIキーは一般提供となった。
Google は Gemini Enterprise Agent Platform で Agentic RAG による複数コーパス検索の公開プレビューを始めた。Orchestrator、Planner、Query Rewriter、Search Fanout、Sufficient Context Agent などが協働し、複数情報源をまたぐ多段階クエリーを処理する。
Google Researchは水文モデリング枠組みをGitHubでApache 2.0として公開した。各国の気象・水文機関がAI洪水予測を業務に組み込める。PyTorchを使うPythonパッケージで、LSTMを採用し、Caravanデータで学習・微調整できる。対話型のチュートリアルnotebookと動画も付属する。
Google ResearchはI/O 2026でGemini for Scienceの実験ツール群を公開した。ERAとAlphaEvolveのComputational Discovery、Co-ScientistのHypothesis Generation、NotebookLMのLiterature Insightsを含む。
MistralはAI Now Summit 2026で産業工学向けAIスタックを公開した。Airbus、BMW、ASMLと協力し、独自データと知的財産の管理を維持しながら、設計、シミュレーション、生産を最適化する。
Mistral は Le Chat を仕事とコーディング向けの統合 AI エージェント Vibe に更新した。従来の会話、設定、サブスクリプションプランはすべて維持する。
Mistral AIはSearch Toolkitを公開プレビューで提供した。AIアプリの本番用検索パイプライン向けの組み合わせ可能な枠組みで、取り込み、検索、評価を共通インターフェースに統合する。オープンソースで、クラウド、ローカル、エッジに配置できる。
Mistral は Emmi AI を統合後、AI ネイティブ産業設計向けの物理 AI 基盤を公開した。ASML、Airbus、Safran、Siemens Energy が協力する。形状と境界条件から物理場を直接予測し、単一 GPU の1回の順伝播で数秒で終える。従来の CFD/FEM は設計ごとに数時間から数週間かかる。設計反復を速める用途で、検証や特殊条件には従来ソルバーを残す。
MistralはStudioにConnectorsを公開した。内蔵コネクターと独自MCPをAPI/SDK経由で全モデルとエージェント呼び出しに使える。現在は公開プレビューだ。
GoogleはGeminiで科学コードを作成・最適化する研究ツールEmpirical Research Assistance(ERA)を公開した。関連論文は本日Natureに掲載され、Gemini for Scienceの一部として世界の科学者に提供される。
Co-Scientistは数万の論文を調べ、試験可能な新しい遺伝要因を20以上提案して細胞老化逆転の研究を加速している。一部は実験室で細胞を若い状態へ導き、全体的な機能を改善すると確認された。従来6か月かかったスクリーニングデータの分析も数日に縮める。
Google DeepMindは実験的プロトタイプProject GenieにStreet View groundingを導入した。Mapsのピンで米国内の実在地点を選び、スタイルとキャラクターを指定すると、Genieが実写を出発地点の基準にした操作可能な世界を生成する。
Google DeepMind は Gemini for Science を公開し、Google Labs に三つの実験ツールを導入した。Co-Scientist に基づく Hypothesis Generation。
Googleはコンテンツの透明性・検証ツールをSearch、Gemini、Chrome、Pixel、Cloudへ拡大すると発表した。SynthIDは1000億超の画像と動画、6万年分の音声に透かしを付けた。Geminiアプリ内のSynthID検証は5000万回利用され、今後数週間でSearchとChromeにも導入される。
Cambridge教授Clare BryantはGoogle Co-Scientistで、インフルエンザなどの種間伝播で敗血症を起こす分子機構を研究する。生成・順位付けされた仮説で未注目のタンパク質を特定し、具体的なアミノ酸部位まで絞った。チームは変異を持つ細胞株で検証しており、2~3年の実験を6か月で完了できる見込みだ。
エディンバラ大学は Google Co-Scientist で MASH 肝疾患を研究した。肝生物学と薬理の証拠を統合し、NLRP3 インフラマソームを炎症と代謝の重要な橋渡しと特定して、resmetirom が適格患者の一部にしか効かない理由を説明した。仮説は実験で検証され、標的を絞った二重療法につながる可能性がある。
Google DeepMindのCo-ScientistはMITの機械工学者Ritu RamanによるALS文献の整理を速め、考えを検証可能な仮説に変え、実現性とリスク・利益で順位付けする。
Mistral AIはWorkflowsの公開プレビューを開始した。企業AIのオーケストレーション層として、永続実行、可観測性、耐障害性を備え、AIの処理を概念実証から本番へ進める。
Google ResearchはGoogle PhotosのAuto frameに、撮影後のカメラ視点を変える新手法を導入した。内部の3D点マップ推定モデルで場面と焦点距離を再構成し、生成型潜在拡散モデルで新たな視点から露出する空白領域を埋める。顔の位置と広角の歪みを自動検出して理想的な構図を提案する。人物を含む写真には既に自動適用され、ユーザーはAuto frameの候補から構図を変えた版を選べる。
Mistral AIは人の開発者とコーディングエージェント向けSpaces CLIを公開した。spaces initやspaces devなどで雛形作成、開発環境、配置を進め、対話プロンプトごとに対応するflagがあるため、エージェントが全工程を自律実行できる。initはcontext.jsonとAGENTS.mdを生成し、構造と規則を伝える。
Google DeepMindはGeminiで動く実験的なAIポインターを公表した。指しているものだけでなく、ユーザーにとっての意味も理解する。作業を中断しないこと、周囲の視覚・意味的文脈を捉えること、「これ」「あれ」のような自然な略し方に対応すること、ピクセルを場所、日付、物体など操作可能な実体へ変えることの4原則を示した。
GoogleはGeminiとWebXR、three.js、LiteRT.jsを使うXR Blocksを組み合わせたVibe Coding XRを公開した。自然言語の指示を物理的な状況を認識するAndroid XRアプリに変え、公式には60秒以内で完了する。
Mistral AI は独自知識に基づく最先端級 AI モデル構築システム Forge を公開した。事前訓練、事後訓練、強化学習に対応し、dense と MoE の構造を扱う。必要に応じてマルチモーダル入力にも対応し、企業内の基盤でモデルの訓練とガバナンスを行える。
Google は Flood Hub で都市の鉄砲水予報を公開した。新しい AI 手法により、都市部で最大24時間先の鉄砲水リスクを予測できる。
Google Researchは大規模な公開音声データセットWAXALを公開した。初期版は1億人超が使うサハラ以南アフリカの27言語を対象とし、CC-BY-4.0で提供する。
Mistral は Devstral 2 シリーズによる端末コーディングエージェント Mistral Vibe 2.0 を公開した。独自サブエージェント、複数選択式の確認、スラッシュコマンドのスキル、統合エージェントモード、自動更新を追加する。
Mistralは企業チーム向けの本番用AIプラットフォームMistral AI Studioを公開した。Observability、Agent Runtime、AI Registryの3つを柱とする。
Le Chat Memoriesは自動保存、賢い想起、出所の常時表示を組み合わせる。記憶を停止し、記憶を使わない非公開会話を始め、個別に編集・削除、出力や他所からの入力もできる。同時導入のMemory Insightsは本人のデータから傾向と要約を示す。今後は分類整理と即時忘却に対応する。
Mistral は Le Chat に MCP ベースの安全なコネクター20超の beta カタログを導入した。データ、生産性、開発、自動化、ビジネスなどを扱い、Databricks、Snowflake、GitHub、Atlassian、Asana、Outlook、Box、Stripe、Zapier などにつなぐ。独自 MCP コネクターや任意のリモート MCP サーバーも追加できる。
Mistral AIはCodestral 25.08と、Codestral、Codestral Embed、Devstral、Mistral Code IDEプラグインを含む企業向けの完全なコーディングスタックを公開した。
MistralはLe Chatに、プレビューのDeep Research、Voxtralによる音声モード、Magistralによる多言語推論、会話を整理するProjects、Black Forest Labsと協力した画像編集などを追加した。
Mistral AIはGPU、編成、API、製品、サービスを含むプライベートな統合AI基盤Mistral Computeを公開した。ベアメタルサーバーからフルマネージドPaaSまで提供する。
MistralはCodestral、Codestral Embed、Devstral、Mistral Mediumの4モデルを統合したAIコーディング助手Mistral Codeを公開した。クラウド、専用容量、ローカルのエアギャップGPUへ配置でき、コードは企業の境界内に留まる。
Mistral AI は Agents API を公開した。自社言語モデルにコード実行、画像生成、文書ライブラリ、ウェブ検索のコネクターと MCP ツールを組み合わせ、会話をまたぐ永続記憶とエージェント編成を提供する。
Mistralは新しいMistral Medium 3で動く企業助手Le Chat Enterpriseを公開した。企業検索、エージェント作成、独自データとツールのコネクター、文書庫、独自モデル、ハイブリッド配置などを備え、全機能が今後2週間で順次利用可能になる。
Mistral AIは画像とPDFを読み、文字と画像を順番に交互出力するMistral OCR APIを導入した。Le Chatの数百万人にとって既定の文書理解モデルになっている。