Google DeepMind、フロンティアモデル「Gemini 4 Argon」を発表
Google DeepMindは新たなフロンティアモデル「Gemini 4 Argon」を発表した。まずFairwind Programの信頼できるサイバー防御担当者に開放し、その後開発者、企業、消費者向けに提供する。価格は入力100万トークンあたり2ドル、出力100万トークンあたり10ドルから。
Google DeepMindは新たなフロンティアモデル「Gemini 4 Argon」を発表した。まずFairwind Programの信頼できるサイバー防御担当者に開放し、その後開発者、企業、消費者向けに提供する。価格は入力100万トークンあたり2ドル、出力100万トークンあたり10ドルから。
Amazon Bedrock Knowledge BasesにAgenticRetrieveStream APIが加わった。複数の要素を含む保険金請求に関する質問をサブクエリーに分解し、根拠が十分になるまで検索を繰り返して、引用付きの回答を生成する。
Microsoft Researchは、L1での太陽風観測、AE指数とDst指数の予報、各地の地質の電気伝導率データを使うエンドツーエンドの機械学習パイプラインを開発した。米国本土の66,935変電所について、30〜60分先の局地的な宇宙天気リスクを推定する。
NVIDIA の第26回大学院生奨学金プログラムが世界中から応募を受け付ける。AI、機械学習、自動運転、コンピューターグラフィックス、ロボティクス、医療、高性能計算などを対象に、学生1人当たり最大6万ドルを支援する。
AWSの公式ブログが、Amazon Bedrock AgentCore Runtime Instancesに3エージェントの音楽制作パイプラインを配置する例を紹介した。作曲エージェントはClaude Sonnet 4.6で音楽の制作要件を生成し、インスタンスのNVIDIA L4上でACE-Stepを実行して音声をレンダリングする。納品エージェントは共有ボリュームの.wavを読み、測定とDSP処理を行う。適合確認エージェントは独立して再測定し、楽曲ライブラリーとの和声的類似度を調べる。
CoreWeave は、Spectrum-X 102.4T Ethernet と組み合わせた NVIDIA Vera Rubin NVL72 システムが CoreWeave Cloud で利用可能になったと発表した。Cognition が本番環境でこのシステムを運用する最初の顧客となる。
Google DeepMindはSynthID Bioを公開し、透かし技術を合成生物学に導入した。生物のコードに知覚できない署名を埋め込むことで、生物学的な機能を維持しながら、デジタルモデルと合成された実物のタンパク質の両方で透かしを検証できるようにする。
Hugging Face は、客観的指標でオープンソース TTS モデルを評価する Open TTS Leaderboard を公開し、数週間の投票による評価を数時間に短縮する。Qwen3 ASR で WER/CER を算出し、H200 GPU で RTFx と TTFA を測定、WavLM 埋め込みで話者類似度 SIM を求め、多言語と音声クローンの比較に対応する。
Amazon Bedrock はインドで Anthropic の Claude Opus 5、Claude Sonnet 5、Claude Haiku 4.5 を提供し、地理的なクロスリージョン推論でデータをインド国内で処理する。
Amazon BedrockがソウルとシンガポールでAnthropic Claudeモデルのリージョン内推論に対応した。ソウルではClaude Opus 5とClaude Sonnet 5、シンガポールではClaude Sonnet 5を利用でき、いずれもbedrock-runtimeエンドポイントを通じて呼び出す。
GPT-6.1 SolがAmazon Bedrockで一般提供され、エージェント型コーディング、コンピューター操作、日常の専門業務に向けて推論能力を強化した。OpenAIによると、DeepSWE v1.1でGPT-6 Astraの約5分の1のタスク単価で同等の成績を達成し、GPT-6 Solの最高成績を6.4ポイント上回った。
Google Research は Diffusion Controller を提案した。拡散モデルのノイズ除去を連続制御問題として捉え直し、基盤モデルを凍結したまま軽量な「ステアリングダンパー」ネットワークで生成軌道を動的に調整する。Stable Diffusion v1.4 を HPS-v2 で評価したところ、完全に解放した版は基準モデルに対する勝率90%を達成した。内部ウェイトにアクセスできないクローズドモデルのカスタム制御にも対応する。
Amazon Quickのプロンプト設計は自然言語の依頼に対するAI機能の回答品質を左右する。公式の2部構成シリーズの第1部は、コンポーネントに共通する原則と再利用できる枠組みを扱う。CRISPEは文脈と制約、役割と責任、意図と入力、手順と範囲などを含み、抽象的な説明より具体化、業務の文脈、例示が有効だと強調する。
AWSがAmazon Quick各コンポーネントのプロンプトの書き方を解説した。Quick Researchでは目的、対象者、期間を明確にし、サブ質問を自ら分解してデータソース(Quick Index)を限定する必要がある。
Amazon Quick と Amazon Bedrock AgentCore による契約分析基盤は、AI エージェントが契約 PDF から八つの重要項目を抽出し、独立して検証する。署名認識の相違は Amazon Textract が判定し、結果を Amazon Aurora PostgreSQL に保存する。
Condé NastはAWS生成AIイノベーションセンター(GenAIIC)と協力し、Amazon BedrockとAmazon OpenSearch Serviceを基盤にマルチモーダル動画検索を構築した。映像、音声、文字起こしを一緒に符号化するため、TwelveLabs Marengo埋め込みモデルを採用した。
NVIDIAはオープンソースの表形式基盤モデルKumo Tabularを公開した。ラベル付きの表の行を入力すると、学習、調整、特徴量設計なしに、単一の順伝播で新しい行のラベルを予測し、分類と回帰に対応する。28M〜215Mの3サイズを提供し、人工合成の表のみで事前学習した。商用利用可能なOpenMDW-1.1ライセンスを採用し、TabArena、BeyondArena、TALENT、ScoringBenchの4ベンチマークで首位だった。
Microsoft Researchは生物学の複雑さを扱うAI研究システムQuineを公開した。配列、構造、機能、細胞状態、画像などのマルチモーダルデータで学習した生物世界モデルと、モデル、科学ツール、文献、実験担当者をつなぐ対話型ハーネスから構成される。
Hugging FaceはMCPエージェント向けの生成後検証層ProvenanceGuardの論文を公開した。ツール出力の出所を保持し、「事実は正しいが帰属先が違う」情報源間の混同を検出する。医療エージェントの実際の281トレースで、専門家が阻止すべきと判断した139主張のうち138件を阻止した。出所識別の正確さは約86%で、4種類の検証器との比較で最高得点だった。
OpenAI が GPT-6.1 Sol を発表した。公式は Astra に近い知能水準を持ち、コーディング、コンピューター操作、専門業務の場面に対応するとしている。このモデルの API 入力・出力トークン価格は Astra の標準価格の5分の1。
OpenAI が DevDay 2026 の振り返りを公開し、GPT-6 Astra、ChatGPT、Codex、API、安全性、開発者向けの新ツールなど20以上の発表をまとめた。原文は概要のみで、各アップデートの詳細には触れていない。
OpenAIが能動型アシスタント「dots」を発表。複雑なプロジェクトや日常的なタスクで作業を継続的に進められる。公式は、dotsによってユーザーが作業の進行過程で制御権を保てるとしている。
xAIのGrok 4.7がAmazon Bedrockで提供され、500Kトークンのコンテキストウィンドウとlow、medium、high、xhighの4段階で設定できる推論強度を備える。Responses、Chat Completions、Converse APIに対応する。
Microsoft初の東南アジア研究所であるMSRA – Singaporeは、設立以来1年間、次世代AIモデルとエージェントシステム、分野別AI、AIネイティブな研究実践、人材のエコシステムの4分野に注力した。シンガポールの医療関係者とマルチモーダル医療AIや自己進化する診断エージェントを研究し、EDBと2026年2月に物流・交通AIの幹部円卓会議を開催した。
OpenAI はオーストラリア政府サイトに関わる事件を謝罪し、同国のサイバー防御を強化するため、より厳格な保護措置と支援策を公表した。
OpenAI は、最先端 AI 訓練の安全ケースに関する初期ガイドを公表した。技術的な保護措置、運用実務、ミスアライメント事件の調査という三つの面を扱い、最先端モデルの訓練段階の安全性を論証する枠組みを提供する。
AWSはClaude Sonnet 5.5をAmazon BedrockとClaude Platform on AWSで提供すると発表した。コーディングと知識労働向けのより効率的なSonnetと位置付け、多くのタスクで1件当たりの費用が低く、速度も速いとする。
AWSはSageMaker AIにQwen3-TTSを配置できるvLLM-Omni DLCを公開した。持続的な双方向接続1本で文字を入力しながら音声を出力し、生成が完了する前から再生を始められる。
AWSは、同じvLLM-Omni DLCイメージを使った2つのエンドポイントをSageMaker AIへ配置するチュートリアルを公開した。リアルタイム側はFLUX.2-klein-4Bで画像を生成し、非同期側はWan2.1-VACE-1.3Bで画像条件付き動画を生成する。テキスト指示からPNGを生成し、動きの指示とともにAmazon S3経由で動画側へ渡し、最終的にS3からMP4を取得する。例にはコマンドライン手順と任意のStreamlit画面を含む。
Mistral は Munich に新拠点を開き、Physics AI と産業 AI に特化する研究チームを組織した。2030年までに欧州で1 GW の計算容量を整備する計画だ。BMW と衝突シミュレーション・エンジニアリング AI、Siemens Energy と産業 AI 応用で連携し、Munich 工科大学(TUM)とは風洞施設を使う自動車空力デジタルツインを開発する。
Amazon Nova ActとAmazon Bedrock AgentCoreを使うエージェント駆動の合成監視構成は、SeleniumやPlaywrightのDOMセレクタースクリプトを自然言語の動作指示で置き換える。マルチモーダルLLMが画面のスクリーンショットを読み、ログイン、注文、決済などの重要な手順を実行する。
AWSはAmazon Textractアダプターのライフサイクルを複数アカウント間で自動管理する手法を公開した。アダプターIDをAWS Systems Manager Parameter Storeへ外出しすることで、本番環境の参照を停止やアプリ再配置なしに更新できる。従来数時間から数日かかっていた調整を数秒へ短縮する。
HはHolo4エージェントモデル群を公開した。27Bのdenseと35B-A3BのMoEの2規模がH Models APIで利用可能で、Hugging FaceではBF16、FP8、NVFP4、4-bit GGUF形式のウェイトを公開している。
OpenAI は Lenfest Institute との AI 連携・フェローシッププログラムを拡大し、500万ドルを投じ、最大500万ドル分のソフトウェア利用枠とエンジニアリング支援を提供する。
GPT-6 Astraは50シートの税務ワークブックをGPT-5.6 Solの2倍の速度で処理する。ユーザーの意図をより深く理解する能力により、Basisは実際の利用に対する信頼を高めた。
OpenAIはCodex Originalsの次の段階を開始し、Codexを使う開発者、研究者、クリエイターの実際の経験とプロジェクトを募集している。参加希望者は下のフォームから経験とプロジェクトの紹介を提出できる。
Proaction は Codex、GPT-Live-1、GPT-6 Astra で現代的な車両群管理サービスを構築・運営・販売し、売上が60%増え、75時間超を節約した。
Copilotアプリのcanvasはカスタマイズ可能な双方向の画面だ。エージェントとの会話で/create-canvasと自然言語の説明を入力するだけで、コードを書かずにカンバン、公開チェックリスト、ダッシュボードなどを作れる。拡張として保存し、プロジェクトと共有したり個人拡張として再利用したりできる。Awesome Copilotにはコミュニティーのテンプレートもある。
AWSはAmazon EKSでEFAとDeepEPを組み合わせ、MoE強化学習の学習を拡張する構成を示した。処理量は40%向上する。
Amazon SageMaker HyperPodでオープンソースRLフレームワークSkyRLを使い、GRPOで視覚言語モデルQwen3-VL-8Bをマルチモーダル強化学習によって追加学習した。固定の64迷路評価セットで、迷路の成功率を43.75%から95%超へ引き上げた。