本文へ移動

News の精選

Google DeepMind、フロンティアモデル「Gemini 4 Argon」を発表

Google DeepMindは新たなフロンティアモデル「Gemini 4 Argon」を発表した。まずFairwind Programの信頼できるサイバー防御担当者に開放し、その後開発者、企業、消費者向けに提供する。価格は入力100万トークンあたり2ドル、出力100万トークンあたり10ドルから。

Google DeepMind

Amazon Bedrock AgentCore Runtime Instancesで複数エージェントの音楽制作パイプラインを構築

AWSの公式ブログが、Amazon Bedrock AgentCore Runtime Instancesに3エージェントの音楽制作パイプラインを配置する例を紹介した。作曲エージェントはClaude Sonnet 4.6で音楽の制作要件を生成し、インスタンスのNVIDIA L4上でACE-Stepを実行して音声をレンダリングする。納品エージェントは共有ボリュームの.wavを読み、測定とDSP処理を行う。適合確認エージェントは独立して再測定し、楽曲ライブラリーとの和声的類似度を調べる。

AWS Machine Learning Blog

  1. NVIDIA と CoreWeave、Vera Rubin NVL72 を本番導入、最初の顧客は Cognition

    CoreWeave は、Spectrum-X 102.4T Ethernet と組み合わせた NVIDIA Vera Rubin NVL72 システムが CoreWeave Cloud で利用可能になったと発表した。Cognition が本番環境でこのシステムを運用する最初の顧客となる。

    NVIDIA Blog業界
  2. Google DeepMind、AI生成タンパク質に検証可能な透かしを埋め込むSynthID Bioを公開

    Google DeepMindはSynthID Bioを公開し、透かし技術を合成生物学に導入した。生物のコードに知覚できない署名を埋め込むことで、生物学的な機能を維持しながら、デジタルモデルと合成された実物のタンパク質の両方で透かしを検証できるようにする。

    Google DeepMindモデル
  3. GPT-6.1 Sol、Amazon Bedrockで一般提供開始

    GPT-6.1 SolがAmazon Bedrockで一般提供され、エージェント型コーディング、コンピューター操作、日常の専門業務に向けて推論能力を強化した。OpenAIによると、DeepSWE v1.1でGPT-6 Astraの約5分の1のタスク単価で同等の成績を達成し、GPT-6 Solの最高成績を6.4ポイント上回った。

    AWS Machine Learning Blogプロダクト
  1. NVIDIA、表形式予測の基盤モデルKumo Tabularを公開

    NVIDIAはオープンソースの表形式基盤モデルKumo Tabularを公開した。ラベル付きの表の行を入力すると、学習、調整、特徴量設計なしに、単一の順伝播で新しい行のラベルを予測し、分類と回帰に対応する。28M〜215Mの3サイズを提供し、人工合成の表のみで事前学習した。商用利用可能なOpenMDW-1.1ライセンスを採用し、TabArena、BeyondArena、TALENT、ScoringBenchの4ベンチマークで首位だった。

    Hugging Face Blogモデル
  2. Microsoft Research、Quineを公開:生物学の複雑さを扱うAI研究システム

    Microsoft Researchは生物学の複雑さを扱うAI研究システムQuineを公開した。配列、構造、機能、細胞状態、画像などのマルチモーダルデータで学習した生物世界モデルと、モデル、科学ツール、文献、実験担当者をつなぐ対話型ハーネスから構成される。

    Microsoft Researchモデル
  3. OpenAI、能動型アシスタント「dots」を発表

    OpenAIが能動型アシスタント「dots」を発表。複雑なプロジェクトや日常的なタスクで作業を継続的に進められる。公式は、dotsによってユーザーが作業の進行過程で制御権を保てるとしている。

    OpenAI Newsプロダクト
  4. xAIのGrok 4.7、Amazon Bedrockで提供開始

    xAIのGrok 4.7がAmazon Bedrockで提供され、500Kトークンのコンテキストウィンドウとlow、medium、high、xhighの4段階で設定できる推論強度を備える。Responses、Chat Completions、Converse APIに対応する。

    AWS Machine Learning Blogモデル
  5. Claude Sonnet 5.5、Amazon BedrockとClaude Platform on AWSで提供開始

    AWSはClaude Sonnet 5.5をAmazon BedrockとClaude Platform on AWSで提供すると発表した。コーディングと知識労働向けのより効率的なSonnetと位置付け、多くのタスクで1件当たりの費用が低く、速度も速いとする。

    AWS Machine Learning Blogモデル

H、27Bと35B-A3BのエージェントモデルHolo4を公開

HはHolo4エージェントモデル群を公開した。27Bのdenseと35B-A3BのMoEの2規模がH Models APIで利用可能で、Hugging FaceではBF16、FP8、NVFP4、4-bit GGUF形式のウェイトを公開している。

Hugging Face Blog

Google DeepMind、Gemini 3.8 Live with Live Avatarを公開

Google DeepMindはGemini 3.8 Live with Live Avatarを公開した。ネイティブなリアルタイム対話モデルにほぼリアルタイムの動画生成を加え、聞く、見る、話すことのできる動的な視覚アバターを実現し、本日からGemini Enterpriseで提供する。

Google DeepMind

  1. Google Research、長尺動画研究を公開、AI 動画共同監督と四つのエージェントの枠組み

    Google Research は長尺動画生成の研究を公開し、AI 動画共同監督という複数エージェントの編成フレームワークを提案した。Gemini と Veo を基盤に、複数ショットの物語で視覚的一貫性を計画する。

    Google Research論文
  2. GitHub Security Lab、C/C++のファジング全工程を自動化するFuzzing Taskflowを公開

    GitHub Security LabはC/C++プロジェクト向けの自律ファジングパイプラインFuzzing Taskflowを公開した。GitHubリポジトリーを指定するだけで、入口の特定、ビルドシステムの分析、ハーネス作成、AFL++実行、カバレッジ報告の読解とハーネス改善を行い、最後に各クラッシュを分類して脆弱性報告を生成する。

    GitHub Blog · AI & MLプロダクト
  1. Microsoft Research、ロボット外への物理AI推論オフロードで成功率と稼働時間を向上

    Microsoft Researchは移動マニピュレーションロボットのワークロードを体系的に測定し、物理AI推論をロボット上のGPUからエッジやクラウドのGPUへ移すことで、タスク成功率の向上、大規模モデルの利用、稼働時間の延長が可能だと示した。

    Microsoft Research論文
  2. Google DeepMind、Private AI Computeにサーバー側の永続メモリーを導入

    Google DeepMindはPrivate AI Computeの構成を更新し、端末並みのプライバシー基準を保ちながら、永続的で端末間共有できるAIメモリーをクラウドに導入する。データは暗号化ストレージに封じ、復号鍵はユーザー端末だけに保持する。モデルがアクセスするときはエンドツーエンド暗号化経路でクラウドのsecure enclaveにつなぎ、隔離メモリー内で一時復号し、新しい文脈を保存した直後に再暗号化する。

    Google DeepMind業界

OpenAI、GPT-6 SolとLunaを公開

OpenAIはGPT-6 SolとLunaを公開した。最先端の知能を日常業務に届け、能力と費用のバランスにそれぞれ異なる重点を置く。

OpenAI News

  1. Google DeepMind、Gemini 3.8 Flash TTSとFlash-Lite TTSを公開

    Google DeepMindは音声生成モデルGemini 3.8 Flash TTSとGemini 3.8 Flash-Lite TTSを公開した。前者はキャラクター設計と行ごとの演技指示、後者は同時処理数の多い吹き替えと音声エージェント向けである。

    Google DeepMindモデル