Google DeepMind、フロンティアモデル「Gemini 4 Argon」を発表
Google DeepMindは新たなフロンティアモデル「Gemini 4 Argon」を発表した。まずFairwind Programの信頼できるサイバー防御担当者に開放し、その後開発者、企業、消費者向けに提供する。価格は入力100万トークンあたり2ドル、出力100万トークンあたり10ドルから。
Google DeepMindは新たなフロンティアモデル「Gemini 4 Argon」を発表した。まずFairwind Programの信頼できるサイバー防御担当者に開放し、その後開発者、企業、消費者向けに提供する。価格は入力100万トークンあたり2ドル、出力100万トークンあたり10ドルから。
GPT-6.1 SolがAmazon Bedrockで一般提供され、エージェント型コーディング、コンピューター操作、日常の専門業務に向けて推論能力を強化した。OpenAIによると、DeepSWE v1.1でGPT-6 Astraの約5分の1のタスク単価で同等の成績を達成し、GPT-6 Solの最高成績を6.4ポイント上回った。
OpenAI が GPT-6.1 Sol を発表した。公式は Astra に近い知能水準を持ち、コーディング、コンピューター操作、専門業務の場面に対応するとしている。このモデルの API 入力・出力トークン価格は Astra の標準価格の5分の1。
OpenAI が DevDay 2026 の振り返りを公開し、GPT-6 Astra、ChatGPT、Codex、API、安全性、開発者向けの新ツールなど20以上の発表をまとめた。原文は概要のみで、各アップデートの詳細には触れていない。
xAIのGrok 4.7がAmazon Bedrockで提供され、500Kトークンのコンテキストウィンドウとlow、medium、high、xhighの4段階で設定できる推論強度を備える。Responses、Chat Completions、Converse APIに対応する。
AWSはClaude Sonnet 5.5をAmazon BedrockとClaude Platform on AWSで提供すると発表した。コーディングと知識労働向けのより効率的なSonnetと位置付け、多くのタスクで1件当たりの費用が低く、速度も速いとする。
OpenAIはCodex Originalsの次の段階を開始し、Codexを使う開発者、研究者、クリエイターの実際の経験とプロジェクトを募集している。参加希望者は下のフォームから経験とプロジェクトの紹介を提出できる。
Proaction は Codex、GPT-Live-1、GPT-6 Astra で現代的な車両群管理サービスを構築・運営・販売し、売上が60%増え、75時間超を節約した。
GitHub Podcastの最新回はAI開発の5つの話題を検討する。AIコードは読み、責任を持つ必要があるが、確認の度合いはリスクに応じる。Skillsはチームの経験を包装したもの、MCPはツールとデータをつなぐ標準で、組み合わせられる。RAGは終わっておらず、学習外の情報を提供し、エージェント、Skills、MCPと同じワークフローに共存できる。
GitHubはCopilot appとCopilot CLIを使い、Copilot agent runtimeをTypeScriptから80万行超の本番用Rustへ全面的に書き換えた。AIエージェントがコードの大半を書き、128件のPRで段階的に導入し、性能は数桁向上した。
CognitionはGPT-6 AstraでDevinがソフトウェアをテストし、使えることを証明する能力を高める。技術者のコード審査を減らし、納品を速めることを目指す。
Copilotアプリはdiff、端末、ブラウザーを内蔵し、画面を切り替えずAIコードの確認、実行、プレビューを行える。diffは追加を緑、削除を赤で示し、採用、コメント、追加修正に対応する。端末はコマンド実行と複数ウィンドウ切替、ブラウザーはPick & Polishで要素を選びエージェントに調整させられる。
César de la Fuente の研究室は Codex と ChatGPT で現存・絶滅生物のゲノムから抗菌候補分子を探し、薬剤耐性感染症に対抗する。
Mistralは欧州のエネルギー事業者が4万行のFortran 77をC++へ移行するのを支援した。対象はテストや集約された文書がない、物理計算中心の油層シミュレーターだった。チームはまず数値一致を確認するテスト基盤を作り、Skill.mdでエージェントに状態スナップショットの出力と移行モジュールの検証を指示した。その後Vibe CLIで100超のエージェントを起動し、呼び出しツリーを解析し、Mistral OCRで散在する文書を整理した。
MITの研究者がGPT-5.6 SolとCodexを使い、量子計算実験を自律実行し、結果の分析と量子ビットの校正を行った。
1Passwordの技術者はCodexで新機能と社内ツールを迅速に作り、厳格な安全方針を保って本番利用可能にし、開発効率を21%高めた。
OpenAIは内部データを公開し、エージェントの利用、実験速度、タスクの複雑さ、研究加速などでコーディングエージェントがAI研究を変えていると示した。
GitHubはProject HydraFusionの研究プレビューを公開した。実行時の複数モデルの編成でCopilotに最先端のコーディング能力を提供する。Copilot CLIで/experimentalから有効化でき、各モデルが実際に使うトークンの標準料金で課金される。
Copilot appは独立したGit worktreeで複数セッションを同時に動かし、干渉せず各文脈を保つ。sessions viewで名前と進捗を見て、いつでも切り替え、中断から再開でき、依頼を説明し直す必要はない。tailspin-toysでfunded sort機能、アクセシビリティー確認、テストを同時進行する例を示す。
Google DeepMind は Gemini 3.8 Flash と Gemini 3.8 Flash Cyber を公開した。前者は長時間のコーディングと自律エージェント向けで、料金は3.7 Flash と同じく入力100万トークン当たり0.75ドル、出力100万トークン当たり3.75ドルだ。
Multiverse ComputingはQuantization-Aware Healing(QAH)を提案する論文を公開した。GPT-OSS 120Bを60Bパラメーターへ圧縮しMXFP4へ量子化した後、復元したbfloat16チェックポイントではなく、圧縮前の元モデルから直接蒸留する。
Google DeepMind は Gemini 3.7 Flash を公開し、コーディングとエージェント向けの最強の主力モデルと位置付けた。Gemini 3.6 Flash 公開からわずか3週間だ。
Hugging FaceはSpring、Jakarta EE、Quarkus間の企業Javaアプリ移行を評価するScarfBench(Self-Contained Application Refactoring Benchmark)を公開した。
MistralはAI Now Summit 2026で産業工学向けAIスタックを公開した。Airbus、BMW、ASMLと協力し、独自データと知的財産の管理を維持しながら、設計、シミュレーション、生産を最適化する。
Mistral は Le Chat を仕事とコーディング向けの統合 AI エージェント Vibe に更新した。従来の会話、設定、サブスクリプションプランはすべて維持する。
Mistralは指示への追従、推論、コーディングを初めて統合した128Bの稠密モデルMistral Medium 3.5を公開した。修正版MITライセンスで重みを公開し、256kコンテキストに対応する。GPU4基以上で自社ホスティングが可能だ。
Google DeepMind は Gemini 3.5 シリーズの最初のモデル3.5 Flash を公開した。エージェントとコーディングを重視し、本日から Gemini app、Google Search の AI Mode、Google Antigravity、Gemini API、Gemini Enterprise で提供する。
Google DeepMindはAlphaEvolveの1年間の進展をまとめた。Geminiで動くこのコーディングエージェントは、数学・計算機科学の未解決問題から、ゲノム、電力網、量子物理、AIインフラなどへ活動領域を広げた。
Mistral AIはLean 4向け初のオープンソースコーディングエージェントLeanstralを公開した。6Bの有効パラメーターを持つ疎な構造を採用し、重みはApache 2.0で公開した。Mistral vibeと無料APIエンドポイントlabs-leanstral-2603に接続されている。
Mistral は公開コーディングアシスタント Vibe から自律エージェントを構築した。Rails ソースを読み、RSpec テストを生成・改善し、CI/CD で人の介入なしに実行する。
Mistral は Devstral 2 シリーズによる端末コーディングエージェント Mistral Vibe 2.0 を公開した。独自サブエージェント、複数選択式の確認、スラッシュコマンドのスキル、統合エージェントモード、自動更新を追加する。
Mistral AIは次世代コーディングモデルDevstral 2を公開した。123BのDevstral 2は修正版MIT、24BのDevstral Small 2はApache 2.0で、どちらもオープンソースだ。
Mistral AIはCodestral 25.08と、Codestral、Codestral Embed、Devstral、Mistral Code IDEプラグインを含む企業向けの完全なコーディングスタックを公開した。
Mistral AIはAll Hands AIと共同でDevstral Mediumを公開し、Devstral Small 1.1を更新した。
MistralはCodestral、Codestral Embed、Devstral、Mistral Mediumの4モデルを統合したAIコーディング助手Mistral Codeを公開した。クラウド、専用容量、ローカルのエアギャップGPUへ配置でき、コードは企業の境界内に留まる。
Mistral AIは初のコード向け埋め込みモデルCodestral Embedを公開した。実際のコード検索でVoyage Code 3、Cohere Embed v4.0、OpenAIの大型埋め込みモデルを上回る。
Mistral AIとAll Hands AIはソフトウェア開発向けのエージェント型LLM Devstralを共同公開した。Apache 2.0のオープンソースだ。