Google DeepMind、フロンティアモデル「Gemini 4 Argon」を発表
Google DeepMindは新たなフロンティアモデル「Gemini 4 Argon」を発表した。まずFairwind Programの信頼できるサイバー防御担当者に開放し、その後開発者、企業、消費者向けに提供する。価格は入力100万トークンあたり2ドル、出力100万トークンあたり10ドルから。
AI がコードを書くことのすべて:コーディング支援、Vibe Coding、コードモデルの評価、開発の進め方の変化。
Google DeepMindは新たなフロンティアモデル「Gemini 4 Argon」を発表した。まずFairwind Programの信頼できるサイバー防御担当者に開放し、その後開発者、企業、消費者向けに提供する。価格は入力100万トークンあたり2ドル、出力100万トークンあたり10ドルから。
GPT-6.1 SolがAmazon Bedrockで一般提供され、エージェント型コーディング、コンピューター操作、日常の専門業務に向けて推論能力を強化した。OpenAIによると、DeepSWE v1.1でGPT-6 Astraの約5分の1のタスク単価で同等の成績を達成し、GPT-6 Solの最高成績を6.4ポイント上回った。
OpenAIはGPT-6.1 Solを発表し、安全上の問題で延期された旗艦モデルGPT-6.1 Astraにエージェントコーディング、コンピュータ操作、オフィス業務で迫り、コストは約5分の1だと述べている。
OpenAIはDevDayでGPT-6.1 Solを発表した。エージェントによるコーディング、コンピューター操作、専門業務でGPT-6 Astraに近い知能を持ち、標準の入力・出力トークン料金は5分の1だという。
OpenAI は San Francisco の DevDay 2026 で Codex と API の拡張を発表した。Codex には再利用可能なクラウド環境、リポジトリー安全スキャン Codex Security Cloud、デスクトップのコードレビュー画面、刷新した CLI を追加し、Agents API には Computer Use、Tool Search、Context Compaction を導入する。
OpenAI が GPT-6.1 Sol を発表した。公式は Astra に近い知能水準を持ち、コーディング、コンピューター操作、専門業務の場面に対応するとしている。このモデルの API 入力・出力トークン価格は Astra の標準価格の5分の1。
OpenAI が DevDay 2026 の振り返りを公開し、GPT-6 Astra、ChatGPT、Codex、API、安全性、開発者向けの新ツールなど20以上の発表をまとめた。原文は概要のみで、各アップデートの詳細には触れていない。
Latent SpaceのAINewsは9/24~9/25の動向をまとめ、今週公開されたOpus 5.5へのコミュニティーの反応は好意的で、特にコードで解説動画を生成する能力が優れているとした。
xAIのGrok 4.7がAmazon Bedrockで提供され、500Kトークンのコンテキストウィンドウとlow、medium、high、xhighの4段階で設定できる推論強度を備える。Responses、Chat Completions、Converse APIに対応する。
AWSはClaude Sonnet 5.5をAmazon BedrockとClaude Platform on AWSで提供すると発表した。コーディングと知識労働向けのより効率的なSonnetと位置付け、多くのタスクで1件当たりの費用が低く、速度も速いとする。
AnthropicはClaude 5.5ファミリーの2番目のモデルClaude Sonnet 5.5を公開した。出力生成速度は30%超向上し、タスク単価は最大30%低下した。複数のベンチマークでOpus 5.5に近い成績を示す。
Anthropic は Claude Opus 5.5 を公開した。新 Claude 5.5 ファミリー最初のモデルで、大半の作業で Claude Fable 5.1 水準に達し、運用コストは Opus 5 より40%低いとする。Claude Code と Claude アプリの標準モデルになる。
GitHubはCopilot appとCopilot CLIを使い、Copilot agent runtimeをTypeScriptから80万行超の本番用Rustへ全面的に書き換えた。AIエージェントがコードの大半を書き、128件のPRで段階的に導入し、性能は数桁向上した。
Mistralは欧州のエネルギー事業者が4万行のFortran 77をC++へ移行するのを支援した。対象はテストや集約された文書がない、物理計算中心の油層シミュレーターだった。チームはまず数値一致を確認するテスト基盤を作り、Skill.mdでエージェントに状態スナップショットの出力と移行モジュールの検証を指示した。その後Vibe CLIで100超のエージェントを起動し、呼び出しツリーを解析し、Mistral OCRで散在する文書を整理した。
GitHubはProject HydraFusionの研究プレビューを公開した。実行時の複数モデルの編成でCopilotに最先端のコーディング能力を提供する。Copilot CLIで/experimentalから有効化でき、各モデルが実際に使うトークンの標準料金で課金される。
Google DeepMind は Gemini 3.8 Flash と Gemini 3.8 Flash Cyber を公開した。前者は長時間のコーディングと自律エージェント向けで、料金は3.7 Flash と同じく入力100万トークン当たり0.75ドル、出力100万トークン当たり3.75ドルだ。
Multiverse ComputingはQuantization-Aware Healing(QAH)を提案する論文を公開した。GPT-OSS 120Bを60Bパラメーターへ圧縮しMXFP4へ量子化した後、復元したbfloat16チェックポイントではなく、圧縮前の元モデルから直接蒸留する。
Google DeepMind は Gemini 3.7 Flash を公開し、コーディングとエージェント向けの最強の主力モデルと位置付けた。Gemini 3.6 Flash 公開からわずか3週間だ。
MistralはAI Now Summit 2026で産業工学向けAIスタックを公開した。Airbus、BMW、ASMLと協力し、独自データと知的財産の管理を維持しながら、設計、シミュレーション、生産を最適化する。
Mistral は Le Chat を仕事とコーディング向けの統合 AI エージェント Vibe に更新した。従来の会話、設定、サブスクリプションプランはすべて維持する。