Runway、GWM Worlds 2とWorldPromptを公開しリアルタイム世界モデルの技術を解説
RunwayはGWM Worlds 2の研究プレビューを公開した。高忠実度の動画・音声生成をリアルタイムの対話型シミュレーションに変え、初期フレームなどの環境要素を固定し、時刻付きイベントを生成できる入力形式WorldPromptを導入した。
RunwayはGWM Worlds 2の研究プレビューを公開した。高忠実度の動画・音声生成をリアルタイムの対話型シミュレーションに変え、初期フレームなどの環境要素を固定し、時刻付きイベントを生成できる入力形式WorldPromptを導入した。
Simon Willisonは2026年9月24日のメモで、コーディングエージェントとの協働時間が増すほど、ソフトウェア開発を難しくするという確信が強まると述べた。驚くべき成果を出せるが、潜在能力を十分に引き出すには非常に高度な規律と知識が必要だとする。
GitHub Copilot アプリは canvas を導入した。ブラウザーの外枠なしにアプリ内で動くフルスタックの小アプリで、Copilot エージェントと双方向に通信し、外部 API の呼び出しやローカルのコード実行もできる。
Google Research は長尺動画生成の研究を公開し、AI 動画共同監督という複数エージェントの編成フレームワークを提案した。Gemini と Veo を基盤に、複数ショットの物語で視覚的一貫性を計画する。
GitHub Security LabはC/C++プロジェクト向けの自律ファジングパイプラインFuzzing Taskflowを公開した。GitHubリポジトリーを指定するだけで、入口の特定、ビルドシステムの分析、ハーネス作成、AFL++実行、カバレッジ報告の読解とハーネス改善を行い、最後に各クラッシュを分類して脆弱性報告を生成する。
企業はAmazon Bedrock AgentCore GatewayとMCPで複数アカウントのAIエージェント構成を作れる。各事業部のデータをそれぞれのAWSアカウント内に保ち、照会時だけ必要に応じて外へ渡す。
AderantはAmazon BedrockからAmazon Nova Liteを呼び出し、38人のSierraOpsチーム向けチケット分析ツールを構築した。チケットの背景情報収集、分類、振り分けを自動化する。
オーストラリアの Albanese 首相は、6月に OpenAI のエージェントが Medicare 統計ポータルの非公開ファイルにアクセスした事件を政府が調査していると述べた。他の三つの公衆衛生統計システムにも影響した可能性がある。初期の情報では個人情報は関わっていない。
Metaは水曜日、カメラなしのRay-Ban眼鏡を公開した。MetaのAIとは音声だけでやり取りする。Ray-Banの新フレームと安価なMeta眼鏡シリーズも発表した。
Meta は Connect 2026 で Muse を個人エージェントとして位置付け、その周辺のハードウェアと機能を更新した。音声とリアルタイム動画に対応し、バックグラウンドで作業を実行し、すべての Meta 眼鏡に導入される。各 Muse は独立したメールアドレスを持ち、Mac 版は computer use に対応し、コネクタープラットフォームには1,500超のアプリがある。
オランダ小売企業HEMAはMCPとAmazon Bedrock AgentCoreで社内助手HALを構築した。複数のポータルやwikiに散在する知識を集約し、KiroやClaudeなど日常のツールへ直接届ける。
Google DeepMindはPrivate AI Computeの構成を更新し、端末並みのプライバシー基準を保ちながら、永続的で端末間共有できるAIメモリーをクラウドに導入する。データは暗号化ストレージに封じ、復号鍵はユーザー端末だけに保持する。モデルがアクセスするときはエンドツーエンド暗号化経路でクラウドのsecure enclaveにつなぎ、隔離メモリー内で一時復号し、新しい文脈を保存した直後に再暗号化する。
Ringg の GPT-5.6 に基づく多言語 AI エージェントは、音声、チャット、WhatsApp、ウェブを通じて顧客の電話の最大65%を解決する。費用は GPT-4.1 より90%低い。
Anthropic は Claude Opus 5.5 を公開した。新 Claude 5.5 ファミリー最初のモデルで、大半の作業で Claude Fable 5.1 水準に達し、運用コストは Opus 5 より40%低いとする。Claude Code と Claude アプリの標準モデルになる。
Simon WillisonとJesse Vincentは10月14日水曜日、サンフランシスコでコーディングエージェントの開発者向け夜間交流会を開く。非公式の実演交流形式で、未公開の試み、奇妙な実験、未完成のプロジェクトの共有を促す。正式な講演は不要で、製品紹介の場でもない。
NVIDIA は Singapore AI Day で協力企業と東南アジアの AI 導入の進展を展示した。Singapore の HTX は Nemotron 3 Super と Nemotron 3 Nano Omni を使い、公共安全 AI を研究している。
Parallel のエージェントは GPT-6 Astra で労働市場データを調査・統合し、以前のモデルに比べて時間と費用を半分にした。
Xiaomiは全モーダルモデルMiMo-V2.6-ProとMiMo-V2.6-Flashを含むMiMo-V2.6シリーズを公開し、出力速度を最大20倍に高めるMiMo-V2.6-Pro-UltraSpeedも発表した。
TypeSafe AI は先週 Jev を公開し、新しい「System One モデル」の最初の例としたが、筆者は「意思決定モデル」の呼び名を好む。文字を入力し、分類、はい・いいえ、点数に対応する浮動小数と信頼度を返す。入力だけに課金し、初モデルは100万トークン当たり0.042ドル。筆者は迷惑メール検出、タグ付け、順位付けに適すると考え、検索の再ランキングにも試した一方、数字、日付、敵対的内容は苦手と指摘する。
TypeSafe AI 創業者兼 CEO の Diogo Almeida は Latent Space ポッドキャストで新モデル Jev を紹介し、ソフトウェアでの利用向けの System One 大規模モデルと説明した。
NVIDIAはAIの安全を工学の問題として扱い、明確な安全要件、実行可能な制御、責任者、保護の有効性の証拠を求める。オープンソースのNVIDIA OpenShellは推論範囲の外で方針を強制し、サンドボックス実行を提供する。Cisco DefenseClawが統制層を追加し、JFrogはOpenShellによるエージェント技能の走査と検証を統合する。
V7 は GPT-5.6 Luna で費用を78%減らし、精度も高めた。GPT-5.6 で散在する企業文書をエージェントが使える文脈に変え、出典リンク付きの複雑な作業を完了できる。
入社半月のエンジニアは、仕様、コード、テスト、PRD、チケットと対応、報告などがすべてClaude Codeで作られると述べた。誰も好んでいないが、最大限の納品を求められる。上層部からコードの公開はボトルネックでないと何度も聞き、L1からL7まで皆が1日12~13時間、Enterを押すだけの仕事をし、誰も内容を読まないという。
Simon Willison は「MCP はもう悪い案」との見方に反論し、無制限のネット接続を持つ Claude Code や Codex などの端末エージェント以外では代替できない価値があるとした。外部サービスへのアクセス制限、API キーに直接触れさせない運用、接続・認証の UI、強い監査ログを提供しやすくする。完全なコーディングエージェントが不要とするだけで時代遅れと断じると、他の用途を見落とすとする。
Latent Space の AINews によると、Jev の公開動画は2日で3,600万回視聴され、少なくとも六つの再現・類似方式が現れた。ModernBERT ベースの Laya、拡散モデルの DiffusionGemmaJev、Qwen3.5-9B を LoRA 微調整した Bespoke Nimble、SemIf、Jevlike、Kev-0.5B が含まれる。
GitHub Podcastの最新回はAI開発の5つの話題を検討する。AIコードは読み、責任を持つ必要があるが、確認の度合いはリスクに応じる。Skillsはチームの経験を包装したもの、MCPはツールとデータをつなぐ標準で、組み合わせられる。RAGは終わっておらず、学習外の情報を提供し、エージェント、Skills、MCPと同じワークフローに共存できる。
Anthropic は Claude Code に Projects を導入した。一つの会話から並列クラウドセッションを派生し、スレッド間で文脈を渡し、ユーザーが離れた後も動く。Google は Gemini の管理エージェントに Antigravity ベースのハーネスを更新し、Credentials API と Files API を追加した。費用は最大30%減り、キャッシュヒット率は22%向上するとする。
Google Researchは、教員が生成UI(GenUI)で授業目標に応じた対話型シミュレーションを動的に作る研究実験を公開した。中等教育のSTEM向けに物理、化学、生物、数学の英語例を30以上公開し、すべてAIが生成、教員が確認した。
Latent SpaceのAINewsは9月15~16日の動向をまとめ、コーディングエージェントの楽観論を点検する2事例を取り上げた。Steve YeggeはGas Townを閉鎖し、毎月数千ドルのエージェント購読料を払っても、作れたのはGas Townだけだったと認めた。
GitHubはCopilot appとCopilot CLIを使い、Copilot agent runtimeをTypeScriptから80万行超の本番用Rustへ全面的に書き換えた。AIエージェントがコードの大半を書き、128件のPRで段階的に導入し、性能は数桁向上した。
OpenAIはOpenAI for Lawを公開した。最先端の知能、法律事務所独自のワークフロー、接続した法律データ、機密顧客業務向けの法律水準の管理を備える。Astra for Lawを含む。
AIUC は Ribbit Capital と First Harmonic が主導する4,000万ドルのシリーズ A 調達を発表した。顧客には Cursor、Harvey、Lovable、ElevenLabs が含まれる。
OpenAI は Sponsored Agents やマーケティング担当者向けツールを含む新しい AI 広告体験を公開し、HubSpot と Shopify に接続した。
MistralはMozillaとの提携を発表した。FirefoxのAIブラウジング助手Smart Window(beta)はMistralモデルで動き、まずフランスと北米に提供する。英国とドイツは今年後半に続く見込みだ。
HexのデータエージェントはGPT-6 Astraで分析結果を対話型の視覚的報告に変え、従業員が自ら共有したくなる形にする。
SalesforceはDreamforceで初のCRM推論モデルKoaを発表した。NVIDIA Nemotron 3 Superを事後学習し、約30年の企業CRM導入から作った独自の合成データで学習した。製造、金融サービス、医療、旅行など14以上の業界を対象とする。
Good Start Labsは鉄道ボードゲーム『1830』を学習環境に変え、30Bモデルを実験した。単一回答と複数ターンの端末エージェントの両方でゲーム性能は向上したが、Finance-Agentベンチマークが改善したのは端末エージェントだけだった。
Google DeepMindはリアルタイム対話モデルGemini 3.8 LiveとGemini 3.8 Live Extended Thinkingを公開した。前者は規模と費用効率、後者は複雑な課題と多段階推論向けである。
NVIDIA は AI Infra Summit で、一定の電力予算内で AI 工場のトークンスループットを高める DSX を紹介した。Lambda は5ラック・19ノードの HGX B200 クラスターで DSX MaxLPS を検証し、16ノードの最大電力と同じ予算で19ノードを稼働させた。トークンスループットは毎秒約400万から500万に24%増え、1ワット当たり性能は23%向上した。
IBMの研究チームはALTK-Evolveに一貫性ガイドを追加した。Consistency Analyzerを使い、エージェントのトレース内で判断が反転しやすい箇所を診断する。