Runway 发布 GWM Worlds 2 与 WorldPrompt,详解实时世界模型工程
Runway 推出 GWM Worlds 2 研究预览,把高保真视频与音频生成变成实时交互式模拟,并引入 WorldPrompt 这一输入格式,可固定首帧等环境要素并生成带时间戳的事件。
Runway 推出 GWM Worlds 2 研究预览,把高保真视频与音频生成变成实时交互式模拟,并引入 WorldPrompt 这一输入格式,可固定首帧等环境要素并生成带时间戳的事件。
Simon Willison 在 2026 年 9 月 24 日的笔记中表示,随着与编程智能体协作的时间增多,他越发确信这些工具让软件工程变得更难。他认为编程智能体能做出惊人的成果,但释放其全部潜力需要极高的纪律性和知识储备。
GitHub Copilot 应用引入 canvas——一种运行在应用内、无浏览器外壳的全栈小应用,可与 Copilot 智能体双向通信,也能调用第三方 API 或在本地执行代码。
Google Research 发布长视频生成研究,提出 AI 视频联合导演这一多智能体编排框架,构建在 Gemini 与 Veo 之上,用于规划多镜头叙事的视觉连续性。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就能识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分类并生成漏洞报告。
企业可用 Amazon Bedrock AgentCore Gateway 与 MCP 构建多账户 AI 智能体架构,让各业务线数据留在自己的 AWS 账户内,仅在查询时按需流出。
Aderant 基于 Amazon Bedrock 调用 Amazon Nova Lite,为 38 人的 SierraOps 团队构建了智能工单分析器,自动完成工单上下文收集、分类与路由。
澳大利亚总理阿尔巴尼斯表示,政府正在调查 6 月一起 OpenAI 智能体访问该国 Medicare 统计门户非公开文件的事件,另有三个公共卫生统计系统可能受到影响,早期迹象显示未涉及个人信息。
Meta 在周三发布了一款不带摄像头的 Ray-Ban 眼镜,用户只能通过语音与 Meta 的 AI 交互,同时推出 Ray-Ban 新镜框和更便宜的 Meta 眼镜系列。
Meta 在 Connect 2026 上把 Muse 定位为个人智能体,并围绕它发布硬件与功能更新:Muse 支持语音与实时视频,可后台执行任务,将登陆所有 Meta 眼镜;每台 Muse 拥有独立邮箱地址,Mac 版支持 computer use,连接器平台已有 1500+ 应用。
荷兰零售商 HEMA 基于 MCP 和 Amazon Bedrock AgentCore 构建了内部 AI 助手 HAL,把原本分散在多个门户和 wiki 中的知识集中到一处,并直接送进 Kiro、Claude 等团队日常使用的工具中。
Google DeepMind 公布 Private AI Compute 架构更新,将持久化、跨设备的 AI 记忆引入云端,同时保持端侧级别的隐私标准。新架构把数据封存在加密存储中,解密密钥只保留在用户设备上,模型需要访问时通过端到端加密通道连到云端安全隔离区(secure enclave),在隔离内存中临时解密、保存新上下文后立即重新加密。
Ringg 基于 GPT-5.6 打造的多语言 AI 智能体可解决最多 65% 的客户来电,覆盖语音、聊天、WhatsApp 和网页渠道。相比 GPT-4.1,其成本降低 90%。
Anthropic 发布 Claude Opus 5.5,称其为新 Claude 5.5 家族首个模型,多数任务达到 Claude Fable 5.1 水平,运行成本比 Opus 5 低 40%,并成为 Claude Code 与 Claude 应用的默认模型。
Simon Willison 与 Jesse Vincent 将于 10 月 14 日(周三)在旧金山举办一场面向 coding agent 构建者的晚间交流活动,形式为非正式的 agentic show-and-tell。活动鼓励参与者分享尚未公开的尝试、奇怪实验和未完成项目,无需正式演讲,也不是产品推介。
NVIDIA 在新加坡 AI Day 上联合合作伙伴展示东南亚 AI 落地进展,新加坡 HTX 正基于 Nemotron 3 Super 与 Nemotron 3 Nano Omni 模型研究公共安全 AI。
Parallel 的智能体借助 GPT-6 Astra 研究并综合劳动力市场数据,耗时和成本均降至此前模型的一半。
小米发布 MiMo-V2.6 系列,包含全模态模型 MiMo-V2.6-Pro 与 MiMo-V2.6-Flash,并推出输出速度最高提升 20 倍的 MiMo-V2.6-Pro-UltraSpeed。
TypeSafe AI 上周发布 Jev,称其为“System One 模型”这一新类别模型的首个实例,作者更认同“决策模型”这一叫法。Jev 接受文本输入,输出的是对应类别、是/否问题、评分的浮点数及置信度,只按输入计费,首个模型输入价格为每百万 token 0.042 美元。作者认为它适合分类任务,如垃圾邮件检测、打标签、排序,也尝试用于搜索重排,并指出它不擅长数字、日期和对抗性内容。
TypeSafe AI 创始人兼 CEO Diogo Almeida 在 Latent Space 播客中介绍新模型 Jev,称其为面向软件消费的 System One 大模型。
NVIDIA 提出 AI 安全应按工程问题处理,需要明确的安全需求、可执行的管控、指定负责人和防护有效的证据。其开源安全运行时 NVIDIA OpenShell 在智能体推理范围之外强制执行策略并提供沙箱化执行,Cisco DefenseClaw 在其上增加治理层,JFrog 则集成 OpenShell 扫描和验证智能体技能。
V7 使用 GPT-5.6 Luna 将成本降低 78%,同时提升准确率。借助 GPT-5.6,V7 能把分散的公司文件转化为智能体可用的上下文,从而完成复杂且带来源链接的工作。
一位入职大公司半个月的工程师称,团队里的规格、代码、测试、PRD、工单及其处理、报告等全部由 Claude Code 生成,团队中没有人喜欢这种方式,但被要求尽可能多地交付。他表示从高层多次听到推送代码不是瓶颈,人们每天工作 12 到 13 个小时只是为了按回车,从 L1 到 L7 的工程师都在做同样的事,没有人阅读任何内容。
Simon Willison 反驳了“MCP 已是坏主意”的观点,认为在 Claude Code、Codex 等拥有无限制互联网访问的终端智能体之外,MCP 仍有不可替代的价值。他指出,若想限制智能体可访问的外部服务、避免其直接接触 API key、提供用户连接与认证的 UI,以及实现强审计日志,MCP 让这些能力更容易提供。仅因完整编码智能体不需要 MCP 就认定其过时,会忽略其他可构建的场景。
Latent Space 的 AINews 汇总称,Jev 发布两天内其发布视频获得 3600 万次观看,并已出现至少 6 个复现或类似方案,包括基于 ModernBERT 的 Laya、基于扩散模型的 DiffusionGemmaJev、Qwen3.5-9B LoRA 微调的 Bespoke Nimble、SemIf、Jevlike 和 Kev-0.5B。
GitHub Podcast 最新一期拆解了五个 AI 开发热梗:AI 生成的代码仍需阅读和负责,但审查力度应按风险分级;Skills 与 MCP 解决的是不同问题,前者是打包的团队经验,后者是连接工具与数据的标准接口,二者可组合使用。RAG 并未消亡,它为模型提供训练数据之外的相关信息,与 Agent、Skills、MCP 可共存于同一工作流。
Anthropic 在 Claude Code 中推出 Projects,单次对话可派生并行云端会话、在线程间传递上下文,并在用户离开后继续运行。Google 为 Gemini 托管智能体更新基于 Antigravity 的 harness,新增 Credentials API 和 Files API,称成本最多降低 30%、缓存命中率提升 22%。
Google Research 公布一项研究实验,让教师借助生成式 UI(GenUI)为课程目标动态生成互动式学习模拟,并发布 30 多个面向中学 STEM 的英文示例库,覆盖物理、化学、生物和数学,均由 AI 生成、教师审核。
Latent Space 的 AINews 汇总 9 月 15 至 16 日 AI 动态,其中两个案例构成对编码智能体乐观预期的现实检验。Steve Yegge 关停 Gas Town,并承认尽管每月在编码智能体订阅上花费数千美元,实际只用它做出了 Gas Town 这一个项目。
GitHub 用 GitHub Copilot app 和 Copilot CLI 把 Copilot agent runtime 从 TypeScript 完全重写为超过 80 万行生产级 Rust,AI 智能体写了大部分代码,跨 128 个 PR 增量落地,性能提升数个数量级。
OpenAI 发布 OpenAI for Law,为法律行业提供前沿智能、律所自定义工作流、连接的法律数据源,以及面向机密客户工作的法律级管控。该产品包含 Astra for Law。
AIUC 宣布完成 4000 万美元 A 轮融资,由 Ribbit Capital 和 First Harmonic 领投,客户包括 Cursor、Harvey、Lovable 和 ElevenLabs。
OpenAI 推出 AI 广告新体验,包括 Sponsored Agents 以及面向营销人员的工具,并接入 HubSpot 和 Shopify。
Mistral 宣布与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)现由 Mistral 模型驱动,先面向法国和北美用户,英国和德国预计今年晚些时候跟进。
Hex 的数据智能体借助 GPT-6 Astra,把分析答案转化为可交互的可视化报告,让员工愿意主动分享。
Salesforce 在 Dreamforce 上发布其首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 后训练,训练语料为近三十年企业 CRM 部署衍生的专有合成数据集,覆盖制造、金融服务、医疗和旅游等 14 个以上行业。
Good Start Labs 将《1830》铁路桌游改造成训练环境,用 30B 模型做实验:单轮问答和多轮终端智能体两种训练设计都能提升游戏内表现,但只有终端智能体设计在 Finance-Agent 基准上取得提升。
Google DeepMind 发布两款实时对话模型 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,前者面向规模与成本效率,后者面向高复杂度任务与多步推理。
NVIDIA 在 AI Infra Summit 上介绍 DSX 平台,用于在固定电力预算下提升 AI 工厂的 token 吞吐。Lambda 在五机架 19 节点 HGX B200 集群上验证 DSX MaxLPS,以 19 节点运行在 16 节点满功耗的同一预算内,集群 token 吞吐提升 24%,从约每秒 400 万 token 增至 500 万,每瓦性能提升 23%。
IBM 研究团队在 ALTK-Evolve 中新增一致性指南(consistency guidelines),基于 Consistency Analyzer 诊断智能体轨迹中易翻转的决策点。