Runway 发布 GWM Worlds 2 与 WorldPrompt,详解实时世界模型工程
Runway 推出 GWM Worlds 2 研究预览,把高保真视频与音频生成变成实时交互式模拟,并引入 WorldPrompt 这一输入格式,可固定首帧等环境要素并生成带时间戳的事件。
Runway 推出 GWM Worlds 2 研究预览,把高保真视频与音频生成变成实时交互式模拟,并引入 WorldPrompt 这一输入格式,可固定首帧等环境要素并生成带时间戳的事件。
Simon Willison 发布 commit-rewriter 0.2。该工具与 git 相关,具体功能与更新细节原文未作说明。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就能识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分类并生成漏洞报告。
Meta 在周三发布了一款不带摄像头的 Ray-Ban 眼镜,用户只能通过语音与 Meta 的 AI 交互,同时推出 Ray-Ban 新镜框和更便宜的 Meta 眼镜系列。
Remedy Entertainment 的 CONTROL Resonant 已在发售当日登陆 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能串流,支持 NVIDIA DLSS 4、光线追踪、NVIDIA Reflex 和最高 5K HDR,无需 100GB 本地安装。
YouTube 在年度 Made on YouTube 活动上宣布,将推出 Custom Feeds 自定义信息流,用户输入描述即可生成专属内容标签页,并可保存多个信息流,该功能将很快面向美国 Web、移动端和电视用户上线。平台还将在年内支持评论发布 GIF,并为 YouTube 私信加入群聊功能,初期仅限美国、英国、新加坡、巴西及部分欧洲国家。
荷兰零售商 HEMA 基于 MCP 和 Amazon Bedrock AgentCore 构建了内部 AI 助手 HAL,把原本分散在多个门户和 wiki 中的知识集中到一处,并直接送进 Kiro、Claude 等团队日常使用的工具中。
Google 发布两款 Gemini 文本转语音模型 gemini-3.8-flash-tts 和 gemini-3.8-flash-lite-tts,提供超过 2000 种声音,并支持用 30 秒音频样本创建自定义声音。
Google DeepMind 公布 Private AI Compute 架构更新,将持久化、跨设备的 AI 记忆引入云端,同时保持端侧级别的隐私标准。新架构把数据封存在加密存储中,解密密钥只保留在用户设备上,模型需要访问时通过端到端加密通道连到云端安全隔离区(secure enclave),在隔离内存中临时解密、保存新上下文后立即重新加密。
Ringg 基于 GPT-5.6 打造的多语言 AI 智能体可解决最多 65% 的客户来电,覆盖语音、聊天、WhatsApp 和网页渠道。相比 GPT-4.1,其成本降低 90%。
invideo 借助 GPT-6 Astra 实现更精准的剪辑规划,调色与色彩校正效率提升 3 倍,并在一天内生成 50 个自定义特效。
Harvey 借助 GPT-6 Astra 生成结构更清晰、更贴合上下文的法律文书,让律师得以专注于策略。
ChatGPT Ads 扩展至东南亚和台湾,覆盖超过 60 个国家和地区,符合条件的企业可借此触达更多用户。
Airbnb 正在扩大 GPT-6 Astra 及 OpenAI 前沿模型的使用范围,帮助工程团队排查 bug、设计系统并加快交付。
OpenAI 为 GPT-6 改进提示词缓存,带来更高的缓存命中率、新的诊断能力、显式断点以及可降低延迟和成本的控制项。
Simon Willison 发布 llm 0.36。该版本于 2026 年 9 月 22 日发布,具体更新内容未在原文中说明。
Simon Willison 发布 llm-anthropic 0.29。该版本属于其 LLM 命令行工具生态中的 Anthropic 插件,具体更新内容原文未作说明。
Simon Willison 发布 LLM 插件 llm-typesafe 0.1a0,为 LLM 工具接入 TypeSafe AI 的新模型 Jev。
NVIDIA 在加拿大多伦多 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速软件包集合,新增智能体工作流与平台支持,帮助开发者更快构建、定制和部署机器人应用。
Parallel 的智能体借助 GPT-6 Astra 研究并综合劳动力市场数据,耗时和成本均降至此前模型的一半。
Hugging Face 为 transformers 加入 GGUF 支持,用户可从 Hub 选取量化检查点,用 from_pretrained 传入 gguf_file 即可在本地生成,无需额外配置。
Higgsfield AI 借助 GPT-6 Astra,在一天内上线了新的视频功能,让小型企业更轻松地制作视频广告,并更快将新创意工具推向市场。
OpenAI Academy 新增面向员工、开发者、管理者、教育工作者和学生等多类人群的学习路径,用于培养和展示实用 AI 技能。
Hugging Face 发布 tokenizers v1,输出 token ID、API、词表和 merge ranks 与 v0.23 保持一致,但速度最高提升数十倍。
V7 使用 GPT-5.6 Luna 将成本降低 78%,同时提升准确率。借助 GPT-5.6,V7 能把分散的公司文件转化为智能体可用的上下文,从而完成复杂且带来源链接的工作。
Simon Willison 发布 llm-keys-ui 0.1,这是一个解决在远程机器上配置 API key 问题的插件。用户可通过 `uvx --with llm-keys-ui llm keys-ui --all` 启动一个界面,在本地网络或 Tailscale 设备 IP 上保存 API key,避免将密钥直接粘贴进 ChatGPT 应用或 agent 会话。
Pawprint Studio 的开放世界捉宠 RPG《Aniimo》首发即登陆 GeForce NOW,玩家无需等待 45GB 下载即可在 Steam Deck 及新支持的 Firefox 浏览器上串流游玩。
Cooley 基于 ChatGPT Work 打造了 GO Public,把智能能力引入 IPO 流程,帮助律师更早发现潜在问题,并将判断力集中在最关键之处。
OpenAI 发布 OpenAI for Law,为法律行业提供前沿智能、律所自定义工作流、连接的法律数据源,以及面向机密客户工作的法律级管控。该产品包含 Astra for Law。
NVIDIA 在 MLPerf Inference v6.1 首次提交 Vera Rubin NVL72 预览结果,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高达 2.5 倍。
OpenAI 推出 AI 广告新体验,包括 Sponsored Agents 以及面向营销人员的工具,并接入 HubSpot 和 Shopify。
OpenAI 介绍如何用 ChatGPT Work 和 Codex 的分析功能,帮助团队了解 AI 使用量与支出、识别培训需求,并把 AI 采用情况与业务成果关联起来。
Hex 的数据智能体借助 GPT-6 Astra,把分析答案转化为可交互的可视化报告,让员工愿意主动分享。
TypeSafe 发布 Jev,一个用 RLCD 训练、只做决策/分类/路由/打分的非自回归模型,官方称比小型前沿 LLM 快 20–200 倍、便宜 40–400 倍,输出 token 不计费。
Salesforce 在 Dreamforce 上发布其首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 后训练,训练语料为近三十年企业 CRM 部署衍生的专有合成数据集,覆盖制造、金融服务、医疗和旅游等 14 个以上行业。
NVIDIA 在 AI Infra Summit 上介绍 DSX 平台,用于在固定电力预算下提升 AI 工厂的 token 吞吐。Lambda 在五机架 19 节点 HGX B200 集群上验证 DSX MaxLPS,以 19 节点运行在 16 节点满功耗的同一预算内,集群 token 吞吐提升 24%,从约每秒 400 万 token 增至 500 万,每瓦性能提升 23%。
NVIDIA 在 AI Infra Summit 上公布 Vera Rubin 与 DSX 平台的多项进展,重点展示每兆瓦 token 吞吐的能效优化。
费城儿童医院(CHOP)基于 NVIDIA 联合创办的开源医学影像框架 MONAI,将儿童心脏建模从耗时四小时缩短到数秒,并已用于复杂心室间隔缺损手术规划。CHOP 正与 NVIDIA 合作,把基于 NVIDIA Warp 的开源物理引擎 Newton 接入 SlicerHeart,将心脏器械仿真从最长四小时降至近实时。
Fyxer 基于 OpenAI 模型、微调与记忆能力,并结合真实用户反馈,为每位用户整理收件箱、以其本人语气起草邮件。
Perplexity 正使用 GPT-6 Astra 撰写沟通内容、修改软件并监控生产系统,且对模型的检查频率远低于早期模型。