GitHub Copilot 应用如何渲染超大 pull request
GitHub Copilot 应用重建了 pull request 视图,以应对超大 diff 与评论带来的渲染压力,实测对象是一个包含 2,200 个文件、超 100 万行改动和 400 多条行内评论的开源 pull request。其做法是把文档高度拆成确定性的代码几何与动态块几何两个独立域,代码行高提前精确计算,评论等动态块则采用有界高度、延迟测量,并把修正锚定在用户当前浏览位置。
GitHub Copilot 应用重建了 pull request 视图,以应对超大 diff 与评论带来的渲染压力,实测对象是一个包含 2,200 个文件、超 100 万行改动和 400 多条行内评论的开源 pull request。其做法是把文档高度拆成确定性的代码几何与动态块几何两个独立域,代码行高提前精确计算,评论等动态块则采用有界高度、延迟测量,并把修正锚定在用户当前浏览位置。
微软研究院对移动操作机器人工作负载做了系统性测量,发现把物理 AI 推理从机器人端侧 GPU 卸载到边缘或云端 GPU,可提升任务成功率、支持更大模型并延长续航。
Airbnb 正在扩大 GPT-6 Astra 及 OpenAI 前沿模型的使用范围,帮助工程团队排查 bug、设计系统并加快交付。
NVIDIA 在加拿大多伦多 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速软件包集合,新增智能体工作流与平台支持,帮助开发者更快构建、定制和部署机器人应用。
TypeSafe AI 创始人兼 CEO Diogo Almeida 在 Latent Space 播客中介绍新模型 Jev,称其为面向软件消费的 System One 大模型。
NVIDIA 推出 DSX Ready 认证计划,用于验证合作伙伴产品是否符合 NVIDIA DSX AI 工厂参考设计要求,首批覆盖电池储能系统(BESS)和冷却分配单元(CDU)两类。
NVIDIA 发文阐述物理 AI 规模化部署需要覆盖硬件、软件、AI 行为与运行环境的安全体系,并介绍其全栈安全系统 NVIDIA Halos。
NVIDIA 在埃及大埃及博物馆举办 AI 生态活动,其 Deep Learning Institute 埃及学员规模一年内增长超十倍。Hassan Allam 获埃及国家电信管理局数据中心牌照,并与 A15 合作开发预计投资 4 亿美元的新数据中心。NVIDIA 称非洲已有四座 AI 工厂宣布或上线,另有 656 兆瓦新增算力在建。
NVIDIA 提出 AI 安全应按工程问题处理,需要明确的安全需求、可执行的管控、指定负责人和防护有效的证据。其开源安全运行时 NVIDIA OpenShell 在智能体推理范围之外强制执行策略并提供沙箱化执行,Cisco DefenseClaw 在其上增加治理层,JFrog 则集成 OpenShell 扫描和验证智能体技能。
NVIDIA 在纽约气候周重点介绍了 5 家用 AI 推进清洁能源的公司。ThinkLabs AI 的数字孪生与智能体基于 NVIDIA CUDA,帮助南加州爱迪生将电网并网申请评估时间从 30-45 天缩短到 2 分钟。
Hugging Face 发布 tokenizers v1,输出 token ID、API、词表和 merge ranks 与 v0.23 保持一致,但速度最高提升数十倍。
Simon Willison 发布 llm-keys-ui 0.1,这是一个解决在远程机器上配置 API key 问题的插件。用户可通过 `uvx --with llm-keys-ui llm keys-ui --all` 启动一个界面,在本地网络或 Tailscale 设备 IP 上保存 API key,避免将密钥直接粘贴进 ChatGPT 应用或 agent 会话。
Google Research 发布 MilleMiglia,一个用 C++ 编写的实例生成器,用于为中程物流配送问题生成真实且保护隐私的基准数据,源码与文档已在 GitHub 公开。
Anthropic 在 Claude Code 中推出 Projects,单次对话可派生并行云端会话、在线程间传递上下文,并在用户离开后继续运行。Google 为 Gemini 托管智能体更新基于 Antigravity 的 harness,新增 Credentials API 和 Files API,称成本最多降低 30%、缓存命中率提升 22%。
Pawprint Studio 的开放世界捉宠 RPG《Aniimo》首发即登陆 GeForce NOW,玩家无需等待 45GB 下载即可在 Steam Deck 及新支持的 Firefox 浏览器上串流游玩。
GitHub 用 GitHub Copilot app 和 Copilot CLI 把 Copilot agent runtime 从 TypeScript 完全重写为超过 80 万行生产级 Rust,AI 智能体写了大部分代码,跨 128 个 PR 增量落地,性能提升数个数量级。
NVIDIA 在 MLPerf Inference v6.1 首次提交 Vera Rubin NVL72 预览结果,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高达 2.5 倍。
Emerald AI、Google 和 NVIDIA 宣布成立 AI Energy Management Alliance(AEMA),推动数据中心根据电网状况动态调节用电。
OpenAI 介绍如何用 ChatGPT Work 和 Codex 的分析功能,帮助团队了解 AI 使用量与支出、识别培训需求,并把 AI 采用情况与业务成果关联起来。
TypeSafe 发布 Jev,一个用 RLCD 训练、只做决策/分类/路由/打分的非自回归模型,官方称比小型前沿 LLM 快 20–200 倍、便宜 40–400 倍,输出 token 不计费。
曼彻斯特大学团队基于 NVIDIA Earth-2 的生成式模型 Earth-2 CorrDiff,用一年英国逐小时污染数据训练出覆盖全英、分辨率 2-3 平方公里的空气污染模型,在 Isambard-AI 单个八 GPU 节点上仅用两天完成训练。
NVIDIA 在 AI Infra Summit 上介绍 DSX 平台,用于在固定电力预算下提升 AI 工厂的 token 吞吐。Lambda 在五机架 19 节点 HGX B200 集群上验证 DSX MaxLPS,以 19 节点运行在 16 节点满功耗的同一预算内,集群 token 吞吐提升 24%,从约每秒 400 万 token 增至 500 万,每瓦性能提升 23%。
NVIDIA 在 AI Infra Summit 上公布 Vera Rubin 与 DSX 平台的多项进展,重点展示每兆瓦 token 吞吐的能效优化。
费城儿童医院(CHOP)基于 NVIDIA 联合创办的开源医学影像框架 MONAI,将儿童心脏建模从耗时四小时缩短到数秒,并已用于复杂心室间隔缺损手术规划。CHOP 正与 NVIDIA 合作,把基于 NVIDIA Warp 的开源物理引擎 Newton 接入 SlicerHeart,将心脏器械仿真从最长四小时降至近实时。
GitHub 日本和韩国营销负责人用 GitHub Copilot 把活动运营做成自动化流水线:以 GitHub Issue 为工作单元,Issue forms 收集结构化字段,label 触发 GitHub Actions 工作流,自动生成 UTM 链接、落地页、邀请邮件和报名者名单清洗。
OpenAI 将 Habitat 从 Python 库演进为全球分布式存储平台,支撑 10 亿 ChatGPT 用户、每秒 2200 万次请求。该平台用于满足 ChatGPT 在线存储的规模化需求。
Mistral 与 Cloudera 建立合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持完全控制。企业还能在受控环境中用专有数据训练定制模型,同时保有数据和由此产生的智能的所有权。Cloudera 平台上运行着 30 exabytes 的客户管理数据。
TRL v1.14 的 AsyncGRPOTrainer 现已支持只训练并同步 LoRA adapter 到 vLLM,rank-1 adapter 仅几 MB,可通过挂载到各 Job 的 Storage Bucket 传输,无需 NCCL。
GitHub 发布研究预览 Project HydraFusion,通过运行时多模型编排为 Copilot 提供前沿级编码能力,用户可在 GitHub Copilot CLI 中通过 /experimental 启用,费用按各模型实际消耗的 token 标准价计。
Hugging Face 推出 NeoMME 系列多模态多语言编码器,含 260M 和 800M 两个规模,用单个双向 Transformer 同时处理文本 token 与 32×32 图像 patch,从零以掩码离散扩散目标训练,不依赖预训练视觉塔或因果语言模型。
Hugging Face WebAI 团队发布 @huggingface/kernels,一个从 Hugging Face Hub 加载并运行优化 WebGPU kernel 的轻量库,同时上线 207 个 kernel 的初始集合,均以 Apache-2.0 许可发布为独立仓库。
Mistral 与 HUMAIN 宣布战略合作,覆盖 AI 基础设施、先进模型开发与 AI 解决方案部署,初期聚焦网络安全和语音,并计划开发阿拉伯语表现强劲的前沿模型。合作规模达数亿欧元,Mistral 将探索使用 HUMAIN 数据中心基础设施,双方还计划在沙特面向受监管行业制定联合市场策略。
Papers with Code 的论文搜索采用混合检索架构,由 Hugging Face Jobs 批量生成嵌入向量、Storage Buckets 做持久化中转、Inference Endpoints 提供在线查询的低延迟嵌入,目前覆盖 arXiv 与 Daily Papers 的逾 11 万篇论文。
Liquid AI 为 LFM2.5 家族的三款模型 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 草稿模型检查点,通过投机解码在不改变输出质量的前提下提升解码速度,GPU 上吞吐最高提升 3.18 倍,端侧最高 2.87 倍。
Hugging Face 博客介绍了一个约束感知 GPU 分配器,在相同硬件和相同负载下对比 FIFO 调度器,五个真实争用场景中 GPU 利用率从 52–85% 提升到 72–88%,优先级加权产出提升 24.6%–105.1%、平均 52%。
Hugging Face 博客给出 Strands Robots 的流式数据闭环教程,用同一个 Robot() 对象完成录制演示、同步到 Storage Bucket、从 Hub 流式读取训练并把 checkpoint 部署回硬件,全程保持 LeRobot 磁盘格式不变。
Hugging Face 的 ALTK-Evolve 与 ACE 同为无需权重更新的智能体记忆方案,区别在交付方式:ACE 每步注入完整 playbook,ALTK-Evolve 按任务检索少量高支持度 guideline。
Mistral 宣布三项推进 AI 主权的举措:Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行;Mistral Priority Tier 进入公开预览,为关键业务负载提供承诺服务等级、自定义速率限制和 uptime SLA。
NVIDIA 发布 Magpie TTS Multilingual,一个 364M 参数的开源权重语音合成模型,支持英语、西班牙语、法语、德语、意大利语、越南语、中文、印地语、日语以及新增的现代标准阿拉伯语、韩语和巴西葡萄牙语共 12 种语言。
Baseten 成为 Hugging Face Hub 新增的 Inference Provider,首批上线对话与文本生成任务,可访问 Kimi K3、DeepSeek V4 Flash、GLM-5.2 等开放权重模型。