Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质嵌入可验证水印
Google DeepMind 发布 SynthID Bio,把水印技术引入合成生物学,在生物代码中嵌入不可感知的签名,使水印在数字模型和合成出的实体蛋白质上都能被验证,同时保持其生物功能。
Google DeepMind 发布 SynthID Bio,把水印技术引入合成生物学,在生物代码中嵌入不可感知的签名,使水印在数字模型和合成出的实体蛋白质上都能被验证,同时保持其生物功能。
Hugging Face 推出 Open TTS Leaderboard,用客观指标评测开源 TTS 模型,把评测周期从数周投票缩短到数小时。榜单以 Qwen3 ASR 计算 WER/CER,在 H200 GPU 上测 RTFx 与 TTFA,并用 WavLM 嵌入算说话人相似度 SIM,支持多语言与声音克隆对比。
DeepSeek 与华为合作为昇腾芯片打造编程工具并全部开源,核心是比 CUDA 更易上手的 TileLang 语言,该语言最初由北京大学研究者开发,DeepSeek 已使用约一年。双方还优化了由 128 颗昇腾 950 芯片组成的超级节点,华为称对该工作提供了全面支持。DeepSeek 认为,构建独立 AI 芯片软件生态首先需要一门易编程又能发挥硬件全部性能的通用语言。
Anthropic 发布评估称,智谱开放权重模型 GLM-5.3 在漏洞利用开发上接近其 Claude Mythos Preview。
OpenAI 在 DevDay 2026 上发布 Dots 常驻智能体、GPT-6.1 Sol、Ultrafast 模式、Decisions API、ChatGPT Spaces 与 Marketplace,并称 ChatGPT 周活达 12 亿。
据知情人士消息,AI 推理基础设施提供商 Modal Labs 正接近完成由 Accel 领投的 7.5 亿美元融资,估值达 157.5 亿美元,该轮规模此前未被报道。
NVIDIA 发布开源表格基础模型 Kumo Tabular,给定带标签的表格行即可单次前向传播预测新行标签,无需训练、调参和特征工程,覆盖分类与回归。模型提供 28M 到 215M 三种规模,仅用人工合成表格预训练,采用 OpenMDW-1.1 许可可商用,在 TabArena、BeyondArena、TALENT 和 ScoringBench 四个基准上排名第一。
AMD 宣布以约 82 亿美元全股票交易收购李飞飞联合创办的 AI 研究实验室 World Labs,交易预计年底前完成。World Labs 于 2024 年成立,数月内估值达 10 亿美元,2025 年推出首个商业产品 Marble,可根据提示词生成可交互 3D 世界。
AWS 发布 vLLM-Omni DLC,可在 SageMaker AI 上部署 Qwen3-TTS,通过一条持久双向连接实现文本流入、音频流出,语音在生成完成前即开始播放。
Mistral 在慕尼黑开设新中心,组建专注 Physics AI 与工业 AI 的研究团队,并计划到 2030 年建成 1 吉瓦欧洲算力。该中心将与 BMW 合作碰撞仿真与工程 AI、与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学(TUM)合作利用风洞设施开发汽车空气动力学数字孪生。
本期 Import AI 收录多项进展:Michael Levin 提出心智是来自 Platonic 空间、以身体和机器为接口的模式,并主张这一假说可被实证研究;斯坦福研究者 Perry Dong 与 Chelsea Finn 指出机器人预训练已规模化,缺的是像语言模型那样稳定的后训练配方,并提到他们开发的 EXPO(-FT) 算法。
H 公司发布 Holo4 系列智能体模型,包含 27B dense 和 35B-A3B MoE 两个尺寸,均已上线 H Models API,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 格式开源在 Hugging Face。
AWS 给出在 Amazon EKS 上结合 EFA 与 DeepEP 扩展 MoE 强化学习训练的架构方案,吞吐量提升 40%。
阿里云 Qwen 团队开源的 Qwen3-TTS-12Hz-1.7B-Base 已上线 Amazon SageMaker JumpStart,可部署到全托管实时推理端点,仅需几秒参考音频和对应文本即可克隆音色,无需重新训练。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就能识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分类并生成漏洞报告。
AWS 发布 WhisperX Deep Learning Container,在 OpenAI Whisper 基础上加入批处理推理、wav2vec2 强制对齐的逐词时间戳和说话人分离,可部署到 Amazon SageMaker AI 实时或异步端点,无需自建镜像。
Liquid AI 为视觉语言模型 LFM2.5-VL-3B 发布实验性 DSpark 草稿模型 LFM2.5-VL-DSpark,通过投机解码在不改变输出质量的前提下提速,端侧解码最高 3.13x、H100 上最高 2.66x,端到端最高 2.62x 和 2.27x。
NVIDIA 加入由 Google DeepMind、EMBL-EBI 等组成的全球研究联盟,通过 AlphaFold Database 开放 2800 多种病毒的蛋白复合物预测 3D 结构,供任何科学家免费使用。
微软研究院对移动操作机器人工作负载做了系统性测量,发现把物理 AI 推理从机器人端侧 GPU 卸载到边缘或云端 GPU,可提升任务成功率、支持更大模型并延长续航。
NVIDIA 在新加坡 AI Day 上联合合作伙伴展示东南亚 AI 落地进展,新加坡 HTX 正基于 Nemotron 3 Super 与 Nemotron 3 Nano Omni 模型研究公共安全 AI。
NVIDIA 在加拿大多伦多 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速软件包集合,新增智能体工作流与平台支持,帮助开发者更快构建、定制和部署机器人应用。
小米发布 MiMo-V2.6 系列,包含全模态模型 MiMo-V2.6-Pro 与 MiMo-V2.6-Flash,并推出输出速度最高提升 20 倍的 MiMo-V2.6-Pro-UltraSpeed。
oMLX 作者兼维护者 Jun Kim 加入 Hugging Face,全职投入 MLX 社区建设。oMLX 将从副业转为有资金支持的长期项目,仍保持 Apache 2.0 开源协议,由 Jun 继续领导,目标是提升稳定性并加快开发。
Hugging Face 为 transformers 加入 GGUF 支持,用户可从 Hub 选取量化检查点,用 from_pretrained 传入 gguf_file 即可在本地生成,无需额外配置。
NVIDIA 在埃及大埃及博物馆举办 AI 生态活动,其 Deep Learning Institute 埃及学员规模一年内增长超十倍。Hassan Allam 获埃及国家电信管理局数据中心牌照,并与 A15 合作开发预计投资 4 亿美元的新数据中心。NVIDIA 称非洲已有四座 AI 工厂宣布或上线,另有 656 兆瓦新增算力在建。
Latent Space 的 AINews 汇总 9 月 15 至 16 日 AI 动态,其中两个案例构成对编码智能体乐观预期的现实检验。Steve Yegge 关停 Gas Town,并承认尽管每月在编码智能体订阅上花费数千美元,实际只用它做出了 Gas Town 这一个项目。
Mistral 宣布与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)现由 Mistral 模型驱动,先面向法国和北美用户,英国和德国预计今年晚些时候跟进。
曼彻斯特大学团队基于 NVIDIA Earth-2 的生成式模型 Earth-2 CorrDiff,用一年英国逐小时污染数据训练出覆盖全英、分辨率 2-3 平方公里的空气污染模型,在 Isambard-AI 单个八 GPU 节点上仅用两天完成训练。
Good Start Labs 将《1830》铁路桌游改造成训练环境,用 30B 模型做实验:单轮问答和多轮终端智能体两种训练设计都能提升游戏内表现,但只有终端智能体设计在 Finance-Agent 基准上取得提升。
IBM 研究团队在 ALTK-Evolve 中新增一致性指南(consistency guidelines),基于 Consistency Analyzer 诊断智能体轨迹中易翻转的决策点。
Mistral 与 Cloudera 建立合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持完全控制。企业还能在受控环境中用专有数据训练定制模型,同时保有数据和由此产生的智能的所有权。Cloudera 平台上运行着 30 exabytes 的客户管理数据。
TRL v1.14 的 AsyncGRPOTrainer 现已支持只训练并同步 LoRA adapter 到 vLLM,rank-1 adapter 仅几 MB,可通过挂载到各 Job 的 Storage Bucket 传输,无需 NCCL。
Hugging Face 团队用 Gradio Workflow 把 AUTOMATIC1111 的大部分功能重建为一张画布 Workflow1111,由 11 条媒体流水线和 73 个节点组成,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 与图生视频。
Google DeepMind 推出 AlphaGenome Atlas,一个包含人类基因组中 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 多倍。
Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,由三星电子领投,Scaleup Europe Fund 和 PSG Equity 联合领投。公司称这是欧洲科技公司完成的最大股权融资,资金将用于扩展前沿研究、算力、基础设施和商业增长。Mistral 目前业务覆盖 20 个国家,服务包括 Airbus、ASML、HSBC 在内的 125 家以上全球企业。
Google Research 与 HHMI Janelia、剑桥大学等合作,在 Cell 发表论文,发布完整雄性果蝇大脑与中枢神经系统连接组图谱,包含超过 166,000 个神经元和 1.25 亿个突触连接,是迄今按神经元数量计算最大的脑图谱。
Hugging Face 发布开源工具 funes,为 Claude Code、Codex、pi、Hermes 等编码智能体提供持久记忆层,从本机已有会话构建索引,默认在本地完成嵌入与重排。
Hugging Face 博主用 TRL 和 OpenEnv 复现了 Surya Narreddi 让语言模型画水彩画的创意,模型通过 p5.brush 编写约 150 行 JavaScript 作画,相关数据集、RL 环境、训练脚本和模型全部开源。
Hugging Face WebAI 团队发布 @huggingface/kernels,一个从 Hugging Face Hub 加载并运行优化 WebGPU kernel 的轻量库,同时上线 207 个 kernel 的初始集合,均以 Apache-2.0 许可发布为独立仓库。
Google Research 发布 TimesFM-3,这是其首个原生预训练支持多变量预测的时间序列基础模型,参数量 3.3 亿,预训练语料超过 1 万亿个时间点。