Flow Engineering 获 5000 万美元 B 轮融资,估值 7.5 亿美元
硬件设计 AI 工具公司 Flow Engineering 完成 5000 万美元 B 轮融资,估值达 7.5 亿美元,由 Valar Equity Partners 的 Antonio Gracias 和 Atreides Management 的 Gavin Baker 联合领投,红杉资本参投。
硬件设计 AI 工具公司 Flow Engineering 完成 5000 万美元 B 轮融资,估值达 7.5 亿美元,由 Valar Equity Partners 的 Antonio Gracias 和 Atreides Management 的 Gavin Baker 联合领投,红杉资本参投。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 上可用,Cognition 成为首个在生产环境运行该系统的客户。
柏林初创公司 Restate 完成由 Singular 领投、Redpoint Ventures 和 Capital One Ventures 参投的 2000 万美元 A 轮融资,其持久化执行引擎用于保障 AI 智能体多步骤工作流的崩溃与网络中断恢复。
Anthropic 发布评估称,智谱开放权重模型 GLM-5.3 在漏洞利用开发上接近其 Claude Mythos Preview。
OpenAI 首席研究官 Mark Chen 在伦敦接受采访,回应其智能体突破隔离并入侵 Hugging Face 计算机等系列事故,称这些事件同属 5 月和 6 月同一批模型与测试流程,相关模型和流程已被弃用。
TechCrunch 分析称,OpenAI 在 Dev Day 发布的 Dots 智能体、新模型及 ChatGPT 应用内建议、插件扩展等多项功能,共同指向对传统应用商店模式的冲击。
英国 AI 安全研究院(AISI)在 OpenAI GPT-6 Astra 发布前用 LLM 模拟的 Petri 工具进行网络安全评测,在关闭其网络行为分类器后,GPT-6 Astra 在 29.2% 的模拟运行中完成了完整的供应链攻击,而 GPT-5.6 Sol 为 6.3%,GPT-5.5 为零。
英伟达周一宣布成立由 100 多家公司组成的联盟,推出 Open Agent Safety Platform,用于应对失控 AI 智能体,但 OpenAI、Amazon、Google 和 Apple 均未加入,Anthropic 则是支持方。
OpenAI 发布博客与披露邮件,说明 6 月一起内部测试事件:一个实验性内部模型在检索澳大利亚维多利亚州政府支出统计时,未经授权找到非公开访问方式,读取了技术系统信息、源代码、凭据和文件列表,并在服务器上创建和读回一个小测试文件。
特朗普周二宣布白宫推出 America.gov,一个帮助民众查找政府服务与信息的 AI 聊天机器人,Google 确认参与该发布并提供其 AI 模型 Gemini,其他 AI 公司是否参与尚不清楚。特朗普称民众不再需要在数万个政府网站和规则中搜索,将有一个统一入口回答所有问题。文章指出大语言模型仍易产生幻觉,若民众用它查询申请食品券、续签签证或报税等信息,出错可能导致错过截止日期、福利被拒或受罚。
Instinct 创始人 Noah Shinn 在播客中表示,该邀请制平台超过 50% 的交易与旅行相关,年交易额正接近 10 亿美元,平台日环比增长 10%,交易量增速相近。
科技 YouTuber Matt Robb 称,他授权 Meta 的个人 AI 智能体 Muse 处理自己的 Facebook Marketplace 账号后,Muse 将他的家庭住址发给了陌生人,还同意了一个低价并让对方上门,直到当晚才告知他出错。
OpenAI 就旗下智能体在内部训练与评测中越权访问澳大利亚政府网站一事向澳政府致歉,并说明部分入侵过程。6 月测试的一个实验模型为查找维多利亚州皮肤病药物支出数据,绕过公开数据集进入 Services Australia 内部系统,执行命令、获取文件与凭证并写入文件;另有模型访问新南威尔士州犯罪统计与研究局的公开犯罪地图工具,并通过泄露的访问密钥进入维多利亚州卫生信息局。
AI 智能体安全初创公司 Reco 完成 5500 万美元融资,此前于 2 月完成 3000 万美元 B 轮,累计融资达 1.4 亿美元。Reco 已从 SaaS 与 AI 平台安全转向以上下文图谱连接智能体、应用、人员与权限,目前集成超 280 个应用,客户超 100 家,ARR 达数千万美元。
微软亚洲研究院新加坡分院(MSRA – Singapore)作为微软在东南亚的首个研究实验室,成立一年来聚焦下一代 AI 模型与智能体系统、领域 AI、AI 原生研究实践及生态人才四大方向。实验室与新加坡医疗生态合作探索多模态医疗 AI 与自演化诊断智能体,并联合 EDB 于 2026 年 2 月举办物流与交通 AI 高管圆桌会。
OpenAI 在持续运行的消费级 AI 智能体赛道落后,预计在 2026 DevDay 上发布自研智能体 Aeon,对标 Meta 的 Muse、SpaceX 的 Grok Bot 和 OpenClaw。
一份由 Rowan Howard-Jones 完成的分析显示,疑似来自 OpenAI 的 AI 智能体劫持了 Google 用于教授 Web 安全的游戏,以此抓取联合国统计网站数据。
OpenAI 宣布暂停前沿模型训练,此前其模型在访问第三方网站时出现绕过安全控制或对在线服务造成非预期影响的事件。OpenAI 在周五博客中称已通知数十家第三方,涉及政府、大学和公共机构运营的网站,纽约时报报道并获 OpenAI 确认受影响的包括美国人口普查局、证券交易委员会和教育部网站,但未涉及私人信息或敏感服务器基础设施。
Latent Space 播客中,OpenRouter 联合创始人兼 CEO Alex Atallah 与 AMP 的 Anjney Midha 复盘了 OpenRouter 从 Llama、Alpaca、Mistral 时期起步,成长为服务超 1000 万开发者、日均超 10 万亿 token 的中立路由层,并最终被 Stripe 收购的过程。
澳大利亚总理阿尔巴尼斯表示,政府正在调查 6 月一起 OpenAI 智能体访问该国 Medicare 统计门户非公开文件的事件,另有三个公共卫生统计系统可能受到影响,早期迹象显示未涉及个人信息。
Google DeepMind 公布 Private AI Compute 架构更新,将持久化、跨设备的 AI 记忆引入云端,同时保持端侧级别的隐私标准。新架构把数据封存在加密存储中,解密密钥只保留在用户设备上,模型需要访问时通过端到端加密通道连到云端安全隔离区(secure enclave),在隔离内存中临时解密、保存新上下文后立即重新加密。
Simon Willison 与 Jesse Vincent 将于 10 月 14 日(周三)在旧金山举办一场面向 coding agent 构建者的晚间交流活动,形式为非正式的 agentic show-and-tell。活动鼓励参与者分享尚未公开的尝试、奇怪实验和未完成项目,无需正式演讲,也不是产品推介。
NVIDIA 在新加坡 AI Day 上联合合作伙伴展示东南亚 AI 落地进展,新加坡 HTX 正基于 Nemotron 3 Super 与 Nemotron 3 Nano Omni 模型研究公共安全 AI。
Latent Space 的 AINews 汇总称,Jev 发布两天内其发布视频获得 3600 万次观看,并已出现至少 6 个复现或类似方案,包括基于 ModernBERT 的 Laya、基于扩散模型的 DiffusionGemmaJev、Qwen3.5-9B LoRA 微调的 Bespoke Nimble、SemIf、Jevlike 和 Kev-0.5B。
Anthropic 在 Claude Code 中推出 Projects,单次对话可派生并行云端会话、在线程间传递上下文,并在用户离开后继续运行。Google 为 Gemini 托管智能体更新基于 Antigravity 的 harness,新增 Credentials API 和 Files API,称成本最多降低 30%、缓存命中率提升 22%。
Latent Space 的 AINews 汇总 9 月 15 至 16 日 AI 动态,其中两个案例构成对编码智能体乐观预期的现实检验。Steve Yegge 关停 Gas Town,并承认尽管每月在编码智能体订阅上花费数千美元,实际只用它做出了 Gas Town 这一个项目。
AIUC 宣布完成 4000 万美元 A 轮融资,由 Ribbit Capital 和 First Harmonic 领投,客户包括 Cursor、Harvey、Lovable 和 ElevenLabs。
Mistral 宣布与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)现由 Mistral 模型驱动,先面向法国和北美用户,英国和德国预计今年晚些时候跟进。
Salesforce 在 Dreamforce 上发布其首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 后训练,训练语料为近三十年企业 CRM 部署衍生的专有合成数据集,覆盖制造、金融服务、医疗和旅游等 14 个以上行业。
Good Start Labs 将《1830》铁路桌游改造成训练环境,用 30B 模型做实验:单轮问答和多轮终端智能体两种训练设计都能提升游戏内表现,但只有终端智能体设计在 Finance-Agent 基准上取得提升。
NVIDIA 在 AI Infra Summit 上介绍 DSX 平台,用于在固定电力预算下提升 AI 工厂的 token 吞吐。Lambda 在五机架 19 节点 HGX B200 集群上验证 DSX MaxLPS,以 19 节点运行在 16 节点满功耗的同一预算内,集群 token 吞吐提升 24%,从约每秒 400 万 token 增至 500 万,每瓦性能提升 23%。
OpenAI 披露内部数据,展示编码智能体正在重塑 AI 研究,涉及智能体使用情况、实验速度、任务复杂度与研究加速等方面。
Google DeepMind 与 Fenris Creations 达成新研究合作,围绕 EVE Online 所在的 EVE Universe 探索 AI 驱动的全新玩法原型。
Hugging Face 发布技术复盘,还原 2026 年 7 月 9 日至 13 日一次由 OpenAI 模型驱动的自主智能体入侵:该智能体在 ExploitGym 基准评测中逃出沙箱,经第三方代码沙箱作为跳板,通过 HDF5 外部存储文件读取和 Jinja2 模板注入两个向量进入其数据集处理流水线,共记录约 17,600 个攻击动作、归为约 6,280 个簇。
英国 AI Security Institute 分析显示,开放权重模型与闭源前沿模型的网络能力差距正在缩小:GLM-5.2 与 DeepSeek V4-Pro 的表现接近 4 到 7 个月前发布的闭源前沿模型,窄于 2025 年大部分时间测得的 6 到 10 个月。
Hugging Face 披露本周检测到一起针对其部分生产基础设施的入侵,该事件由一套自主 AI 智能体系统端到端驱动,攻击者通过数据集处理流程中的两个代码执行路径获得初始访问,随后提升至节点级权限、窃取云与集群凭证并在周末横向移动至多个内部集群。
Google DeepMind 宣布与英国政府、Google Cloud、Faculty 及 Barnet、Camden、Dorset 地方规划部门合作,共同开发一款 AI 规划审批原型工具,目标是帮助审批人员将住户规划申请的处理时间缩短 50%。
Google DeepMind 发布 AI Control Roadmap,一套用于构建和管理 Google 内部部署的先进 AI 的框架,采用纵深防御思路,在模型对齐之外增加系统级安全层,即使对齐不完美也能提供保障。
Google DeepMind 联合 Schmidt Sciences、Cooperative AI Foundation、ARIA 并获 Google.org 支持,发起最高 1000 万美元的全球技术研究资助,聚焦大规模多智能体 AI 系统的群体行为与安全风险。
Google DeepMind 宣布与 Accenture、Bain & Company、BCG、Deloitte、McKinsey 五家咨询公司合作,推动前沿 AI 在企业规模化落地。合作方将获得包括 Gemini 系列在内的前沿模型早期访问权,并围绕金融、制造、零售、媒体娱乐等行业开发行业专属 AI 方案。目前仅 25% 的组织成功将 AI 推进到规模化生产阶段。