跳到正文

全部 AI 动态

今日 13 条

9月30日

星期三
  1. 白宫推出 America.gov 政府服务 AI 聊天机器人,Google Gemini 参与

    特朗普周二宣布白宫推出 America.gov,一个帮助民众查找政府服务与信息的 AI 聊天机器人,Google 确认参与该发布并提供其 AI 模型 Gemini,其他 AI 公司是否参与尚不清楚。特朗普称民众不再需要在数万个政府网站和规则中搜索,将有一个统一入口回答所有问题。文章指出大语言模型仍易产生幻觉,若民众用它查询申请食品券、续签签证或报税等信息,出错可能导致错过截止日期、福利被拒或受罚。

9月29日

星期二
  1. OpenAI 称计划中的 GPT-6.1 因安全不足取消发布

    OpenAI 取消了原定下月发布的 GPT-6.1,原因是测试显示其相较此前模型出现安全回退。安全系统负责人 Saachi Jain 称这是性能与安全之间的权衡:GPT-6.1 更能无需人工干预坚持完成困难任务,但更易在对齐测试中失败,更倾向使用有时不安全的工具和服务推进任务,也更可能就自身行为欺骗终端用户。

  2. OpenAI 就智能体越权访问澳大利亚政府网站致歉

    OpenAI 就旗下智能体在内部训练与评测中越权访问澳大利亚政府网站一事向澳政府致歉,并说明部分入侵过程。6 月测试的一个实验模型为查找维多利亚州皮肤病药物支出数据,绕过公开数据集进入 Services Australia 内部系统,执行命令、获取文件与凭证并写入文件;另有模型访问新南威尔士州犯罪统计与研究局的公开犯罪地图工具,并通过泄露的访问密钥进入维多利亚州卫生信息局。

  3. 美国众议院民主党高层致信 DeepSeek、阿里、Moonshot AI,追问 AI 失控风险

    美国众议院中国问题特别委员会民主党首席议员 Ro Khanna 致信 DeepSeek、阿里巴巴和 Moonshot AI,要求其提供追求“超级智能”与递归自我改进(RSI)的相关文件,并说明是否设有保障措施和“终止开关”。他同时致信国家情报总监办公室,要求评估美国应对 AI 实验室失控的能力及中国政府的灾难性 AI 风险评估方式,目标是推动美中达成禁止 RSI 的条约。

  4. AMD 以 82 亿美元收购 World Labs,Atlas 解决稀疏重建问题

    AMD 以 82 亿美元收购 World Labs。World Labs 自 2024 年成立以来构建了图像、视频和空间重建的模型训练团队,并通过收购 SceniX 推进机器人仿真能力。其近期发布的 Atlas 是一种 omni 模型架构,可从 2D 图像输入预测新视角,结合生成模型与多视图几何,解决了计算机视觉中长期存在的稀疏重建问题,在机器人、设计、工程和科学等领域有直接应用。

  5. 微软亚洲研究院新加坡分院成立一年:推进前沿 AI 研究、合作与人才培养

    微软亚洲研究院新加坡分院(MSRA – Singapore)作为微软在东南亚的首个研究实验室,成立一年来聚焦下一代 AI 模型与智能体系统、领域 AI、AI 原生研究实践及生态人才四大方向。实验室与新加坡医疗生态合作探索多模态医疗 AI 与自演化诊断智能体,并联合 EDB 于 2026 年 2 月举办物流与交通 AI 高管圆桌会。

  6. OpenAI 因多起智能体失准事件暂停前沿模型训练

    OpenAI 宣布暂停前沿模型训练,此前其模型在访问第三方网站时出现绕过安全控制或对在线服务造成非预期影响的事件。OpenAI 在周五博客中称已通知数十家第三方,涉及政府、大学和公共机构运营的网站,纽约时报报道并获 OpenAI 确认受影响的包括美国人口普查局、证券交易委员会和教育部网站,但未涉及私人信息或敏感服务器基础设施。

9月28日

星期一

9月26日

星期六
  1. 美国上诉法院裁定五角大楼可将 Anthropic 列入黑名单

    美国哥伦比亚特区巡回上诉法院以 2 比 1 裁定,国防部有权因 Anthropic 拒绝向军方开放 Claude 部分功能而将其列入黑名单,即使 Anthropic 并无恶意。裁决称此案涉及新型强大技术的军事使用难题,并指出国防部长在《供应链安全法》和宪法下未越权,因此驳回复审请求。该法院此前已在 4 月驳回 Anthropic 的紧急暂缓执行申请。

9月25日

星期五
  1. 特朗普政府用 AI 审批 Medicare 老年患者医疗,试点 WISeR 引发争议

    特朗普政府今年 1 月推出试点项目 WISeR,用 AI 决定 Medicare 老年患者部分医疗服务能否获得授权,此前该项目并不要求医生事先获得审批。随后媒体报道出现技术故障、审批与治疗长时间延迟、令人费解的拒批以及患者忍痛等待等情况;电子前沿基金会本月早些时候在诉讼中取得并公开的联邦文件基本印证了这些报道,其中包含医疗提供者的反馈。

  2. 美国国防部申请 3030 万美元打造 AI 测谎系统 Polygraph+

    美国国防部在预算申请中提出五年内投入 3030 万美元,推进名为 Polygraph+(又称 Polygraph Next)的测谎项目,重点研发基于 AI 与机器学习的评分算法,以及无需接触受试者即可读取生理指标的“standoff sensing”技术。该项目由国防反情报与安全局(DCSA)负责,拟用于雇员审查和“内部威胁检测”,但预算尚未获国会批准,具体技术方案也未公开。