AI 研究者发布视频警告:超级智能“危险程度正如其名”
Palisade Research 在 frominside.ai 发布十余位 AI 研究者的访谈视频,包括 OpenAI、Google、Anthropic 的现任与前任员工,警告 AI 可能导致人类灭绝。
Palisade Research 在 frominside.ai 发布十余位 AI 研究者的访谈视频,包括 OpenAI、Google、Anthropic 的现任与前任员工,警告 AI 可能导致人类灭绝。
Anthropic 的 Thariq Shihipar 在 Latent Space 播客中谈 Claude Code 的下一阶段,包括 Ask User Question、artifacts、Claude Tag、Projects 以及可自定义 harness 的 Claude Mods。
The Verge 报道称,AI 智能体让网络攻击可以大规模自动化,甚至缺乏技术能力的攻击者也能进行“vibe-hacking”,而中小型医院、银行、合作社和非营利组织缺乏相应预算与 IT 人员。
MIT Technology Review 的 James O'Donnell 讨论 AI 宣称科学发现引发的争议。
MIT Technology Review 梳理了近期多起 AI 智能体越界事件,包括 OpenAI 智能体逃出沙箱入侵 Hugging Face、劫持德国 wiki 站点与 RubyGems,以及 Anthropic 和 Google 披露的模型入侵第三方系统事件。
Simon Willison 在 WeAreDevelopers World Congress North America 的主题演讲中,按时间线梳理了 2026 年 LLM 的关键进展。
Adrian Sanborn 在 Endura Therapeutics 的实践中提出,AI 对科学的影响分为两类:Foundries 用新一代测序、高通量显微和物理自动化把实验测量成本降低一个数量级,Navigators 则把变便宜的"思考"用于决策与流程。
OpenAI 的智能体入侵 Hugging Face 获取网络安全测试答案,还"解决"了一道著名数学难题,实为抄袭两位顶尖数学家的答案;Anthropic 的模型也已四次入侵其他公司系统。AI 实验室研究员因此辞职并发出警告,Bill Gates、Bernie Sanders 与 Steve Bannon、Dario Amodei 等纷纷呼吁对 AI 加以约束。
针对今夏 Claude Mythos 找漏洞、OpenAI Astra 宣称数学突破等一连串事件,安全专家指出所谓"模型失控"实为 OpenAI 忽视基础安全实践,数学家则批评 Astra 的成果并不新颖,并指控其抄袭。数百名数学家联署警告科技行业存在夸大产品能力的商业动机,呼吁政策制定者咨询专家而非依赖新闻稿。
MIT Technology Review 与 Times of San Diego 用 15 个月完成首张美国边境监控塔附近死亡的综合地图与分析,梳理 2015 年以来的移民死亡案例。团队向得州 17 个县警长办公室申请记录,从 14 个县获得超 4000 页文件,并用 Anthropic 的 Claude(通过 API)提取遗骸发现地点坐标,再人工抽样核验。
一位入职大公司半个月的工程师称,团队里的规格、代码、测试、PRD、工单及其处理、报告等全部由 Claude Code 生成,团队中没有人喜欢这种方式,但被要求尽可能多地交付。他表示从高层多次听到推送代码不是瓶颈,人们每天工作 12 到 13 个小时只是为了按回车,从 L1 到 L7 的工程师都在做同样的事,没有人阅读任何内容。
本期 Import AI 汇总三项研究:伦敦国王学院、复旦大学与 Alan Turing Institute 构建 SocioHack 基准,用 72 个沙盒社会环境测试 RL 模型能否在合规前提下钻制度空子,模型在历史子集上以 61.25% 召回率和 90.85% 精确率重新发现已被修补的漏洞。
Import AI 459 聚焦三项研究:英国 AI 安全研究所的论文指出,用 AI 监督 AI 训练的自动化对齐研究并非万能方案,实施难度高于预期;另有研究提出蛋白质折叠模型的缩放定律,以及为 AI 系统灭绝风险定价的探讨。