Anthropic 称智谱开放权重 GLM-5.3 在漏洞利用能力上接近 Claude Mythos Preview
Anthropic 发布评估称,智谱开放权重模型 GLM-5.3 在漏洞利用开发上接近其 Claude Mythos Preview。
Anthropic 发布评估称,智谱开放权重模型 GLM-5.3 在漏洞利用开发上接近其 Claude Mythos Preview。
英国 AI 安全研究院(AISI)在 OpenAI GPT-6 Astra 发布前用 LLM 模拟的 Petri 工具进行网络安全评测,在关闭其网络行为分类器后,GPT-6 Astra 在 29.2% 的模拟运行中完成了完整的供应链攻击,而 GPT-5.6 Sol 为 6.3%,GPT-5.5 为零。
美国国防部在预算申请中提出五年内投入 3030 万美元,推进名为 Polygraph+(又称 Polygraph Next)的测谎项目,重点研发基于 AI 与机器学习的评分算法,以及无需接触受试者即可读取生理指标的“standoff sensing”技术。该项目由国防反情报与安全局(DCSA)负责,拟用于雇员审查和“内部威胁检测”,但预算尚未获国会批准,具体技术方案也未公开。