Hugging Face Blog·· 1 天前
ProvenanceGuard:面向 MCP 智能体的来源感知事实核查
Getting the Source Right, Not Just the Fact: Source-Aware Verification for MCP Agents
AI 导读
Hugging Face 发布论文 ProvenanceGuard,一种面向 MCP 智能体的生成后验证层,可保留工具输出的来源身份,检测"事实为真但归属错误"的跨来源混淆。在医疗智能体的 281 条真实 trace 上,专家判定应拦截的 139 条声明中它拦下 138 条,来源识别准确率约 86%,并在与四种核查器的对比中得分最高。
入选记录
门槛 60官方一手第一次 34第二次 31
未入选两次之和 65 < 门槛的两倍 120
- 信源等级
- 官方一手,这一级的门槛是 60 分
- 预筛
- 通过:MCP智能体验证与来源感知事实核查
评分由模型按同一份标准独立打两次,满分 100;两次之和达到门槛的两倍才入选。门槛按信源等级设定。
来源:Hugging Face Blog · huggingface.co