跳到正文
原文
Hugging Face Blog·· 1 天前

ProvenanceGuard:面向 MCP 智能体的来源感知事实核查

Getting the Source Right, Not Just the Fact: Source-Aware Verification for MCP Agents

AI 导读

Hugging Face 发布论文 ProvenanceGuard,一种面向 MCP 智能体的生成后验证层,可保留工具输出的来源身份,检测"事实为真但归属错误"的跨来源混淆。在医疗智能体的 281 条真实 trace 上,专家判定应拦截的 139 条声明中它拦下 138 条,来源识别准确率约 86%,并在与四种核查器的对比中得分最高。

入选记录

未入选两次之和 65 < 门槛的两倍 120

信源等级
官方一手,这一级的门槛是 60 分
预筛
通过:MCP智能体验证与来源感知事实核查

评分由模型按同一份标准独立打两次,满分 100;两次之和达到门槛的两倍才入选。门槛按信源等级设定。

来源:Hugging Face Blog · huggingface.co