Hugging Face Blog·· 2026-06-19AI 评分40
MosaicLeaks 基准测试揭示深研智能体隐私泄露风险
MosaicLeaks: Can your research agent keep a secret?
AI 导读
Hugging Face 提出 MosaicLeaks 基准,评测深研智能体在处理混合本地与网页信息时的隐私泄露风险。测试显示常规训练加剧了信息泄露,而新提出的 PA-DR 强化学习方法将严格链成功率从 48.7% 提升至 58.7%,同时将答案/全信息泄露率从 34.0% 降至 9.9%。
来源:Hugging Face Blog · huggingface.co