工具

SafeClawBench: Separating Semantic, Audit-Evidence, and Sandbox Harm in Tool-Using LLM Agents

2026-06-18arxiv.org

SafeClawBench构建了面向工具调用型大模型代理的三维安全评估基准。

值得记下

首次系统解耦工具调用场景中不同来源的安全风险维度,支持分层归因分析。

阅读原文

内容来源:arxiv.org,版权归原作者所有