工具
SafeClawBench: Separating Semantic, Audit-Evidence, and Sandbox Harm in Tool-Using LLM Agents
2026-06-18arxiv.org
★★★★★
SafeClawBench构建了面向工具调用型大模型代理的三维安全评估基准。
值得记下
阅读原文↗首次系统解耦工具调用场景中不同来源的安全风险维度,支持分层归因分析。
内容来源:arxiv.org,版权归原作者所有
SafeClawBench构建了面向工具调用型大模型代理的三维安全评估基准。
首次系统解耦工具调用场景中不同来源的安全风险维度,支持分层归因分析。
内容来源:arxiv.org,版权归原作者所有