STORY · 事件已收束

Vera 发布

1 个信源 · 1 篇报道持续 1最新动态 23天前
最新进展

Vera:大规模LLM智能体安全测试框架

TIMELINE

报道时间线

1 条公开报道 · 官方一手 0 条 · 最新在前
  1. Vera:大规模LLM智能体安全测试框架
    HuggingFace Daily Papers(社区热门论文)精选

    Vera是一个端到端自动化安全测试框架,通过三阶段自增强流水线对LLM智能体进行规模化的安全检验:文献驱动探索持续发现新兴风险;组合生成跨维度构造可执行安全用例;自适应执行在隔离沙箱中运行异构agent并基于环境状态与工具调用证据验证结果。在OpenClaw、Hermes、Codex、Claude Code四个生产级agent框架上测试,多通道攻击下平均攻击成功率达93.9%。同步发布Vera-Bench,包含1600个可执行安全用例,覆盖124个风险类别。代码已公开。