STORY · 事件进行中

Anthropic 称已基本解决提示注入攻击

1 个精选信源 · 1 篇报道持续 1最新动态 1小时前
最新进展

Anthropic 称已基本解决提示注入攻击

24 HOURS

本事件热度走势

当前热度 19峰值 208月10日 03:06近24小时变化

移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。

TIMELINE

报道时间线

1 条公开报道 · 官方一手 0 条 · 最新在前
  1. Anthropic 称已基本解决提示注入攻击
    X:Boris Cherny (@bcherny)精选

    Anthropic 的 Boris Cherny 表示,通过模型训练已基本解决 Claude 模型在实际使用中的提示注入威胁。独立研究者的基准测试显示,叠加模型训练、输入探测和意图分类器等多层防御后,未见过的间接提示注入攻击成功率可降至约 0。Claude Code 的 auto 模式将于下周默认开启。