STORY · 事件已收束

Anthropic 更新 Claude 选举保障措施

1 个精选信源 · 1 篇报道持续 1最新动态 122天前
最新进展

关于我们选举保障措施的更新

TIMELINE

报道时间线

1 条公开报道 · 官方一手 1 条 · 最新在前
  1. 关于我们选举保障措施的更新
    Anthropic:Newsroom(网页)官方一手精选

    Anthropic宣布了针对2024年美国中期选举及全球其他主要选举的Claude模型安全保障措施更新。核心举措包括:通过宪法原则和系统提示训练模型保持政治中立,最新评估显示Opus 4.7和Sonnet 4.6在政治话题平衡性上分别获得95%和96%的高分。模型严格执行使用政策,在包含600个提示的选举相关测试中,Opus 4.7和Sonnet 4.6对合法请求的遵守率分别为100%和99.8%,对有害请求的拒绝率也接近100%。针对影响力操作的多轮模拟测试中,两款模型恰当回应率分别达94%和90%。此外,Claude.ai平台将继续通过选举横幅功能,在用户查询投票信息时提供指向TurboVote等权威非党派资源的链接。

RELATED