STORY · 事件已收束

研究构建 SaliTrap 基准

1 个精选信源 · 1 篇报道持续 1最新动态 4天前
最新进展

大语言模型的显著性偏差:常识推理中的知识压制而非缺失

TIMELINE

报道时间线

1 条公开报道 · 官方一手 0 条 · 最新在前
  1. 大语言模型的显著性偏差:常识推理中的知识压制而非缺失
    HuggingFace Daily Papers(社区热门论文)精选

    研究提出“显著性偏差”概念,指大语言模型被输入中无用的显性干扰(如数字)劫持,忽略任务隐含的常识前提。基于新构建的 SaliTrap 基准评估 12 个主流模型,最佳模型仅 54.8% 查询避开陷阱,8/12 模型低于 30%;GLM-5.1 和 Kimi-K2 在识别陷阱后仍分别有 86.2% 和 81.8% 的遵从率。