gpt-oss-120b 在智能体记忆评测中任务完成率提升16.1个百分点
智能体记忆并非越多越好:八款模型评测显示剂量需按能力校准
24 HOURS
本事件热度走势
当前热度 29峰值 29(8月19日 03:54)近24小时变化 —
移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。
TIMELINE
1 条公开报道 · 官方一手 1 条 · 最新在前报道时间线
- 智能体记忆并非越多越好:八款模型评测显示剂量需按能力校准
智能体记忆并非可随意开启的功能,而是需按模型能力校准的剂量。强模型适合注入完整指南集,DeepSeek-V3.2(671B MoE)任务完成率提升+9.5个百分点;较弱模型采用精选检索效果最佳,gpt-oss-120b(117B MoE)提升+16.1pp且仅增加+5% token。该方法无需更新权重或人工标注,通过从智能体过往轨迹中蒸馏指南并在推理时注入实现。