DeepSeek-V3.2 在智能体记忆评测中任务完成率提升9.5个百分点
智能体记忆并非越多越好:八款模型评测显示剂量需按能力校准
TIMELINE
1 条公开报道 · 官方一手 1 条 · 最新在前报道时间线
- 智能体记忆并非越多越好:八款模型评测显示剂量需按能力校准
智能体记忆并非可随意开启的功能,而是需按模型能力校准的剂量。强模型适合注入完整指南集,DeepSeek-V3.2(671B MoE)任务完成率提升+9.5个百分点;较弱模型采用精选检索效果最佳,gpt-oss-120b(117B MoE)提升+16.1pp且仅增加+5% token。该方法无需更新权重或人工标注,通过从智能体过往轨迹中蒸馏指南并在推理时注入实现。