AK · @_akhaliq · X·2026-09-04 08:20·42分钟前
AI 导读

论文 CoGR 训练 LLM 在查询侧和物品侧同时生成紧凑关键词,通过倒排索引直接匹配,并用 GRPO 交替优化两侧生成器。在内部 APP Marketplace 数据集和公开 WANS 基准上,CoGR 相比最强基线分别提升 F_1 10.9% 和 36.1%。论文链接:https://huggingface.co/papers/2609.00638

AK@_akhaliq
24AI 编辑部评分,满分 100
2026-09-04 08:20· 42分钟前
AI 导读

论文 CoGR 训练 LLM 在查询侧和物品侧同时生成紧凑关键词,通过倒排索引直接匹配,并用 GRPO 交替优化两侧生成器。在内部 APP Marketplace 数据集和公开 WANS 基准上,CoGR 相比最强基线分别提升 F_1 10.9% 和 36.1%。论文链接:https://huggingface.co/papers/2609.00638

It Takes Two to Match

Co-Evolving Generative Retriever with Reinforcement Learning

paper: https://huggingface.co/papers/2609.00638

来源:AK· x.com