公众号正文需在微信内阅读,站内仅提供摘要。
在微信中打开原文小红书 dots 团队提出 Vision-OPD,让多模态大模型"看清细节"
AI 导读
小红书 dots 团队提出 Vision-OPD,一种区域到全局在线自蒸馏框架,让模型无需外部教师或推理工具即可从全图中识别细粒度证据。仅用约 6.2K 条全自动合成数据,Vision-OPD-9B 即在多个细粒度基准上以 79.68 平均分总体第一,超越 Gemini-3.5-Flash、GPT-5.4 等闭源模型,同时保持通用视觉任务表现。
公众号正文需在微信内阅读,站内仅提供摘要。
在微信中打开原文(在新标签页打开)来源:公众号:小红书技术(dots.llm)· mp.weixin.qq.com