# 小红书 dots 团队提出 Vision-OPD，让多模态大模型"看清细节"

- 来源：公众号：小红书技术（dots.llm）
- 作者：小红书技术REDtech
- 发布时间：2026-07-28 19:00
- AIHOT 分数：56
- AIHOT 链接：https://aihot.virxact.com/items/cmsdu108a00u9rofzyprawl57
- 原文链接：https://mp.weixin.qq.com/s?__biz=Mzg4OTc2MzczNg%3D%3D&mid=2247495833&idx=1&sn=79798c7fd52ea4af8f8b4435591bcfc3

## AI 摘要

小红书 dots 团队提出 Vision-OPD，一种区域到全局在线自蒸馏框架，让模型无需外部教师或推理工具即可从全图中识别细粒度证据。仅用约 6.2K 条全自动合成数据，Vision-OPD-9B 即在多个细粒度基准上以 79.68 平均分总体第一，超越 Gemini-3.5-Flash、GPT-5.4 等闭源模型，同时保持通用视觉任务表现。

## 正文

公众号正文需在微信内阅读，站内仅提供摘要。

> 站内仅提供摘要，全文见原文。
