STORY · 事件进行中

Qwen3.8-Flash-Next 在基准测试中击败 Claude Opus 4.6 Max

3 个精选信源 · 3 篇报道持续 1最新动态 1小时前
最新进展

Qwen3.8-Flash-Next 发布,SGLang 首日支持

TIMELINE

报道时间线

3 条公开报道 · 官方一手 2 条 · 最新在前
  1. Qwen3.8-Flash-Next 发布,SGLang 首日支持
    X:通义千问 / Qwen (@Alibaba_Qwen)官方一手

    通义千问发布 Qwen3.8-Flash-Next,SGLang 即日支持部署。该模型为 125B 主模型,含 51B N-gram 嵌入,每 token 激活 6B 参数。N-gram 嵌入几乎不增加计算成本即可扩展容量,并可通过异步预取驻留内存;GDN+QSA 混合注意力兼顾长任务效率与检索精度。

  2. Qwen 开源 Qwen3.8-Flash-Next,SGLang 提供 Day-0 支持
    LMSYS:Blog(Chatbot Arena 团队)官方一手

    Qwen 团队开源多模态 MoE 模型 Qwen3.8-Flash-Next,作为 Qwen4 架构的早期预览版。该模型采用 125B 参数主模型加 51B N-gram Embedding,每 token 激活 6B 参数,共 48 层,MoE 层使用 512 个专家和 top-10 路由。

  3. Qwen3.8-Flash-Next:6B激活参数击败Claude Opus 4.6 Max
    X:Kim (@kimmonismus)

    Qwen3.8-Flash-Next 正式发布,这是一款高度稀疏的 MoE 模型,总参数 125B 外加 51B N-gram 嵌入,但每个 token 仅激活 6B 参数。