STORY · 事件进行中

Alibaba Qwen 发布 Qwen3.8-Flash

2 个精选信源 · 2 篇报道持续 1最新动态 42分钟前
最新进展

阿里通义 Qwen3.8-Flash 发布开源:125B 参数 MoE 模型,训练成本仅为前代 1/9

DIGEST

事件全貌

AI 综述 · 更新于 10分钟前

通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,也是 Qwen4 架构的早期预览,现已开放权重。该模型总参数量 125B,每 token 仅激活 6B,原生上下文 262K,可扩展至 1M。

训练成本仅为 Qwen3.7-Plus 的 1/9,并在编码和办公任务上表现更优。

本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。

24 HOURS

本事件热度走势

当前热度 37峰值 378月26日 22:00近24小时变化

移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。

TIMELINE

报道时间线

2 条公开报道 · 官方一手 1 条 · 最新在前
  1. 阿里通义 Qwen3.8-Flash 发布开源:125B 参数 MoE 模型,训练成本仅为前代 1/9
    IT之家(RSS)

    阿里通义千问团队发布 Qwen3.8-Flash,这是一款 125B 参数的多模态 MoE 模型,每 token 激活 6B 参数,原生支持 262,144 tokens 上下文,并可通过 YaRN 扩展至 1M tokens。

  2. 通义千问发布 Qwen3.8-Flash,多模态 MoE 模型,Qwen4 架构早期预览
    X:通义千问 / Qwen (@Alibaba_Qwen)官方一手精选

    通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,也是 Qwen4 架构的早期预览,现已开放权重。该模型总参数量 125B,每 token 仅激活 6B,原生上下文 262K,可扩展至 1M;训练成本仅为 Qwen3.7-Plus 的 1/9,并在编码和办公任务上表现更优。