STORY · 事件已收束

Ant Group 发布 Ling-3.0-flash 混合推理 MoE 模型

4 个精选信源 · 7 篇报道持续 1最新动态 13天前
最新进展

蚂蚁百灵发布Ling-3.0-flash,vLLM即将支持

TIMELINE

报道时间线

7 条公开报道 · 官方一手 6 条 · 最新在前
  1. 蚂蚁百灵发布Ling-3.0-flash,vLLM即将支持
    X:蚂蚁百灵 (@AntLingAGI)官方一手

    蚂蚁百灵发布Ling-3.0-flash,一个124B参数的MoE模型,每token仅激活5.1B参数,采用混合线性注意力机制并支持原生256K上下文。vLLM团队确认其开源支持将在模型权重开源时同步上线,并称赞百灵团队“先公告、后开源”的发布模式为社区提供了稳定的适配窗口。

  2. 蚂蚁集团发布百灵原生混合推理模型 Ling-3.0-flash
    IT之家(RSS)

    蚂蚁集团发布百灵新一代原生混合推理模型 Ling-3.0-flash,总参数量 124B,激活参数量仅 5.1B,能力对标甚至超越上一代 1T 级旗舰 Ring-2.6-1T。该模型采用原生混合线性注意力架构,长输入下 TTFT 降低 60% 至 80%+。即日起至 8 月 3 日,模型在 OpenRouter 与百灵官方平台开放限时免费 API 调用,免费期结束后将正式开源。

  3. 蚂蚁百灵发布Ling-3.0-flash原生混合推理模型
    公众号:蚂蚁百灵(Ling)官方一手精选

    蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-flash,总参数量124B,激活参数量仅5.1B,在传统推理、指令遵循与长文本等指标上对标甚至超越上一代旗舰Ring-2.6-1T。模型采用原生混合线性注意力架构与1/64稀疏MoE,并扩展至10,000+可交互训练环境,长输入下TTFT降低60%至80%以上。

  4. 蚂蚁百灵发布 Ling-3.0-flash:124B 总参数、5.1B 激活,对标 1T 级旗舰
    公众号:蚂蚁百灵(Ling)官方一手精选

    蚂蚁百灵发布新一代原生混合推理模型 Ling-3.0-flash,总参数量 124B、激活参数仅 5.1B,约为上一代 1T 级旗舰 Ring-2.6-1T 的 12.4% 和 8.1%,却在多项指标上对齐甚至超越后者。

  5. 蚂蚁百灵Ling-3.0-flash上线OpenCode免费使用
    X:蚂蚁百灵 (@AntLingAGI)官方一手

    Token效率对于可持续使用极为重要。非常感谢@novita_labs和@opencode团队在发布日的合作!

  6. 蚂蚁百灵发布Ling-3.0-flash混合推理MoE模型
    X:蚂蚁百灵 (@AntLingAGI)官方一手

    今天,我们发布Ling-3.0-flash——一个为生产级智能体构建的混合推理MoE模型。 124B参数。每个token仅激活5.1B。 以1/8的总参数和1/12的激活参数,它在所示大多数基准测试中匹配或超越我们的1T旗舰模型。

  7. 蚂蚁百灵发布 Ling-3.0-flash:124B 总参数、5.1B 激活参数,智能密度超越 1T 级旗舰
    蚂蚁百灵:Developer Blog(网页)官方一手精选

    蚂蚁百灵正式发布新一代原生混合推理模型 Ling-3.0-flash,总参数 124B、激活参数仅 5.1B。该模型以极致智能密度对标并超越上一代 1T 级旗舰思考模型 Ring-2.6-1T。