Ant Group 发布 Ling-3.0-flash 混合推理 MoE 模型
蚂蚁百灵发布Ling-3.0-flash,vLLM即将支持
报道时间线
- 蚂蚁百灵发布Ling-3.0-flash,vLLM即将支持
蚂蚁百灵发布Ling-3.0-flash,一个124B参数的MoE模型,每token仅激活5.1B参数,采用混合线性注意力机制并支持原生256K上下文。vLLM团队确认其开源支持将在模型权重开源时同步上线,并称赞百灵团队“先公告、后开源”的发布模式为社区提供了稳定的适配窗口。
- 蚂蚁集团发布百灵原生混合推理模型 Ling-3.0-flash
蚂蚁集团发布百灵新一代原生混合推理模型 Ling-3.0-flash,总参数量 124B,激活参数量仅 5.1B,能力对标甚至超越上一代 1T 级旗舰 Ring-2.6-1T。该模型采用原生混合线性注意力架构,长输入下 TTFT 降低 60% 至 80%+。即日起至 8 月 3 日,模型在 OpenRouter 与百灵官方平台开放限时免费 API 调用,免费期结束后将正式开源。
- 蚂蚁百灵发布Ling-3.0-flash原生混合推理模型
蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-flash,总参数量124B,激活参数量仅5.1B,在传统推理、指令遵循与长文本等指标上对标甚至超越上一代旗舰Ring-2.6-1T。模型采用原生混合线性注意力架构与1/64稀疏MoE,并扩展至10,000+可交互训练环境,长输入下TTFT降低60%至80%以上。
- 蚂蚁百灵发布 Ling-3.0-flash:124B 总参数、5.1B 激活,对标 1T 级旗舰
蚂蚁百灵发布新一代原生混合推理模型 Ling-3.0-flash,总参数量 124B、激活参数仅 5.1B,约为上一代 1T 级旗舰 Ring-2.6-1T 的 12.4% 和 8.1%,却在多项指标上对齐甚至超越后者。
- 蚂蚁百灵Ling-3.0-flash上线OpenCode免费使用
Token效率对于可持续使用极为重要。非常感谢@novita_labs和@opencode团队在发布日的合作!
- 蚂蚁百灵发布Ling-3.0-flash混合推理MoE模型
今天,我们发布Ling-3.0-flash——一个为生产级智能体构建的混合推理MoE模型。 124B参数。每个token仅激活5.1B。 以1/8的总参数和1/12的激活参数,它在所示大多数基准测试中匹配或超越我们的1T旗舰模型。
- 蚂蚁百灵发布 Ling-3.0-flash:124B 总参数、5.1B 激活参数,智能密度超越 1T 级旗舰
蚂蚁百灵正式发布新一代原生混合推理模型 Ling-3.0-flash,总参数 124B、激活参数仅 5.1B。该模型以极致智能密度对标并超越上一代 1T 级旗舰思考模型 Ring-2.6-1T。