公众号正文需在微信内阅读,站内仅提供摘要。
蚂蚁百灵开源 Ling-3.0-flash:124B 总参数 MoE 模型,支持 API、单机与高性能三种部署
AI 导读
蚂蚁百灵正式开源新一代原生混合推理模型 Ling-3.0-flash,采用 124B 总参数、5.1B 激活参数的 MoE 架构,并提供 FP8、FP4、INT4 等多个版本。
公众号正文需在微信内阅读,站内仅提供摘要。
来源:公众号:蚂蚁百灵(Ling)· mp.weixin.qq.com
蚂蚁百灵正式开源新一代原生混合推理模型 Ling-3.0-flash,采用 124B 总参数、5.1B 激活参数的 MoE 架构,并提供 FP8、FP4、INT4 等多个版本。
提供FP4/INT4量化版本并验证单机推理,让数据敏感、预算有限的团队也能本地运行千亿参数模型,将大模型能力从云端拉回到可控环境。
公众号正文需在微信内阅读,站内仅提供摘要。
来源:公众号:蚂蚁百灵(Ling) · mp.weixin.qq.com
蚂蚁百灵正式开源新一代原生混合推理模型 Ling-3.0-flash,采用 124B 总参数、5.1B 激活参数的 MoE 架构,并提供 FP8、FP4、INT4 等多个版本。
公众号正文需在微信内阅读,站内仅提供摘要。
来源:公众号:蚂蚁百灵(Ling)· mp.weixin.qq.com