公众号:MiniMax(稀宇科技)
精选
72AI 编辑部评分,满分 100

MiniMax 开源原生多模态旗舰模型 M3,总参数 428B

2026-06-15 22:40· 62天前· MiniMax 稀宇科技
AI 导读

MiniMax 上周五开源 M3 模型权重,并发布 MSA 稀疏注意力技术论文。M3 总参数 428B、激活参数 23B,是首个从 Step 0 进行多模态混合训练的开源模型,发布两周即在 Artificial Analysis 综合智能指数上位列全球开源模型第一。目前输出速度已从约 30 TPS 提升至约 80 TPS,官方称还将继续提速 30-40%。

推荐理由

MSA 注意力机制让长上下文计算成本大幅下降,对于在长文档处理或复杂推理场景下需要控制成本的团队,M3 的开源提供了一种新的选型依据。

公众号正文需在微信内阅读,站内仅提供摘要。

在微信中打开原文

来源:公众号:MiniMax(稀宇科技) · mp.weixin.qq.com

返回
精选AI 评分 72/100

MiniMax 开源原生多模态旗舰模型 M3,总参数 428B

公众号:MiniMax(稀宇科技)·2026-06-15 22:40·62天前·MiniMax 稀宇科技
AI 导读

MiniMax 上周五开源 M3 模型权重,并发布 MSA 稀疏注意力技术论文。M3 总参数 428B、激活参数 23B,是首个从 Step 0 进行多模态混合训练的开源模型,发布两周即在 Artificial Analysis 综合智能指数上位列全球开源模型第一。目前输出速度已从约 30 TPS 提升至约 80 TPS,官方称还将继续提速 30-40%。

公众号正文需在微信内阅读,站内仅提供摘要。

在微信中打开原文(在新标签页打开)

来源:公众号:MiniMax(稀宇科技)· mp.weixin.qq.com