STORY · 事件已收束

MaxProof框架:MiniMax M3在IMO 2025和USAMO 2026超越人类金牌线

9 个精选信源 · 20 篇报道持续 8最新动态 57天前
最新进展

MaxProof框架:MiniMax M3在IMO 2025和USAMO 2026超越人类金牌线

TIMELINE

报道时间线

20 条公开报道 · 官方一手 16 条 · 最新在前
  1. MaxProof框架:MiniMax M3在IMO 2025和USAMO 2026超越人类金牌线
    MiniMax:Blog(网页)官方一手精选

    MiniMax M3采用MaxProof框架,在IMO 2025和USAMO 2026两项数学奥赛基准上超越人类金牌线。框架分三阶段训练:Proof RL使用生成式验证器提供奖励,进行长程强化学习提升证明生成能力;Verifier Alignment将验证对齐为错误定位任务;Refinement Augmentation利用训练中产生的错误证明与验证分析对,通过拒绝采样微调修复能力。三者合并为M3通用模型。系统通过低假阳性率过滤噪声,保证RL稳定性。

  2. MiniMax M3 1M token 解码加速 15.6 倍
    X:MiniMax (@MiniMax_AI)官方一手

    15.6× faster decoding at 1M tokens 🔥 感谢 @FireworksAI_HQ 为 M3 提供推理支持。 立即尝试 👇

  3. MiniMax M3联袂Mem0推持久记忆AI
    X:MiniMax (@MiniMax_AI)官方一手精选

    Mem0 是 MiniMax M3 的官方启动合作伙伴! M3 的 1M token 上下文窗口 + @mem0ai 的记忆层 = 真正记住的 AI 应用。 构建具有持久记忆的个性化 AI 智能体,现在启动周内 M3 享五折优惠。 开始使用 Minimax → https://platform.minimax.io/docs/guides/models-intro 注册 mem0 → http://app.mem0.ai/?utm_source=minimax_x_post

  4. MiniMax-M3 多模态模型发布,开源权重新SOTA
    X:MiniMax (@MiniMax_AI)官方一手精选

    MiniMax-M3 在 @ValsAI 排名中位列第六 新的开源权重 SOTA 🚀

  5. MiniMax开源M3模型发布:结合编程智能体、长上下文与多模态能力
    X:MiniMax (@MiniMax_AI)官方一手

    MiniMax宣布推出首个开源权重模型M3。该模型结合了三大前沿能力:在编程与智能体方面,它在SWE-Bench Pro等评测上取得了具体分数;通过MiniMax Sparse Attention技术,其上下文窗口可扩展至1M tokens;并且模型从零开始原生支持多模态。模型的权重与技术报告将在约10天后发布。

  6. MiniMax M3 模型上线 Cloudflare AI Gateway
    X:MiniMax (@MiniMax_AI)官方一手精选

    M3 on Cloudflare AI Gateway, day one ⚡ 前沿编码能力,1M 上下文,原生多模态,现在一次 fetch 即可调用。 是时候构建些东西了。 🦞

  7. MiniMax M3模型与智能体对齐实践
    X:MiniMax (@MiniMax_AI)官方一手

    这就是模型与智能体对齐的样子 🤝 @SimularAI

  8. MiniMax M3模型登陆Qubrid AI平台,早期用户享半价
    X:MiniMax (@MiniMax_AI)官方一手

    MiniMax的M3模型现已在Qubrid AI平台上线。该模型具备100万token上下文、原生多模态、前沿的代码性能,并支持长期智能体工作流,被评为年度技术上最有趣的开放权重模型之一。Qubrid AI作为首发合作伙伴,为早期用户提供50%的折扣。

  9. MiniMax发布开源模型M3,集成编码、长上下文与多模态三大能力
    X:Kim (@kimmonismus)

    MiniMax发布开源模型M3,它是首个将前沿编码能力、1M token上下文窗口与原生多模态集成于单一系统的开源模型。M3在SWE-Bench Pro上得分为59.0%,略高于GPT-5.5(58.6%)与Gemini 3.1 Pro(54.2%);在BrowseComp自主浏览任务中以83.5%领先Opus 4.7。此外,模型在Terminal Bench 2.1(66.0%)、MCP Atlas(74.2%)等基准上表现优异。其每token成本约为GPT-5.5的十二分之一,模型权重及技术报告预计在10天后发布。

  10. MiniMax M3 现已上线 SiliconFlow 平台
    X:硅基流动 SiliconFlow (@SiliconFlowAI)官方一手

    MiniMax M3 现已在 SiliconFlow 平台上线,并提供限时7天的50%折扣。定价为:缓存 $0.06、输入 $0.30、输出 $1.20(每百万 token)。M3 是首个同时具备三大前沿能力的开源模型:一是编码与智能体能力,在 SWE-Bench Pro 评测中击败了 GPT-5.5 和 Gemini 3.1 Pro;二是支持 100万 token 上下文窗口(通过 MiniMax Sparse Attention 技术实现);三是具备原生多模态能力,支持图像、视频与计算机操作。

  11. MiniMax 发布 M3 模型
    X:karminski (@karminski3)

    MiniMax 发布新模型 MiniMax M3,声称是首个同时整合三项前沿能力的开源权重模型。这三项能力为:编码与智能体前沿能力,在 SWE-Bench Pro 等基准测试中取得具体分数;MiniMax 稀疏注意力机制将上下文长度扩展至 1M;以及原生多模态能力。模型权重与技术报告预计在约 10 天后发布。

  12. MiniMax M3 模型在 Novita AI 平台上线
    X:MiniMax (@MiniMax_AI)官方一手

    MiniMax M3 模型现已在 Novita AI 平台上线,并提供首周半价优惠。作为首个开源权重模型,它集成了前沿编码与智能体能力,在 SWE-Bench Pro 上得分 59.0%,Terminal Bench 2.1 上得分 66.0%,MCP Atlas 上得分 74.2%。该模型上下文窗口最高可达 1M tokens,由 MiniMax Sparse Attention 技术支持,并从一开始即支持原生多模态,可处理文本与视觉理解任务。Novita AI 作为其 Day-0 API 发布合作伙伴,为开发者提供接入服务。

  13. MiniMax发布开源模型M3
    X:Testing Catalog (@testingcatalog)

    MiniMax发布了新开源权重模型M3,现已通过API和MiniMax Agent提供服务。该模型在SWE-Bench Pro上得分59.0%,在Terminal Bench 2.1上得分66.0%,并支持高达1M的上下文窗口。同时,MiniMax Agent更新了持久记忆与进化技能等能力。此外,MiniMax Code也已发布,模型权重与技术报告将在约10天后公开。

  14. MiniMax发布M3模型,支持实时音视频交互
    X:MiniMax (@MiniMax_AI)官方一手

    出发吧🔥 M3 + @visionagents_ai 实现实时语音与视频 去构建些令人兴奋的东西吧! [引用 @visionagents_ai]:祝贺 @MiniMax_AI 团队发布 M3! 👉 一款前沿级开源权重模型 👉 100万 token 上下文窗口 👉 原生多模态(图像与视频)

  15. MiniMax M3:前沿编码、100万token上下文与原生多模态一体模型
    MiniMax:Blog(网页)官方一手精选

    MiniMax M3 是一个开源前沿模型,具备先进的编码与AI智能体能力。它支持100万token的超长上下文窗口,并采用名为MSA(MiniMax Sparse Attention)的新型稀疏注意力架构。该架构使模型在100万token上下文下的每token计算成本降至前代的1/20,预填充速度提升9倍以上,解码速度提升15倍以上。在SWE-Bench Pro编码基准上,MiniMax M3得分59.0%,超越GPT-5.5和Gemini 3.1 Pro,性能接近Opus 4.7。该模型可通过MiniMax Code、Token Plan和API服务使用。

  16. MiniMax-M3上线OpenRouter,首周半价
    X:MiniMax (@MiniMax_AI)官方一手

    M3在我们发布当天就登陆了OpenRouter 🔥。 100万token上下文,前沿编码+智能体能力,原生多模态。首周半价。

  17. MiniMax-M3上线OpenRouter,支持百万上下文
    X:OpenRouter (@OpenRouter)官方一手

    MiniMax-M3现已在OpenRouter上线! 一款前沿级开源权重模型,结合了1M-token上下文窗口、前沿的编码和智能体性能,以及原生多模态(图像与视频)能力。

  18. MiniMax M3:首个融合三大前沿能力的开源模型
    X:MiniMax (@MiniMax_AI)官方一手

    介绍 MiniMax M3:首个融合三大前沿能力的开源权重模型 - 编码与智能体前沿:59.0% SWE-Bench Pro,66.0% Terminal Bench 2.1,34.8% SWE-fficiency,28.8% KernelBench Hard,74.2% MCP Atlas - MiniMax Sparse Attention 将上下文窗口扩展至 1M - 从零开始原生多模态 API:http://platform.minimax.io Token 计划:https://platform.minimax.io/subscribe/token-plan 🚀新!MiniMax Code:http://code.minimax.io 权重与技术报告将在约 10 天内发布

  19. 首个三项能力兼备的国产旗舰模型:MiniMax M3 发布,百万上下文、原生多模态
    IT之家(RSS)

    MiniMax 发布旗舰大语言模型 M3,宣称是首个同时具备编码与智能体能力、百万上下文与原生多模态的国产模型。模型基于自研 MSA 架构,API 上下文窗口最高支持 1M tokens,保障至少 512K 可用。在 BrowseComp 智能体评测中,M3 以 83.5 分超越 Opus 4.7(79.3)。官方提供 M3 与 M3-highspeed 两个版本 API,标准版定价为输入 2.1 元、输出 8.4 元/百万 tokens(上下文≤512K,限时五折),并即将在 HuggingFace 与 GitHub 开源。

  20. MiniMax M3 发布:1M 上下文、原生多模态、前沿编程与 Agent 能力
    公众号:MiniMax(稀宇科技)官方一手

    MiniMax M3 今日发布,采用自研 MSA 稀疏注意力架构,支持 1M 上下文窗口,100 万上下文下每 token 计算量仅为上代 1/20,prefilling 加速超 9 倍,decoding 加速超 15 倍。它是原生多模态模型,支持图片、视频输入及 Computer Use。Coding 与 Agent 能力在 SWE-Bench Pro(59.0%)、Terminal Bench 2.1(66.0%)等基准达到前沿水平。M3 是国内首个同时具备 1M 上下文、原生多模态、前沿编程与 Agent 能力的开源模型。API 已开放,按上下文分两档计价,上线首 7 天 512k 及以下 5 折。同步推出 MiniMax Code Agent 与 Token Plan 订阅(¥49/月起)。预计 10 天内发布技术报告并开源模型权重。