STORY · 事件已收束

Moonshot AI 开源 Kimi K3

15 个精选信源 · 17 篇报道持续 1最新动态 10天前
最新进展

Kimi K3 全栈开源,逼近闭源旗舰

TIMELINE

报道时间线

17 条公开报道 · 官方一手 5 条 · 最新在前
  1. Kimi K3 全栈开源,逼近闭源旗舰
    X:阿易 AI Notes (@AYi_AInotes)

    月之暗面正式全栈开源 K3 模型,2.8T 总参数 MoE(激活 104B),原生 100 万上下文。通过 KDA 注意力和 AttnRes 架构,单位算力智能密度提升 2.5 倍,长上下文解码速度提升 6 倍。除全权重外,还开源了 FlashKDA 推理内核、MoE 通信库及 Agent 训练环境 AgentENV,杨植麟表示开源是长期策略。

  2. Kimi K3 开放日:模型权重、技术报告和关键 Infra 技术同步开放
    公众号:月之暗面(Kimi)官方一手精选

    月之暗面发布 2.8 万亿参数的混合专家模型 Kimi K3,支持原生视觉理解和 100 万 token 上下文窗口。其规模化效率较 Kimi K2.5 提升 2.5 倍,并同步开源模型权重、技术报告及 MoonEP、FlashKDA、AgentEnv 三项 Infra 技术。

  3. 黄仁勋、Kimi K3,与一场即将到来的开源战争
    公众号:数字生命卡兹克

    7月27日,月之暗面正式开源全球首个3T级模型Kimi K3,含2.8万亿总参数、1040亿激活参数,并公开47页技术报告及MoonEP、FlashKDA等关键基础设施。此前美国白宫指控K3蒸馏Claude模型,黄仁勋联合英伟达、微软、OpenAI等77家组织反对封禁中国开源模型。

  4. Kimi K3 发布:2.8T 参数开源混合专家模型
    HuggingFace Daily Papers(社区热门论文)

    月之暗面发布 Kimi K3,一个 2.8T 参数(104B 激活参数)的混合专家模型,支持原生视觉和百万 token 上下文窗口。该模型在长程编码、智能体、知识、推理和视觉任务上达到前沿水平,整体性能优于其他开源及闭源模型,但落后于 Claude Fable 5 和 GPT-5.6 Sol。Kimi K3 的完整模型权重已开源。

  5. Kimi K3 发布,开源模型与闭源差距缩小至 4 分
    X:Artificial Analysis (@ArtificialAnlys)

    开源权重智能今日迎来重大进展,Kimi K3 正式发布。在 Artificial Analysis 智能指数上,领先闭源模型与开源权重模型之间的差距已缩小至仅 4 分,这是自 2 月 GLM-5 发布以来的最小差距。 @Kimi_Moonshot 的 Kimi K3 在 Artificial Analysis 智能指数上获得 57 分。目前仅有两家实验室拥有得分更高的模型:@AnthropicAI(Claude Opus 5 得分 61,Claude Fable 5 得分 60)和 @OpenAI(GPT-5.6 Sol 得分 59)。

  6. Moonshot AI 开源 Kimi K3 模型权重与基础设施,称每单位算力智能度提升 2.5 倍
    The Decoder:AI News(RSS)

    Moonshot AI 发布了 Kimi K3 的模型权重与技术报告,并在 Hugging Face 上开源了高性能注意力内核、MoE 通信库等基础设施组件。新架构声称每单位算力的智能度提升 2.5 倍。该模型在基准测试中接近 Fable 5 和 GPT-5.6 Sol 等西方前沿模型,但英国网络研究所的独立测试显示其网络能力和数学技能仍落后于前沿模型。

  7. Kimi K3 技术报告发布:百万 token 上下文与 2.5 倍效率提升
    X:Rohan Paul (@rohanpaul_ai)

    Kimi K3 发布技术报告,这是一款 2.8T MoE 模型,原生支持视觉理解与百万 token 上下文窗口。其架构和训练方案相比 Kimi K2 将整体扩展效率提升了约 2.5 倍,通过 Kimi Delta Attention、NoPE、跨深度注意力残差及 896 专家 MoE 等设计实现。模型权重、技术报告及配套高性能内核与基础设施已开源。

  8. SGLang 和 Miles 为月之暗面 2.8T 参数 Kimi K3 模型提供发布当日支持
    LMSYS:Blog(Chatbot Arena 团队)官方一手

    SGLang 和 Miles 为月之暗面开源的 2.8T 参数模型 Kimi K3 提供发布当日支持,分别负责推理和 RL 训练。K3 采用 69 层 KDA 线性注意力与 24 层 MLA 交错的混合架构,在 SGLang 上单卡 batch-1 解码速度达约 113 tok/s,结合 DSpark 推测解码可达约 423 tok/s。

  9. 月之暗面K3全栈开源,2.8T参数模型逼近闭源
    X:阿易 AI Notes (@AYi_AInotes)

    月之暗面开源Kimi K3,一个2.8T总参数、104B激活参数的MoE模型,原生支持100万token上下文窗口。新架构KDA和AttnRes使单位算力智能密度提升2.5倍,长上下文解码速度提升6倍。除模型权重外,还开源了高性能推理内核FlashKDA、MoE通信库及Agent训练环境AgentENV,将开源模型能力门槛抬至闭源旗舰水平。

  10. Moonshot AI 的 Kimi K3 模型性能媲美美国顶尖系统,成本极低且将免费开放权重
    The Verge:AI(RSS)

    Moonshot AI 的 Kimi K3 模型性能可媲美部分美国顶尖系统,但成本仅为其零头,且计划免费开放模型权重,直接瞄准美国用户。此举正动摇 OpenAI、Google 等闭源模型的统治地位,并引发美国科技界对开放权重模型战略价值的激烈辩论。

  11. Kimi K3 开源,1M 上下文自主建城
    X:硅基流动 SiliconFlow (@SiliconFlowAI)官方一手

    @Kimi_Moonshot 的猛兽——Kimi K3 现已开源,并上线 SiliconFlow。🚀 于是我们给了它一张空白地图 🗺️ 和一个任务:建造一座城市。🏙️ K3 先是撰写了一份 7000 多字的研究报告 📖,然后利用自己的发现来规划架构、编写代码、迭代,并从零开始交付一个可玩的结果。💻 1M 上下文 📚。长周期编码 🧠。原生多模态理解 👁️。智能体执行 🤖。无剧透——在 SiliconFlow 上看 K3 建造。👇

  12. 月之暗面开源 Kimi K3 模型,2.8 万亿参数
    IT之家(RSS)

    月之暗面正式开源 Kimi K3 模型,该模型拥有 2.8 万亿参数、100 万 token 上下文窗口,并原生支持视觉理解。Kimi K3 基于 KDA 混合线性注意力机制构建,结合 Stable LatentMoE 框架在 896 个专家中激活 16 个,整体扩展效率相比 K2 提升约 2.5 倍。

  13. Kimi K3 上线 Modal,支持无损加速推理
    X:Kimi.ai (@Kimi_Moonshot)官方一手

    很高兴 @modal 成为 Kimi K3 的 Day 0 发布合作伙伴! 他们为 K3 的架构训练了自定义 DFlash 投机器,实现更快推理且无质量损失。

  14. Kimi K3 模型正式发布
    X:AK (@_akhaliq)

    Kimi K3 已发布 https://huggingface.co/moonshotai/Kimi-K3

  15. Kimi K3 开源:2.8T MoE 模型,1M 上下文
    X:Elvis Saravia (@omarsar0, DAIR.AI)

    月之暗面(Kimi)发布其最强模型 Kimi K3,这是一个 2.8T 参数的 MoE 模型,具备原生视觉理解能力和 1M token 上下文窗口。新架构实现了每单位计算 2.5 倍的智能提升,而非单纯增加参数。同时,Kimi 还开源了高性能注意力内核、MoE 通信库及大规模智能体环境运行基础设施。

  16. Kimi K3 开源:2.8T MoE 模型与技术报告
    X:Kimi.ai (@Kimi_Moonshot)官方一手精选

    Kimi 发布其最强模型 Kimi K3,这是一个 2.8T 参数的 MoE 模型,具备原生视觉理解和 1M token 上下文窗口。新架构实现了每单位计算 2.5 倍的智能提升。除模型权重外,Kimi 还开源了高性能注意力内核、MoE 通信库及大规模智能体运行环境基础设施。

  17. 月之暗面开源Kimi K3:2.8T MoE模型
    X:Kim (@kimmonismus)

    月之暗面(Moonshot AI)正式开源其最强模型Kimi K3的权重与技术报告。K3是一个2.8T参数的MoE模型,具备原生视觉理解能力和1M-token上下文窗口。新架构实现了单位计算量2.5倍的智能提升,同时开源了高性能注意力内核、MoE通信库及智能体环境运行基础设施。