STORY · 事件已收束

Deltafin 在 M1 Max 上运行 Kimi K3 实现 0.0687 token/s 推理

1 个精选信源 · 1 篇报道持续 1最新动态 9天前
最新进展

在 M1 Max 上运行 2.8T 参数的 Kimi K3:Deltafin 项目实现 0.0687 token/s 推理

TIMELINE

报道时间线

1 条公开报道 · 官方一手 0 条 · 最新在前
  1. 在 M1 Max 上运行 2.8T 参数的 Kimi K3:Deltafin 项目实现 0.0687 token/s 推理
    Hacker News 热门(buzzing.cc 中文翻译)精选

    Deltafin 项目成功在 64 GB M1 Max 上运行了 2.8T 参数的 MoE 模型 Kimi K3,当前中位推理速度为 0.0687 token/s(14.6 秒/token)。完整安装需约 1.7 TB 本地磁盘,流式模式仅需 215 GB 但推理速度降至 3 分钟以上/token。项目提供 OpenAI 兼容 API 服务器,支持聊天和代码补全,但建议客户端超时设为小时级别。