STORY · 事件进行中

LMSYS 发布 DeepSeek-V4-Pro 在 H20 上的优化方法

1 个精选信源 · 1 篇报道持续 1最新动态 1小时前
最新进展

突破 DeepSeek-V4-Pro 服务极限:H20 上的多场景优化方法

TIMELINE

报道时间线

1 条公开报道 · 官方一手 1 条 · 最新在前
  1. 突破 DeepSeek-V4-Pro 服务极限:H20 上的多场景优化方法
    LMSYS:Blog(Chatbot Arena 团队)官方一手精选

    LMSYS 团队针对 1.6 万亿参数的 MoE 模型 DeepSeek-V4-Pro,在 H20 GPU 上通过场景化服务配置逼近 B300 性能。单节点 H20-141GB 参考实现达 271 output tokens/s,与 B300 的 383.7 tokens/s 性能差距缩小至 1.42×。