Qwen@Alibaba_Qwen
46AI 编辑部评分,满分 100
2026-08-14 23:55· 50分钟前
AI 导读

通义千问开源 Qwen3.8-27B 小模型,SGLang 首日支持即上线。在单张 RTX 5090 上配合 NVFP4 与 DSpark 实现 206.1 tok/s 解码速度,DGX Spark 上为 38.28 tok/s。该模型在智能体规划与长程任务上树立小模型新标杆。

Yes, we are back👑, with 206 tok/s on a single RTX 5090! Amazing Day-0 work from the SGLang team. Give it a try~@sgl_project

SGLangThe king of small models is back! Qwen3.8-27B from @Alibaba_Qwen is open source, and Day-0 support is live in SGLang: - 206.1 tok/s decode on a single RTX 5090,...

来源:Qwen · x.com

Qwen · @Alibaba_Qwen · X·2026-08-14 23:55·50分钟前
AI 导读

通义千问开源 Qwen3.8-27B 小模型,SGLang 首日支持即上线。在单张 RTX 5090 上配合 NVFP4 与 DSpark 实现 206.1 tok/s 解码速度,DGX Spark 上为 38.28 tok/s。该模型在智能体规划与长程任务上树立小模型新标杆。

Yes, we are back👑, with 206 tok/s on a single RTX 5090! Amazing Day-0 work from the SGLang team. Give it a try~@sgl_project

SGLangThe king of small models is back! Qwen3.8-27B from @Alibaba_Qwen is open source, and Day-0 support is live in SGLang: - 206.1 tok/s decode on a single RTX 5090,...

来源:Qwen· x.com