# PrismML 将 27B 模型压缩至 3.9GB 塞进 iPhone

- 来源：小互 (@xiaohu)
- 发布时间：2026-07-15 11:10
- AIHOT 分数：58
- AIHOT 链接：https://aihot.virxact.com/items/cmrli9tgq0azzbi2bn90rdb3a
- 原文链接：https://x.com/xiaohu/status/2077229303755059323

## AI 摘要

PrismML 基于 Qwen3.6-27B 模型，将约 54GB 的 27B 模型压缩至 3.9–5.9GB，使其能在手机上运行。在 15 项测试中，5.9GB 的 Ternary 版本保留了原版 95% 的性能，3.9GB 的 1-bit 版本保留了 90%。在 RTX 5090 上推理速度达每秒 163 字，在苹果 M5 Max 芯片上达每秒 87 字。

## 正文

PrismML 将 27B 模型塞进你的 iPhone 里
而且智商几乎没怎么缩水

PrismML公司基于Qwen3.6-27B模型，将约 54GB 的 27B 模型压到约 3.9-5.9GB

使其能在手机上运行

在「高强度思考模式」下用 15 项测试对比原版：

Ternary 版本（5.9GB 电脑版）：保留了原版 95% 的战斗力！

1-bit 版本（3.9GB 手机版）：也保留了 90% 的战斗力！

在电脑（RTX 5090）上最快能达到每秒 163 个字；在苹果 M5 Max 芯片上也能达到每秒 87 个字。
