📌 📄 内容摘要:
AirM5标准本,用新出的GoogleTurboQuant搭建了本地模型Qwen3.5-9B,速度18tokens/sec,内存压力有点上去,稍微发烫,总体表现还可以。4B就稳得很,25tokens/sec,几乎不带升温,内存压力还是绿色的。就是不知道为什么Apple自家的MLX模型都是失败,包括Qwen3.5-4
────────── 链接信息 ──────────
🔗 论坛链接: www.nodeseek.com
📎 访问地址: https://www.nodeseek.com/post-668375-1
─────────────────────────────
📢 来源:NODESEEK