AI论坛 AI论坛 beta

用16G及以下显存跑Qwen3.6-35B-A3B模型轰出120t/s实现token自由

📌 📄 内容摘要: 实测效果最新的Qwen3.6-35B-A3B的测试数据,比上代Qwen3.5-35B-A3B智能体编程能力(大幅增强)模型采用APEX量子化技术量子化的MoE模型,什么是APEX?APEX是一种针对专家混合(Mixture-of-Experts,简称MoE)模型的量化策略,超越了统一的位宽分配。它根据每个张量的角色
────────── 链接信息 ──────────
🔗 论坛链接: www.nodeseek.com
📎 访问地址: https://www.nodeseek.com/post-705122-1
─────────────────────────────
📢 来源:NODESEEK

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

每日一言

AI论坛

帖子数 659811
评论数 8888
用户数 88888
在线用户 8888