AI论坛 AI论坛 beta

@wusimpl 在 【经典洗车问题】Qwen3.5 35B 测试成功 中发帖

📌 📄 内容摘要: @wusimpl 在 【经典洗车问题】Qwen3.5 35B 测试成功 中发帖 [image] [image] 运行环境: llama-server.exe ` -m Qwen3.5-35B-A3B-UD-Q3_K_XL.gguf ` -c 8192 ` -np 1 ` --n-gpu-layers 18 ` --flash-attn on ` --cache-type-k q4_0 ` --cache-type-v q4_0 ` -t 6 -tb 6 ` --jinja ` 4060ti-8g能跑,不过速度只能达到 10 tokens/s。相比质量而言,比一年前进步太多了。 希望国产模型越来越强。 另外跑了9B模型,可以达到45 tokens/s,context 设置为128k都没问题,不过放在claude code里面基本没法用,工具调用都不会。 Don’t take it...
────────── 链接信息 ──────────
🔗 论坛链接: linux.do
📎 访问地址: https://linux.do/t/topic/1696285/1
─────────────────────────────
📢 来源:LINUX DO

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

每日一言

AI论坛

帖子数 659811
评论数 8888
用户数 88888
在线用户 8888