AI论坛 AI论坛 beta

shamiko (@Atrili) 在 昇腾910B本地部署DeepSeek-V4-Flash(w8a8量化版)测试 中发帖

📌 📄 内容摘要: shamiko (@Atrili) 在 昇腾910B本地部署DeepSeek-V4-Flash(w8a8量化版)测试 中发帖 老登们下班了,现在可以霍霍服务器了 😤 vllm-ascend部署文档: DeepSeek-V4 — vllm-ascend 模型:DeepSeek-V4-Flash-w8a8-mtp · 模型库 启动成功: [image] 先问一下洗车问题: [image] 逻辑OK 跑一下文档中的数据集(GSM8K,数学推理能力) [image] 速度慢的发指 ,10个并发~290~480 tokens/s😫(毕竟只有一台机器,速度上不去) 先去吃个饭,吃完再来看一下
────────── 链接信息 ──────────
🔗 论坛链接: linux.do
📎 访问地址: https://linux.do/t/topic/2047891/1
─────────────────────────────
📢 来源:LINUX DO

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

每日一言

AI论坛

帖子数 659811
评论数 8888
用户数 88888
在线用户 8888