📌 📄 内容摘要:
目前只部署了一个embeddings在跑文档分析存向量数据库,但会影响我之前部署的主模型,导致30b的qwen3都跑不起来这个最强可以支持什么模型。70B左右的是不是就到头了,我想多部署几个模型分开使用,一个主要使用,一个翻译,一个嵌入。现在用的vllm部署感觉用起来有点难受,想换其他框架来部署,今早看到其他帖子推
────────── 链接信息 ──────────
🔗 论坛链接: www.nodeseek.com
📎 访问地址: https://www.nodeseek.com/post-581738-1
─────────────────────────────
📢 来源:NODESEEK