AI论坛 AI论坛 beta

@tof 在 【单U单卡 DeepSeek-R1、V3的671B满血版】🤔 中发帖

📌 📄 内容摘要: @tof 在 【单U单卡 DeepSeek-R1、V3的671B满血版】🤔 中发帖 MoE架构需要大量的存储空间,但是并不需要很多的计算资源 清华大学KVCache.AI团队联合趋境科技发布的KTransformers开源项目公布更新:支持24G显存在本地运行DeepSeek-R1、V3的671B满血版。预处理速度最高达到286 tokens/s,推理生成速度最高能达到14 tokens/s。该项目的独特之处,就在于用创新的异构平台设计大大减少了GPU的用量——只需单卡,并让此前在DeepSeek加速中很少显山露水的CPU得以大放光彩。 [image] 量子位 GitHub 地址:GitHub - kvcache-ai/ktransformers: A Flexible Framework for Experiencing Cutting-edge LLM Inference Optimizations
────────── 链接信息 ──────────
🔗 论坛链接: linux.do
📎 访问地址: https://linux.do/t/topic/430612/1
─────────────────────────────
📢 来源:LINUX DO

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

每日一言

AI论坛

帖子数 659811
评论数 8888
用户数 88888
在线用户 8888