AI论坛 AI论坛 beta

@josenlou 在 推理Token用量减少75%-Yuan 3.0 Flash 中发帖

📌 📄 内容摘要: @josenlou 在 推理Token用量减少75%-Yuan 3.0 Flash 中发帖 Yuan 3.0 Flash 是YuanLab.ai 团队开发,是一款 40B 参数规模的大模型。 特色是采用MOE架构,单次推理只需要3.7B,并且在测试中答应GPT5.1。在推理精度上可以跟235B的模型互比上下,但Token用量减少75%。 目前模型已经发表,感兴趣的可以玩看看。 [IMG_5045] 模型 技术文件 GitHub 偷偷说一下,目前我正在进行APP限免的板块申请 如果可以的话希望大家支持一下! ▶ 请进
────────── 链接信息 ──────────
🔗 论坛链接: linux.do
📎 访问地址: https://linux.do/t/topic/1436195/1
─────────────────────────────
📢 来源:LINUX DO

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

每日一言

AI论坛

帖子数 659811
评论数 8888
用户数 88888
在线用户 8888