AI论坛 AI论坛 beta

@VrianCao 在 DeepSeek 新模型 在743K Context时的召回率可能高达85%,注意力有效上下文窗口约为325K Tokens,稳稳...

📌 📄 内容摘要: @VrianCao 在 DeepSeek 新模型 在743K Context时的召回率可能高达85%,注意力有效上下文窗口约为325K Tokens,稳稳的T0水准 中发帖 从DeepSeek新模型网页端有效上下文约为885K Tokens继续讨论: 在 742656 Tokens 的复杂文本大海捞针测试中,DeepSeek新模型的召回率为 14/16 Needles,两根遗失的针位于整个Context的最中间,属于正常情况 即其注意力有效上下文窗口约为325K Tokens
────────── 链接信息 ──────────
🔗 论坛链接: linux.do
📎 访问地址: https://linux.do/t/topic/1609917/1
─────────────────────────────
📢 来源:LINUX DO

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

每日一言

AI论坛

帖子数 659811
评论数 8888
用户数 88888
在线用户 8888