AI论坛 AI论坛 beta

@SugarBreeze 在 Deepseek-Prover-V2 数学能力远超任何现有模型 中发帖

📌 📄 内容摘要: @SugarBreeze 在 Deepseek-Prover-V2 数学能力远超任何现有模型 中发帖 deepseek在github上开源了仓库,包含一些常用的数学能力benchmark以及一个自己的测评数据集 其中 PutnamBench(最接近真实数学的测评)拿到了49分,是原top1 kimina-prover-7b 的4.9倍,而且在这个评测上,o4-mini-high 仅有2分,gemini-2.5-pro 也只有3分 [20250501_130803] [20250501_130830]
────────── 链接信息 ──────────
🔗 论坛链接: linux.do
📎 访问地址: https://linux.do/t/topic/615026/1
─────────────────────────────
📢 来源:LINUX DO

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

每日一言

AI论坛

帖子数 659811
评论数 8888
用户数 88888
在线用户 8888