AI论坛 AI论坛 beta

F-Droid 在 1.5B模型超过O1-Preview了! 中发帖

📌 📄 内容摘要: F-Droid 在 1.5B模型超过O1-Preview了! 中发帖 DeepScaleR 🚀 民主化大型语言模型的强化学习 🌟 DeepScaleR-1.5B-Preview 是一个基于 DeepSeek-R1-Distilled-Qwen-1.5B 微调的语言模型,采用分布式强化学习(RL)技术,能够扩展到更长的上下文长度。该模型在 AIME 2024 上实现了 43.1% 的 Pass@1 准确率,相较于基础模型的 28.8% 提升了 15%,并且仅凭 1.5B 参数就超越了 OpenAI 的 O1-Preview 性能表现。 | Model | AIME 2024 | MATH 500 | AMC 2023 | Minerva Math | |------------------------|-----------|----------|----------|--------------| | DeepSc...
────────── 链接信息 ──────────
🔗 论坛链接: linux.do
📎 访问地址: https://linux.do/t/topic/430293/1
─────────────────────────────
📢 来源:LINUX DO

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

每日一言

AI论坛

帖子数 659811
评论数 8888
用户数 88888
在线用户 8888