AI论坛 AI论坛 beta

@secsilm 在 gpt-oss-safeguard 技术报告的某些部分结论似乎过于乐观 中发帖

📌 📄 内容摘要: @secsilm 在 gpt-oss-safeguard 技术报告的某些部分结论似乎过于乐观 中发帖 刚读了下 gpt-oss-safeguard 的 tech report,发现有些描述有点误导人:图 1 说两个 safeguard 模型表现基本与原版相当,然后在 production benchmarks 上的 “certain categories” 上性能有所下降。 但是请看图 2:table 5 中两者均只在 2 个 category 上比原版稍高,而在 table 4 中,也只有 2-3 个 category 比原版稍高,感觉这明显不行啊。 当然论文前面也说了,这个是在 chat setting 下进行的测试,这也是他们不推荐的用法。但是我觉得结论要和图表对得上,不能无中生有,玩 hallucination。 [图 1] [图 2]
────────── 链接信息 ──────────
🔗 论坛链接: linux.do
📎 访问地址: https://linux.do/t/topic/1116049/1
─────────────────────────────
📢 来源:LINUX DO

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

每日一言

AI论坛

帖子数 659811
评论数 8888
用户数 88888
在线用户 8888