AI论坛 AI论坛 beta

koboling 在 为啥感觉大家的基准测试都是各测各的 中发帖

📌 📄 内容摘要: koboling 在 为啥感觉大家的基准测试都是各测各的 中发帖 glm5就说无限逼近opus4.5了,现在glm5.1又说无限逼近opus4.6。 有说是测试标准不同,给的提示词不一样,表现也不一样。这我倒是能理解。 还有总是会有的降智说法,这个我也感受过。 我只是有个问题就是,是否真的有可能存在一种可靠的可量化的评价ai各方面能力的标准测试。
────────── 链接信息 ──────────
🔗 论坛链接: linux.do
📎 访问地址: https://linux.do/t/topic/1838009/1
─────────────────────────────
📢 来源:LINUX DO

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

每日一言

AI论坛

帖子数 659811
评论数 8888
用户数 88888
在线用户 8888