AI论坛 AI论坛 beta

@xueluo 在 OpenAI 首次与 Anthropic 合作进行 AI 安全性评估 中发帖

📌 📄 内容摘要: @xueluo 在 OpenAI 首次与 Anthropic 合作进行 AI 安全性评估 中发帖 OpenAI blog Anthropic blog 简单总结:在gpt5、claude-opus-4.1发布前两家公司分别对对方的公开 AI 模型进行了安全测试,测试结果显示 O3 在大多数测试上表现优异,Claude 模型在遵守复杂指令和避免不实信息生成方面表现出色,但在抵抗越狱攻击方面稍弱,两家公司模型除 O3 外大多都存在“掐媚”的问题。
────────── 链接信息 ──────────
🔗 论坛链接: linux.do
📎 访问地址: https://linux.do/t/topic/911847/1
─────────────────────────────
📢 来源:LINUX DO

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

每日一言

AI论坛

帖子数 659811
评论数 8888
用户数 88888
在线用户 8888