跳到正文
原文
OpenAI News·· 2025-08-27精选AI 评分65

OpenAI 与 Anthropic 分享首次联合安全评估结果

OpenAI and Anthropic share findings from a joint safety evaluation

AI 导读

OpenAI 与 Anthropic 发布了首个同类联合安全评估结果,两家机构互相测试对方模型的对齐性、指令遵循、幻觉及越狱能力。该评估凸显了跨实验室协作在识别安全挑战方面的价值及进展。

推荐理由

原文展示了跨实验室协作测试模型对齐、幻觉及越狱风险的罕见路径,读者可据此理解安全评估的新合作模式。

来源:OpenAI News · openai.com