OpenAI News·· 2025-08-27精选AI 评分65
OpenAI 与 Anthropic 分享首次联合安全评估结果
OpenAI and Anthropic share findings from a joint safety evaluation
AI 导读
OpenAI 与 Anthropic 发布了首个同类联合安全评估结果,两家机构互相测试对方模型的对齐性、指令遵循、幻觉及越狱能力。该评估凸显了跨实验室协作在识别安全挑战方面的价值及进展。
推荐理由
原文展示了跨实验室协作测试模型对齐、幻觉及越狱风险的罕见路径,读者可据此理解安全评估的新合作模式。
来源:OpenAI News · openai.com