跳到正文
OpenAI News·· 4 天前精选AI 评分64

OpenAI 披露挫败协调式模型蒸馏攻击并强化防御

Disrupting a coordinated model-distillation campaign

AI 导读

OpenAI 披露其成功挫败了一场旨在提取受保护模型推理能力的协调式模型蒸馏攻击,并宣布正加强针对此类对抗性蒸馏的安全防御机制。

推荐理由

OpenAI 披露了针对模型蒸馏攻击的防御行动,展示了应对对抗性提取保护模型推理能力的新进展。

来源:OpenAI News · openai.com