跳到正文
原文
OpenAI·· 3 天前AI 评分42

OpenAI 挫败协同模型蒸馏攻击

Disrupting a coordinated model-distillation campaign

AI 导读

OpenAI 成功挫败了一项旨在提取受保护模型推理过程的协同蒸馏攻击活动。该事件凸显了针对大语言模型的对抗性蒸馏威胁,OpenAI 正着手加强相关防御机制以应对此类安全挑战。

来源:OpenAI · openai.com