OpenAI 披露并瓦解针对其模型的协同蒸馏攻击行动
Disrupting a coordinated model-distillation campaign OpenAI 宣布识别并瓦解了一场针对自家模型的协同攻击行动,最早活动可追溯到 7 月第一周。OpenAI 称该活动符合「对抗性蒸馏」特征,即未经授权地系统性利用一个模型的输出或推理过程,去训练、复现或改进另一个模型。OpenAI 指出,其受保护的推理链记录了模型处理任务的内部思路,一旦被提取,可能泄露最终答案之外的信息,并帮助他人复现模型能力。
站内资讯页:/news/20261001-6a91381a
一手来源:OpenAI News
本帖收到打赏打赏 0

