01OpenAIOpenAI挫败一起模型蒸馏攻击活动
OpenAI近日披露并挫败了一起针对其前沿模型的"蒸馏攻击"行动。所谓模型蒸馏,指的是通过大量调用目标模型的API接口,利用其输出结果训练出能力相近但成本更低的替代模型,属于一种典型的知识产权窃取手段。OpenAI并未在通报中披露攻击者的具体身份,但强调其安全团队已识别出具有协调性、规模化的滥用行为模式,并在早期阶段进行了阻断。事件中OpenAI利用账户行为分析、查询模式聚类以及速率与流量异常检测等手段识别异常使用,并对其安全与滥用检测系统进行了针对性升级,以更好防范此类攻击。这是一起少见的由头部AI厂商主动公开披露的对抗性蒸馏事件,反映出随着前沿模型训练成本高企、模型权重与能力本身成为核心竞争资产,针对大模型的提取与窃取行为正在从理论威胁变为现实风险,也意味着API层面的滥用防护和滥用情报共享将越来越成为大模型厂商安全建设的重点方向。
原文 ↗