앤트로픽이 공개한 증류 공격 탐지
Anthropic이 세 곳의 AI 연구소가 Claude의 기능을 불법적으로 추출해 자체 모델을 개선하는 증류 공격을 탐지하고 공개했다. 이해하기 쉽게 슬라이드로 정리한 자료를 함께 공유한다.

Anthropic이 DeepSeek, Moonshot, MiniMax 등 세 곳의 AI 연구소가 Claude의 기능을 불법적으로 추출하여 자체 모델을 개선하는 증류 공격을 탐지하고 이를 공개했다.
원문: https://www.anthropic.com/news/detecting-and-preventing-distillation-attacks
이해하기 쉽게 슬라이드로 정리한 내용을 함께 공유한다.