ADV-045숲위험 탐지형
모델 포이즈닝
Model Poisoning
학습 난이도
숲
모델 자체를 조작해 잘못된 행동을 하게 만드는 공격.
한 문장으로 이해하기
모델 포이즈닝은 모델의 가중치나 학습 과정 자체를 조작해 숨은 악성 행동을 심는 공격입니다. 평소엔 정상처럼 보이다가 특정 신호에 오작동할 수 있습니다.
이렇게 떠올리세요
기계 안에 몰래 스위치를 달아 특정 순간에 오작동하게 만드는 것과 같습니다.
실제 예시
오픈소스 모델 파일에 백도어를 심어 배포하면 모델 포이즈닝입니다.
핵심 한 문장
모델 포이즈닝은 모델 자체에 악성 행동을 심는 공격입니다.
위 문장을 보지 않고 자기 말로 다시 설명해보면 오래 기억에 남습니다.