RREDPAPA
용어 목록으로 돌아가기
ADV-045위험 탐지형

모델 포이즈닝

Model Poisoning

학습 난이도

모델 자체를 조작해 잘못된 행동을 하게 만드는 공격.

한 문장으로 이해하기

모델 포이즈닝은 모델의 가중치나 학습 과정 자체를 조작해 숨은 악성 행동을 심는 공격입니다. 평소엔 정상처럼 보이다가 특정 신호에 오작동할 수 있습니다.

이렇게 떠올리세요

기계 안에 몰래 스위치를 달아 특정 순간에 오작동하게 만드는 것과 같습니다.

실제 예시

오픈소스 모델 파일에 백도어를 심어 배포하면 모델 포이즈닝입니다.

핵심 한 문장

모델 포이즈닝은 모델 자체에 악성 행동을 심는 공격입니다.

위 문장을 보지 않고 자기 말로 다시 설명해보면 오래 기억에 남습니다.

헷갈리는 용어

같이 보면 좋은 용어