RREDPAPA
용어 목록으로 돌아가기
ADV-015훈련 진화형

RLAIF

Reinforcement Learning from AI Feedback

학습 난이도

AI의 피드백을 이용해 다른 AI 모델을 개선하는 방식.

한 문장으로 이해하기

RLAIF는 사람 대신 AI가 답변을 평가해 다른 모델을 개선하는 방식입니다. 사람 피드백을 모으는 비용과 시간을 줄이려는 시도입니다.

이렇게 떠올리세요

잘 훈련된 선배 AI가 후배 AI를 채점해 주는 것과 같습니다.

실제 예시

안전 기준을 담은 AI가 답변을 평가해 모델을 학습시키면 RLAIF입니다.

핵심 한 문장

RLAIF는 사람 대신 AI 피드백으로 모델을 개선합니다.

위 문장을 보지 않고 자기 말로 다시 설명해보면 오래 기억에 남습니다.

헷갈리는 용어

같이 보면 좋은 용어