ADV-015숲훈련 진화형
RLAIF
Reinforcement Learning from AI Feedback
학습 난이도
숲
AI의 피드백을 이용해 다른 AI 모델을 개선하는 방식.
한 문장으로 이해하기
RLAIF는 사람 대신 AI가 답변을 평가해 다른 모델을 개선하는 방식입니다. 사람 피드백을 모으는 비용과 시간을 줄이려는 시도입니다.
이렇게 떠올리세요
잘 훈련된 선배 AI가 후배 AI를 채점해 주는 것과 같습니다.
실제 예시
안전 기준을 담은 AI가 답변을 평가해 모델을 학습시키면 RLAIF입니다.
핵심 한 문장
RLAIF는 사람 대신 AI 피드백으로 모델을 개선합니다.
위 문장을 보지 않고 자기 말로 다시 설명해보면 오래 기억에 남습니다.