RREDPAPA
용어 목록으로 돌아가기
ADV-014훈련 진화형

RLHF

Reinforcement Learning from Human Feedback

학습 난이도

사람의 선호 피드백을 이용해 AI 답변을 개선하는 학습 방식.

한 문장으로 이해하기

RLHF는 사람이 여러 답변 중 더 나은 것을 고른 피드백으로 모델을 개선하는 방법입니다. 정답을 일일이 쓰는 대신 선호를 알려 주어 답변을 다듬습니다.

이렇게 떠올리세요

심사위원이 더 좋은 답에 손을 들어 방향을 잡아 주는 것과 같습니다.

실제 예시

ChatGPT가 정중하고 도움이 되도록 다듬어진 데는 RLHF가 쓰였습니다.

핵심 한 문장

RLHF는 사람의 선호 피드백으로 답을 다듬는 방법입니다.

위 문장을 보지 않고 자기 말로 다시 설명해보면 오래 기억에 남습니다.

헷갈리는 용어

같이 보면 좋은 용어