회사 소개
백서
블로그
☀️
← 용어집
AI · 탐지 엔진
인간 피드백 강화학습 (RLHF)
RLHF
정의
인간의 선호 평가를 보상으로 삼아 모델을 정렬시키는 강화학습 기법이다. LLM의 유해 출력 억제에 쓰인다.
더 알아보기
Wikipedia ↗
관련 뉴스 ↗
같은 분류의 다른 용어
LLM / sLLM
인공신경망 (ANN)
스파이킹 신경망 (SNN)
검색증강생성 (RAG)
에이전트형 AI (Agentic AI)
적대적 예제 (Adversarial Example)