WhiteMail
← 术语表

AI 与检测引擎

인간 피드백 강화학습 (RLHF)RLHF

定义

A reinforcement learning method that aligns models using human preference feedback as reward. Used to suppress harmful LLM outputs.

了解更多

同类别的其他术语