Aggiunto il 24/03/2026
RLHF (Reinforcement Learning from Human Feedback)
Apprendimento per rinforzo dal feedback umano
ENRLHF (Reinforcement Learning from Human Feedback) · uso non numerabile
ITApprendimento per rinforzo dal feedback umano · gen. m. · uso non numerabile
Tecnica che usa preferenze e valutazioni umane per orientare un modello AI verso risposte più utili, sicure e coerenti nel contesto specifico.
RLHF addestra un modello partendo da esempi valutati da persone. Le preferenze umane vengono usate per costruire un modello di ricompensa, poi il sistema viene ottimizzato per produrre risposte più allineate a quei giudizi. La tecnica ha aiutato a rendere i chatbot più seguibili e meno grezzi, ma dipende dalla qualità delle valutazioni. Può anche introdurre eccessiva compiacenza, risposte prudenti o bias presenti nei criteri umani.