Aggiunto il 22/09/2026
RLCD (Reinforcement Learning for Calibrated Decisions)
ENRLCD (Reinforcement Learning for Calibrated Decisions) · uso non numerabile
ITRLCD (Reinforcement Learning for Calibrated Decisions) · gen. m. · inv.
AcronimoTecnico
Metodo di addestramento proposto da TypeSafe, premia decisioni corrette e probabilità coerenti con la frequenza effettiva degli esiti.
TypeSafe presenta RLCD come approccio per addestrare modelli che scelgono fra alternative definite e assegnano probabilità alle proprie decisioni. Il criterio valorizza la corrispondenza fra probabilità dichiarate e risultati osservati su molti casi. Una previsione all’80% dovrebbe quindi risultare corretta circa otto volte su dieci in condizioni comparabili. Il nome identifica una proposta recente, i cui dettagli pubblici restano limitati.
Storia d'uso
- Coniatosettembre 2026· Nome del metodo annunciato da TypeSafe; distinto dall’omonima Contrastive Distillation.[1]