1. OKTOBER 2026

← Alle begreper
Hva er

RLHF

Reinforcement Learning from Human Feedback: trening der mennesker rangerer modellsvar, og modellen læres opp til å foretrekke svarene folk likte. Grunnen til at chatboter oppfører seg.

Artikler som bruker dette begrepet
Modeller · 11. september 2026

Cognitions nye kodemodell er bygget på kinesisk grunnmur