Gunjan Dhanuka — Learning Notes
Search
Search
Dark mode
Light mode
Reader mode
Explorer
goodhart
1 item with this tag.
Sep 02, 2026
Reward Overoptimization (Goodhart)
reward-overoptimization
reward-hacking
goodhart
scaling-laws
warm
kl-regularization
rl-for-llms