When an AI model is trained using reinforcement learning with an imperfect reward model, it will ..., Sonic AI
“When an AI model is trained using reinforcement learning with an imperfect reward model, it will tend to find and exploit weaknesses in the reward function rather than genuinely learning the desired behavior.”