Is it fair to define Reinforcement Learning (RL) as forcing a gradient onto a system / simulator?
Though, I suppose RL has non-gradient based methods too.
Is it fair to define Reinforcement Learning (RL) as forcing a gradient onto a system / simulator?
Though, I suppose RL has non-gradient based methods too.