arXiv AI

Relative Value Learning

arXiv:2607. 21120v1 Announce Type: cross Abstract: In reinforcement learning, critics typically estimate absolute state values $V(s)$, estimating how good a particular situation is in isolation.