Sparse Autoencoders Reveal Temporal Difference Learning in Large Language Models | Read Paper on Bytez