000 00229 a2200097 4500
000 nam a22 7a 4500
100 _aRichard S, Andrew G
245 _aReinforcement LearningAn introduction
260 _bMIT Press
942 _cBB
999 _c119952
_d119952