Cite
APA Citation
Lee, J. N., Laskey, M., Tanwani, A. K., Aswani, A., & Goldberg, K. (2021). dynamic regret convergence analysis and an adaptive regularization algorithm for on-policy robot imitation learning. International journal of robotics research, 40, 1284–1305. http://access.bl.uk/ark:/81055/vdc_100130686755.0x000015