arXiv AI
Jul 21

Scalable Causal Imitation Learning

arXiv:2607. 17003v1 Announce Type: cross Abstract: Imitation learning enables learning a policy in an unknown environment with a latent reward signal using expert demonstrations, but it struggles when the imitator's and expert's observations are mismatched and unobserved confounders are present in expert demonstrations.

By Eylam Tagor, Mingxuan Li, Elias Bareinboim