Toad_arxiv
New preprint: TOAD optimizes driving trajectories at test time by treating the planner’s scorer as a learned reward, improving end-to-end planners.
New preprint: TOAD optimizes driving trajectories at test time by treating the planner’s scorer as a learned reward, improving end-to-end planners.