Addestrare un robot a muoversi bene all'interno di una simulazione è relativamente semplice, ma confermare che quella policy di navigazione funzioni anche fuori dall'ambiente di addestramento è la vera sfida.
I team di ricerca in robotica raramente hanno un modo economico e rapido per testare se le proprie policy generalizzano, senza dover mantenere costosi cluster GPU sempre attivi.
Valutazioni indipendenti e comparabili restano rare e lente da ottenere.
