La valutazione degli agent AI avviene dietro porte chiuse.
Le grandi aziende testano i propri modelli con criteri che nessuno vede, e non esiste un modo indipendente per confrontare le prestazioni reali di un agent di shopping.
Non sai se un agent è davvero bravo a comprare prodotti online o se i risultati sono stati scelti ad arte.
Manca trasparenza e manca uno standard aperto che chiunque possa verificare.
