La maggior parte dell'addestramento AI si basa su segnali di approvazione umana, pollice in su o pollice in giù, che premiano risultati apparentemente sicuri piuttosto che ragionamenti autentici.
Non esiste un ambiente aperto e verificabile in cui i sistemi AI siano costretti a difendere le proprie posizioni da una reale opposizione e a sopportare le conseguenze di un errore.
