L'allineamento dell'intelligenza artificiale, ossia il modo in cui un modello pesa i valori umani e prende decisioni complesse, è oggi nelle mani di un piccolo gruppo di laboratori.
Il processo è chiuso e privo di standard chiari.
I metodi attuali addestrano i modelli con feedback umano, il che insegna al modello a dire la risposta giusta, non a ragionare su di essa, e questo comportamento diventa sempre più difficile da verificare man mano che i modelli diventano più capaci.
