La qualità, la copertura, le distorsioni e la liceità dei dati di addestramento influenzano il comportamento del modello.
I dati di addestramento servono ad addestrare un modello affinché apprenda schemi; la trappola d'esame consiste nell'ignorare come distorsioni, lacune o fonti illegali compromettano gli output.