La calidad, la cobertura, los sesgos y la legalidad de los datos de entrenamiento influyen en el comportamiento del modelo.
Los datos de entrenamiento sirven para ajustar un modelo a fin de que aprenda patrones; la trampa del examen consiste en ignorar cómo los sesgos, las lagunas o las fuentes ilegales corrompen los resultados.