Un experimento aleatorio con más de 1.000 estudiantes de la Universidad Bocconi reveló que el acceso a ChatGPT y la formación en razonamiento causal mejoran el trabajo estudiantil de maneras distintas y complementarias. Los estudiantes que utilizaron ChatGPT produjeron respuestas de mayor calidad y más coherentes, similares a las recomendaciones de expertos, mientras que aquellos que recibieron formación en razonamiento causal generaron una mayor variedad de ideas únicas.

  • El acceso a GPT-4o mejoró las puntuaciones de la rúbrica de cinco puntos casi un punto completo e incrementó la coherencia lógica.
  • Los ejercicios de razonamiento causal llevaron a los estudiantes a explicar por qué las ideas podrían funcionar o fracasar, produciendo ideas más distintas que no quedan capturadas por la calificación estándar.
  • Los estudiantes que recibieron ambas intervenciones mostraron mejoras en el rango más amplio de medidas, combinando una salida pulida con originalidad.

Los resultados sugieren que, a medida que la IA facilita la producción de respuestas pulidas, las evaluaciones educativas deben adaptarse para medir otras cualidades como la originalidad y el razonamiento.