Epi2Diff: Usar trazas de razonamiento de LLM para predecir la dificultad de los ítems humanos
Los investigadores presentan Epi2Diff, un marco que mapea las trazas de Modelos de Razonamiento Grande (LRM) en secuencias de episodios fundamentadas cognitivamente para predecir la dificultad de los ítems humanos en evaluación educativa. Al modelar la dificultad a través de la escala de razonamiento, la asignación de esfuerzo y las transiciones de estado, el método proporciona una alternativa interpretable a la costosa calibración humana.