Moderadores de exámenes usan escritura generada por IA para evaluar estándares de alfabetización

El Departamento de Educación del Reino Unido prueba el uso de IA para generar muestras de escritura usadas en la evaluación de estándares de alfabetización, diciendo que reduce costos anuales en un 95 por ciento.

Por El Medio Oriente
16 de agosto de 2026
Varios niños de primaria sentados en pupitres escribiendo en cuadernos durante una clase en un aula escolar.
Estudiantes de primaria trabajan en sus tareas de escritura en una sala de clase. El Reino Unido está experimentando con muestras de escritura generadas por inteligencia artificial para evaluar los estándares de alfabetización en las escuelas. (New Scientist)
3 min de lectura
Tamaño del texto

El Departamento de Educación del Reino Unido (DfE) está probando el uso de IA para producir muestras de escritura utilizadas en la evaluación de estándares de alfabetización de estudiantes conforme avanzan entre la escuela primaria y secundaria. Según el departamento, este método reduce los costos anuales en un 95 por ciento.

Alrededor de 2000 moderadores tienen la tarea de verificar el nivel de escritura de los estudiantes al final de la etapa clave 2 (KS2), un momento crítico en el camino educativo de los niños en Inglaterra y Gales. Para garantizar que las calificaciones asignadas por los maestros estén estandarizadas, los moderadores verifican el trabajo de los estudiantes comparándolo con muestras de escritura generalmente obtenidas de trabajos reales producidos por escolares. Este proceso cuesta alrededor de £100,000 por año.

A partir de este año y el próximo, algunos moderadores serán presentados con resultados generados por IA creados por el modelo GPT-5 de ChatGPT. El departamento dice que GPT-5 actualmente se está utilizando para crear tres colecciones de escritura para un ejercicio de estandarización, mientras que un ejercicio completo en 2026-27 y 2027-28 continuará conteniendo trabajos escritos por niños obtenidos bajo el contrato anterior.

Alrededor de 20 gestores expertos de moderación de autoridades locales revisarán el material derivado de IA para verificar su autenticidad antes de ser utilizado. El departamento planea decidir en primavera de 2027 si continúa produciendo muestras de esta manera o regresa a adquirirlas de un proveedor externo. Su registro de transparencia no enumera una evaluación de impacto formal para el sistema.

Sin embargo, el uso de IA en una parte clave de la evaluación educativa ha generado cuestionamientos. Rebecca Clarkson, investigadora en la Universidad Anglia Ruskin del Reino Unido, dijo que tener un ejemplo de escritura que no sea de un niño real "crea un problema filosófico y ético". "La preocupación es que la IA cambie nuestra perspectiva de lo que es aceptable en la escritura, o qué es un buen estándar, o algo así", señaló.

Clarkson, quien estudia evaluación y moderación de escritura en KS2, ha escuchado a varios moderadores que han expresado preocupaciones sobre el posible uso de muestras generadas por IA. Dijo que sus críticas se centran "básicamente en el hecho de que no es escritura de niños reales". Agregó que las consecuencias de esto son imposibles de predecir: "¿Es una preocupación si no usamos escritura de niños reales? Quién sabe. Supongo que no sabremos cuál es el impacto hasta que podamos medirlo".

El uso de IA de esta manera no debería afectar a qué escuelas secundarias asisten los estudiantes, ya que las evaluaciones de escritura de KS2 tienen lugar después de que los estudiantes han sido asignados a sus nuevas escuelas. Sin embargo, qué tan bien coincidan los niños con las muestras sintéticas podría determinar el nivel de apoyo que reciben al entrar en su próxima escuela.

Dado que la IA tiende a producir escritura plana o genérica, existe preocupación de que los niños que hablan inglés como segundo idioma o que son neurodivergentes y por lo tanto pueden no usar el mismo lenguaje que la mayoría sean descartados. La propia evaluación del DfE de los riesgos potenciales señala que "los modelos de lenguaje producen textos que frecuentemente excluyen vocabulario atípico y estructuras de oraciones que podrían ser utilizadas por estudiantes neurodivergentes o que no hablan inglés como lengua nativa", algo que planea mitigar mediante "revisión exhaustiva".

La evaluación también señala que los resultados generados por IA serán "revisados y editados extensamente" y estarán sujetos a revisión antes de ser utilizados en procesos de estandarización. Jo-Anne Baird, investigadora de la Universidad de Oxford, dijo: "El uso de IA se está filtrando en todos los aspectos de nuestras vidas y sin una gobernanza adecuada, no sabemos cuáles serán las implicaciones. En evaluación, existe la preocupación de que habrá un efecto de retroalimentación, con los materiales generados por IA convirtiéndose en los estándares que los maestros intenta que los estudiantes emulen. Esto podría llevarnos a lugares extraños".

Moderadores de exámenes usan escritura generada por IA para evaluar estándares de alfabetización | El Medio Oriente