A propósito de Jev, el modelo de TypeSafe AI presentado el 15 de septiembre de 2026, que devuelve una puntuación en vez de texto.
¿Puede una IA corregir a un alumno de 1.º de ESO? Por qué en Clyra decide el profesor
Ana Pujana, fundadora de Clyra. .
Hay un modelo nuevo que solo sabe hacer una cosa: leer el texto de un alumno y devolver una nota. Sus creadores dicen que lo hace bien, y no tengo por qué dudarlo. El problema no es cuando se equivoca. Es lo que pasa cuando acierta.
Un modelo que solo devuelve una cifra
El 15 de septiembre TypeSafe AI presentó Jev. No genera texto: se le da un escrito y unas opciones, y devuelve una de ellas con una probabilidad. Un sí o un no, un nivel del uno al cuatro, un aprobado o un suspenso. Es rápido, es barato y es tentador, porque corregir es la parte del trabajo docente que más horas come y menos se ve.
Lo evalué para Clyra. Tenía sentido sobre el papel: un revisor que dijera si lo que escribió el alumno alcanza el nivel o no. Lo descarté en una tarde. No por la calidad del modelo, que no discuto, sino por lo que devuelve.
Una nota sin testigo
Imagina que Jev lee lo que escribió Lucía sobre por qué un grupo del Paleolítico enterraba a sus muertos y devuelve «notable, con un 82 % de probabilidad». ¿Qué hace el profesor con eso? Si se fía, firma una nota que no puede defender delante de una familia, porque no sabe qué frase de Lucía la justifica. Si no se fía, tiene que ir a leer el texto entero, y entonces el modelo no le ha ahorrado nada. Y el 82 % no le dice dónde mirar.
Lo mismo le pasa a Lucía, si algún día ve la nota. Una nota le dice cómo va. No le dice qué escribió bien, qué le faltó ni qué hacer la próxima vez. La evaluación que el currículo llama «formativa» es exactamente eso: información que sirve para ajustar, al profesor lo que enseña y al alumno lo que hace. Una puntuación con probabilidad no ajusta nada. Es un veredicto sin testigo.
«Yo lo que necesito es tiempo»
Es la objeción que me hace cualquier profesor, y tiene razón. Con veintiocho alumnos y veinticinco mensajes cada uno, una sesión son setecientos mensajes. Nadie los lee. Yo tampoco pretendo que nadie lo haga.
Pero fíjate en qué tiempo ahorra la puntuación. Ahorra en los casos claros, que el profesor ya sabía: el alumno que escribió tres párrafos con argumento y el que contestó «si o no». Donde no ahorra es en el caso dudoso, el del 55 %, que es justo donde el profesor necesita ayuda. Ahí tiene que ir a leer igual, y sin una pista de por dónde empezar. El tiempo que se ahorra es el que menos valía.
Lo que hace Clyra en vez de una cifra
Clyra también propone un nivel. No voy a decir que no ponemos notas, porque un profesor que abra el panel lo vería en un minuto. La diferencia está en tres cosas.
Cada nivel llega con las frases literales del alumno en las que se apoya, una, dos o tres por criterio. Y esas frases se comprueban contra la conversación: si la IA cita algo que el alumno no escribió, la cita se descarta antes de que el profesor la vea. Segundo, junto al nivel va qué le falta al alumno para subir uno. Eso es lo que un profesor puede decirle a Lucía el martes. Y tercero, el nivel es una propuesta: el profesor lo confirma o lo cambia, dimensión a dimensión, y el alumno no ve nada de esto nunca. Ni el nivel, ni las frases, ni el panel.
Lo digo con la misma honestidad con la que critico la puntuación: no hemos medido cuánto tarda un profesor en corregir así. Dos profesoras han usado el panel; ninguna ha llevado un nivel al acta todavía. Prometer «corriges en cinco minutos» sería la misma trampa que critico.
La pregunta que importa
La ley europea de inteligencia artificial considera de alto riesgo los sistemas que evalúan lo que ha aprendido un alumno. Lo es un clasificador que devuelve una puntuación, y lo es el evaluador de Clyra. Los dos. La pregunta no es cuál es más listo. Es cuál está construido para que una persona pueda supervisarlo: mirar de dónde sale la propuesta, cambiarla y responder por ella.
Un 82 % no se puede supervisar. Una frase de Lucía, sí.
La próxima noticia
Los modelos que ponen notas van a mejorar, y van a ser cada vez más baratos. Antes de un año saldrá la noticia de la primera IA que corrige exámenes oficiales, y volveré aquí a escribir sobre ella. La postura no va a cambiar: la IA aporta evidencias, el profesor decide, y el alumno no ve una nota puesta por una máquina.