Artículos · Educación
La medida de la escuela
PISA, inteligencia educativa y responsabilidad democrática en México
Dedico estas páginas a la memoria de mi amigo Alonso Lujambio. Durante su responsabilidad al frente de la educación pública, procuró que la evaluación sirviera para conocer mejor la escuela, orientar las decisiones del Estado y valorar con seriedad el trabajo de maestras y maestros, sin convertirla en una causa de ruptura.
Comprendió que gobernar un sistema educativo exige información, diálogo, prudencia y una mirada siempre puesta en los estudiantes. Este ensayo recuerda esa forma de ejercer la gestión educativa: medir para comprender, transformar sin desestabilizar y poner la evidencia al servicio del aprendizaje.
El problema no es si debemos evaluar, sino qué hacemos visible, a quién responsabilizamos y qué obligaciones nacen de la evidencia obtenida.
La evaluación educativa no es un examen, una calificación ni una tabla de posiciones. Tampoco es el instante cuando una autoridad descubre, desde lejos, aquello que la escuela no pudo resolver. Es una institución pública de conocimiento, juicio y responsabilidad: una arquitectura que permite hacer visible qué aprende un estudiante, cómo lo aprende, dónde se interrumpe su trayectoria y qué debe hacer el sistema para ayudarlo a avanzar. Medir es asignar valores a ciertos desempeños mediante reglas explícitas; calificar es condensar un juicio en una escala; evaluar es interpretar evidencias, a la luz de propósitos y criterios, para tomar decisiones. Cuando este último paso desaparece, la evaluación conserva su aparato técnico, pero pierde su razón educativa.
Ninguna evaluación es neutral. Toda evaluación contiene, aunque no lo declare, una teoría del aprendizaje, una noción de igualdad y una manera de distribuir responsabilidades. Es, al mismo tiempo, una operación técnica, una decisión pedagógica y un acto de poder. Su calidad no depende únicamente de la precisión del instrumento, sino de tres condiciones inseparables: la validez de las interpretaciones que permite formular, la utilidad de la información para mejorar la enseñanza y la legitimidad de las reglas y consecuencias que se desprenden de ella. Una prueba puede ser adecuada para observar tendencias nacionales y, al mismo tiempo, insuficiente para decidir el destino laboral de una persona. A mayor consecuencia, mayor debe ser la carga de evidencia.
Cuando asistir dejó de ser suficiente
Durante buena parte del siglo XX, México midió el avance de su escuela por su capacidad de llegar. En un territorio extenso, desigual y marcado por un crecimiento demográfico acelerado, la prioridad era abrir planteles, llevar maestros a comunidades urbanas, rurales e indígenas, combatir el analfabetismo y ampliar la matrícula. La expansión fue, en sí misma, una política de justicia social. Cada aula nueva modificaba el horizonte de una familia y extendía la presencia del Estado. La pregunta dominante era cuántos podían entrar a la escuela; sólo gradualmente adquirió fuerza otra, más incómoda y exigente: además de asistir, ¿qué estaban aprendiendo realmente niñas, niños y jóvenes?
Ese desplazamiento, de la preocupación casi exclusiva por el acceso hacia una visión que incorporaba permanencia, equidad y aprendizaje, comenzó a hacerse visible hacia finales de la década de 1980. El acceso y el aprendizaje no se sucedieron como etapas ordenadas: se superpusieron. México llegó al final del siglo con diferencias regionales profundas, rezago acumulado y trayectorias escolares interrumpidas. Lo que cambió fue la medida del derecho. Ya no bastaba con disponer de un lugar en el aula: la promesa educativa debía incluir aprendizajes relevantes, condiciones dignas de enseñanza y posibilidades reales de concluir los distintos niveles.
En el trasfondo se encontraba una mutación más amplia. La vida social, el trabajo, la ciencia y la economía comenzaban a organizarse alrededor de conocimientos cada vez más complejos y cambiantes. La llamada "sociedad del conocimiento" colocó en el centro la capacidad de aprender durante toda la vida, seleccionar información, comprender problemas y actuar razonadamente frente a ellos. La idea tenía una dimensión emancipadora, porque reconocía el conocimiento como condición de autonomía; pero también una dimensión económica que tendía a valorar la educación por su contribución a la productividad y la competitividad. Esa tensión sigue vigente. Educar no es solamente formar capital humano: es formar personas capaces de comprender su realidad, deliberar sobre ella y transformarla.
La profesionalización docente formó parte de ese tránsito. En 1984, la educación normal fue elevada formalmente al nivel de licenciatura. Carrera Magisterial, acordada en 1992 e instrumentada desde el ciclo 1992-1993, abrió una vía de promoción horizontal para mejorar los ingresos sin abandonar el aula. Reconoció antigüedad, preparación profesional, formación continua y, con el tiempo, resultados de aprovechamiento. Fue un antecedente importante, aunque no exento de distorsiones: amplió oportunidades y estimuló la actualización, pero también produjo burocracia, acceso desigual a los incentivos y una asociación problemática entre el desempeño de los alumnos y el mérito individual del maestro. La enseñanza depende de la preparación y el compromiso docente, pero también de la escuela, los recursos, la gestión y las condiciones sociales. Desde entonces se volvió evidente una cuestión que después olvidaríamos: evaluar al sistema, al plantel, al programa, al maestro y al estudiante son tareas relacionadas, pero no intercambiables.
PISA y una nueva idea de aprender
Con esa preocupación entramos al siglo XXI. En el año 2000, México participó desde su primera edición en el Programa para la Evaluación Internacional de los Estudiantes, PISA, organizado por la OCDE. La prueba se aplica a muestras representativas de jóvenes de 15 años escolarizados y no busca verificar cuánto recuerdan de un currículo nacional específico. Pretende estimar en qué medida pueden movilizar conocimientos y habilidades de lectura, matemáticas y ciencias para enfrentar problemas de la vida contemporánea. Su aparición no sólo añadió una medición internacional; introdujo otra manera de preguntar qué significa saber.
En lectura, el énfasis dejó de estar únicamente en decodificar palabras o recordar información. Comprender implicaba interpretar, relacionar, evaluar fuentes, reconocer argumentos y utilizar textos con propósitos diversos. Leer dejó de aparecer solamente como acceso a la literatura y se reveló como código de entrada a todos los saberes: una herramienta para aprender al ritmo del cambio, distinguir evidencia de propaganda y participar en la vida pública. En matemáticas, la atención se desplazó de la ejecución mecánica de operaciones hacia la capacidad de formular, representar y resolver problemas mediante modelos. En ciencias, importaban la explicación de fenómenos, el razonamiento sustentado en evidencia y la evaluación crítica de conclusiones. En conjunto, PISA expresaba una alfabetización más exigente: no bastaba con acumular información; había que comprenderla, movilizarla y someterla a juicio.
Esta perspectiva obligó también a mirar el currículo. El currículo es la gramática de la evaluación: define qué conocimientos, capacidades, valores y formas de convivencia considera indispensables una sociedad. Una competencia no es una habilidad vacía de contenido, sino la integración de saberes, procedimientos y juicio para actuar ante situaciones concretas. Sin claridad curricular, los resultados pueden ordenarse, pero difícilmente comprenderse. El currículo prescrito, el que efectivamente se enseña, el que logran aprender los estudiantes y el que finalmente se evalúa nunca coinciden por completo. La evaluación funciona, por ello, como un espejo selectivo: ilumina algunos aprendizajes y deja otros fuera. Cuando sus resultados tienen consecuencias intensas, lo medido tiende a recibir más tiempo y recursos hasta convertirse en la definición práctica de lo que vale la pena enseñar.
PISA posee, sin embargo, límites que conviene afirmar con la misma claridad con que se reconoce su valor. Una prueba estandarizada ofrece una fotografía parcial, no una definición exhaustiva de la calidad. No capta por completo la formación histórica, artística, ética, cívica o socioemocional; tampoco explica por sí sola las causas de un resultado. Las comparaciones internacionales empobrecen el debate cuando se convierten en rankings descontextualizados o en competencias de prestigio. Su mayor utilidad no reside en declarar ganadores y perdedores, sino en revelar tendencias, brechas y grupos de estudiantes a quienes el sistema no está garantizando aprendizajes fundamentales. Un indicador debe iluminar una decisión, no sustituirla.
La construcción de la inteligencia educativa
México no se limitó a participar en PISA. Durante la primera década del siglo construyó una capacidad institucional para observarse. El Instituto Nacional para la Evaluación de la Educación, creado en 2002, produjo indicadores, estudios y evaluaciones sobre acceso, trayectorias, condiciones escolares y aprendizajes. Su valor no consistía solamente en aplicar exámenes: un sistema no sólo necesita saber, necesita confiar en la manera en que sabe. Los Exámenes de la Calidad y el Logro Educativos, EXCALE, aplicados desde 2005, trabajaban con muestras y permitían conocer el desempeño del sistema y de sus principales subpoblaciones. ENLACE, iniciado por la SEP en 2006 para educación básica, tuvo carácter censal y ofreció resultados por alumno y escuela. No eran instrumentos equivalentes ni debían utilizarse para las mismas decisiones.
Una evaluación muestral puede estimar con solidez lo que ocurre en el país, en una entidad o en ciertos tipos de escuela sin examinar a toda la población. Una evaluación censal puede devolver información a cada plantel y seguir resultados con mayor cercanía, pero enfrenta riesgos más altos cuando sus puntajes se usan para clasificar escuelas, distribuir estímulos o imputar responsabilidades individuales. ENLACE amplió de manera inédita la disponibilidad pública de datos y ayudó a romper la comodidad de los promedios nacionales. También mostró que México no tenía un solo sistema educativo, sino múltiples sistemas superpuestos por territorio, condición social, modalidad y oportunidad de aprender.
Esa visibilidad produjo conocimiento, pero también incentivos indeseables. Cuando los puntajes se incorporaron a esquemas de estímulos y comenzaron a circular rankings de escuelas, una medición concebida para informar adquirió consecuencias que el instrumento no podía sostener por sí solo. Aparecieron presiones para enseñar hacia la prueba, reducir el currículo y, en algunos casos, alterar las condiciones de aplicación. El problema no fue disponer de información, sino confundir medición, mejora y sanción. La uniformidad del instrumento no garantizaba la justicia de la política: además de preguntar si todos respondían la misma prueba, era necesario saber si todos habían dispuesto de condiciones razonables para aprender lo que se les exigía.
Después de la revisión técnica de ENLACE y EXCALE, en 2015 comenzó el Plan Nacional para la Evaluación de los Aprendizajes, PLANEA, coordinado inicialmente por el INEE y la SEP. Su diseño combinó modalidades orientadas al sistema, a los centros escolares y al diagnóstico pedagógico. La distinción era crucial. Una evaluación del sistema debía revelar tendencias y desigualdades; una evaluación de escuela, ofrecer referencias para organizar apoyos; una evaluación del aprendizaje, localizar el punto en que se encontraba cada estudiante; y una evaluación profesional, valorar prácticas y responsabilidades mediante evidencia específica y plural. Confundir estos planos atribuye al individuo fallas estructurales y convierte indicadores colectivos en sentencias personales.
La aportación más profunda de aquella etapa no fue el número de pruebas, sino la formación de una incipiente inteligencia educativa. Por más de una década, el Estado acumuló información independiente para reconocer diferencias, identificar retrocesos y orientar decisiones. Pero medir no equivalía a mejorar. La evaluación sólo cerraba su circuito cuando la evidencia era interpretada, se convertía en decisión, activaba un apoyo y permitía verificar lo ocurrido después. Si el resultado llegaba tarde, no localizaba la dificultad o encontraba una institución incapaz de intervenir, el diagnóstico terminaba convertido en clasificación. Evaluar no equivale a mejorar, pero mejorar sin evaluar conduce a actuar a ciegas.
Cuando la evaluación se volvió conflicto político
La reforma educativa de 2013 concentró esa tensión. Por una parte, otorgó autonomía constitucional al INEE y creó el Servicio Profesional Docente para regular el ingreso, la promoción, el reconocimiento y la permanencia mediante procedimientos públicos. Profesionalizar una función de Estado, limitar la discrecionalidad y reconocer el mérito eran objetivos defendibles. Por otra, la evaluación quedó asociada a consecuencias laborales de alto impacto y fue instrumentada sin construir antes la confianza, la gradualidad y las capacidades que una transformación de esa magnitud requería.
En el debate público se mezclaron dos cuestiones que debieron permanecer separadas: la necesidad de contar con evidencia independiente sobre el estado de la educación y la evaluación de docentes vinculada a su permanencia. Una prueba puede ser válida para observar una tendencia y no serlo para juzgar el aporte causal de una persona. La evaluación profesional de alto impacto exige criterios conocidos, evidencia plural, observación en distintos momentos, evaluadores preparados, consideración del contexto, acceso al expediente, derecho de audiencia, resolución fundada, posibilidad de revisión y oportunidades reales de mejora. El rigor no consiste en endurecer las consecuencias, sino en no afirmar más de lo que la evidencia permite afirmar.
El Servicio Profesional Docente, que debió ser la culminación de una nueva carrera, se convirtió durante el gobierno de Enrique Peña Nieto en la manzana envenenada de la reforma. La evaluación apareció menos como una herramienta de formación que como un dispositivo de control y reorganización laboral. La resistencia magisterial no puede explicarse sólo como rechazo a rendir cuentas: expresó también el desacuerdo con una política percibida como vertical, estandarizada y poco sensible a las diferencias escolares. Reconocerlo no obliga a renunciar a la evaluación. Obliga a hacerla más legítima, contextualizada y útil. No se necesitaba convertir la evaluación en amenaza; se necesitaba convertirla en inteligencia institucional.
La profesión docente no puede quedar fuera del escrutinio público. La autonomía profesional es discreción responsable, no inmunidad. Pero la rendición de cuentas tampoco autoriza la arbitrariedad. Los derechos laborales no cancelan las obligaciones profesionales: aseguran que la exigencia tenga reglas, proporcionalidad y debido proceso. La responsabilidad, además, debe ser recíproca. El maestro responde por sus decisiones profesionales y la autoridad por las condiciones en las que exige resultados: tiempo escolar, formación, materiales, infraestructura, seguridad, organización y acompañamiento. Ningún sistema mejora si comienza por humillar a quienes deben hacerlo funcionar.
La reforma constitucional de 2019 abrogó el régimen del Servicio Profesional Docente, eliminó al INEE y creó la Comisión Nacional para la Mejora Continua de la Educación, Mejoredu. El cambio separó la evaluación de la permanencia laboral y privilegió un enfoque diagnóstico y formativo, pero también produjo una ruptura institucional. Capacidades técnicas y series construidas durante años perdieron continuidad, comparabilidad o presencia pública.
En diciembre de 2024, una nueva reforma eliminó del artículo 3º la base constitucional de Mejoredu y ordenó su extinción una vez expedida la legislación secundaria. Esa transición no se consumó de inmediato: la ley reglamentaria de 2019 permaneció vigente y el Presupuesto de Egresos de 2026 todavía reconoció y financió a la Comisión. La evaluación nacional quedó así en una situación institucional transitoria e incierta. En poco más de una década pasamos de medir para gobernar a utilizar la medida para disciplinar y, después, de impugnar el castigo a debilitar la capacidad pública de mirar, como si para impedir que el termómetro castigara al enfermo hubiera que dejar de medir la temperatura. No había que elegir entre una evaluación punitiva y un Estado sin inteligencia educativa.
PISA 2022–2025: deterioro matemático, fragilidad persistente y desigualdad
Los resultados de PISA 2022, publicados en diciembre de 2023, devolvieron al país una imagen que ya no podía explicarse como consecuencia de una disputa administrativa. México obtuvo 395 puntos en matemáticas, 415 en lectura y 410 en ciencias. Sólo 34 por ciento de los estudiantes alcanzó al menos el nivel 2 de competencia en matemáticas; en lectura lo consiguió 53 por ciento y en ciencias, 49 por ciento.
PISA 2025 no modificó sustancialmente ese diagnóstico, pero sí permitió precisarlo. México obtuvo 388 puntos en matemáticas, 408 en lectura y 414 en ciencias. Alcanzaron al menos el nivel 2 el 30 por ciento de los estudiantes en matemáticas, el 50 por ciento en lectura y el 50 por ciento en ciencias. Entre 2022 y 2025, la disminución fue estadísticamente significativa únicamente en matemáticas; las variaciones de lectura y ciencias no lo fueron. No existe, por tanto, una caída consecutiva de las tres áreas, sino un deterioro matemático que continúa y dos campos que permanecen estancados en niveles insuficientes.
La expresión “retrocedimos veinte años” conserva fuerza política, pero exige precisión estadística. Entre 2012 y 2025, matemáticas pasó de 413 a 388 puntos y la proporción de estudiantes que alcanzó al menos el nivel 2 descendió de 45 a 30 por ciento. Lectura pasó de 424 a 408 puntos y de 59 a 50 por ciento en el nivel 2 o superior. Ciencias, en cambio, se mantuvo prácticamente estable: de 415 a 414 puntos, aunque la proporción que alcanzó el nivel mínimo disminuyó de 53 a 50 por ciento. La trayectoria de largo plazo no describe una erosión escalonada —primero matemáticas, después lectura y finalmente ciencias—, sino una combinación más compleja: retroceso sostenido en matemáticas, debilitamiento moderado de la lectura y estancamiento prolongado de las ciencias.
Conviene recordar, además, que PISA no sigue a los mismos estudiantes a lo largo del tiempo. Cada aplicación constituye un corte transversal de la población de 15 años que continúa escolarizada y cumple los criterios de elegibilidad. La comparación permite observar cambios del sistema, pero no reconstruir una secuencia causal individual ni atribuir automáticamente las variaciones a una sola reforma, gobierno o acontecimiento.
Entre 2012 y 2025, las cohortes evaluadas atravesaron al menos dos rupturas de gran alcance. La primera se produjo durante la transición de 2012 y la reforma de 2013, que reorganizó la relación entre el Estado y el magisterio, modificó los mecanismos de ingreso, promoción y permanencia y colocó la evaluación en el centro del conflicto político. La segunda comenzó en 2018, adquirió forma jurídica con la reforma de 2019 —incluida la desaparición del INEE— y se consolidó curricularmente a partir de 2022 con un nuevo esquema educativo.
Estos cambios no demuestran por sí mismos que una reforma haya causado determinado puntaje. PISA no fue diseñada para establecer esa relación. Sin embargo, las rupturas institucionales sí importan: alteraron prioridades, autoridades, mecanismos de seguimiento, instrumentos de evaluación y formas de relación con las escuelas. El problema no consiste sólo en que hayan cambiado las políticas, sino en que cada transformación debilitó la continuidad necesaria para aprender de las anteriores. El sistema sustituyó modelos antes de consolidar una memoria común sobre sus resultados.
La pandemia de COVID-19 agravó esta fragilidad. El cierre prolongado de las escuelas, la pérdida de contacto pedagógico y la desigual disponibilidad de dispositivos, conectividad y apoyo familiar afectaron las oportunidades de aprendizaje. En PISA 2022, una proporción importante de estudiantes mexicanos informó dificultades para comprender las tareas escolares o encontrar ayuda durante el cierre. Pero la pandemia no creó el rezago: encontró un sistema previamente desigual, institucionalmente discontinuo y con amplias brechas territoriales y sociales.
También debe considerarse que la población representada por PISA se amplió. En 2022, la muestra representó aproximadamente al 64 por ciento de la población mexicana de 15 años; en 2025, la cobertura aumentó a cerca de 69 por ciento. La incorporación de jóvenes anteriormente excluidos o rezagados constituye un avance de inclusión, pero también modifica la composición de la población evaluada. La OCDE advierte que una parte del descenso aparente puede relacionarse con la integración escolar de grupos históricamente marginados. Este efecto no elimina el deterioro, pero impide interpretarlo como si se evaluara exactamente a la misma población en cada ciclo.
La ampliación de la cobertura revela una paradoja. El sistema consigue mantener dentro de la escuela a una proporción mayor de adolescentes, pero no garantiza que todos desarrollen los aprendizajes fundamentales. Inclusión sin aprendizaje y aprendizaje sin inclusión son dos formas distintas de incumplir el derecho a la educación. La expansión de la escolarización no debe utilizarse para relativizar los resultados, pero los puntajes tampoco deben emplearse para devaluar el avance que significa incorporar a poblaciones antes excluidas.
Los promedios nacionales, además, comprimen desigualdades que PISA no puede localizar con suficiente precisión. La prueba ofrece una referencia internacional valiosa, pero no permite determinar por sí sola qué ocurre en cada entidad, modalidad, escuela, grupo o trayectoria individual. Tampoco representa directamente a quienes abandonaron la escuela, acumularon un rezago que los colocó fuera de los grados considerados o nunca ingresaron al universo evaluado.
El vacío nacional no significa que México haya dejado de aplicar toda clase de evaluación. Han existido ejercicios diagnósticos, formativos y muestrales. Lo que se perdió fue una arquitectura pública, periódica y metodológicamente estable que permitiera comparar aprendizajes, devolver información útil a las escuelas y construir memoria institucional. ENLACE, EXCALE, PLANEA y PISA responden a propósitos, poblaciones, escalas y marcos conceptuales diferentes; no pueden empalmarse como si fueran una sola serie.
En ausencia de esa arquitectura, PISA termina respondiendo preguntas para las que no fue diseñada. Se le exige explicar diferencias territoriales, identificar necesidades escolares, valorar reformas nacionales y establecer responsabilidades políticas que sus datos no pueden resolver por sí solos. PISA no resulta insuficiente por aquello que mide, sino porque México pretende compensar con ella la información nacional que ha dejado de producir de manera continua.
El diagnóstico, por tanto, es más complejo que la afirmación de un retroceso uniforme: México incorporó a más jóvenes a la población escolar representada, pero no consiguió asegurarles aprendizajes fundamentales; las matemáticas continuaron deteriorándose, mientras lectura y ciencias permanecieron estancadas; y las sucesivas transformaciones políticas no construyeron una capacidad institucional acumulativa para observar, explicar y corregir esas tendencias.
La comparación internacional ofrece una señal de alerta. Corresponde al sistema nacional localizar el problema, distinguir sus causas y orientar las respuestas. Sin esa capacidad, cada publicación de PISA reproduce el mismo ciclo: alarma pública, defensa gubernamental, intercambio de responsabilidades y, finalmente, olvido.
Recuperar la evaluación como bien público
México no necesita regresar a una evaluación punitiva ni reconstruir mecánicamente alguno de los dispositivos del pasado. Tampoco necesita una pedagogía subordinada a los exámenes. Necesita recuperar la evaluación como una institución pública de conocimiento: confiable, periódica, transparente, comparable, técnicamente independiente y pedagógicamente útil.
Esa política debe distinguir al menos cuatro planos: el diagnóstico general del sistema; la evaluación de políticas y programas; la retroalimentación a escuelas, docentes y estudiantes; y el desarrollo profesional del magisterio. Cada plano requiere preguntas, evidencias, instrumentos y consecuencias diferentes. Un resultado válido para describir al sistema nacional puede ser insuficiente para orientar a una escuela; una evidencia útil para acompañar a un estudiante no necesariamente permite comparar entidades. La validez no existe en abstracto: depende del uso que se pretenda dar a la información.
También se necesita una arquitectura de escalas articuladas. La comparación internacional permite situar al país; la evaluación nacional muestra tendencias generales; la información estatal y regional localiza desigualdades; los diagnósticos escolares ayudan a organizar apoyos; y la evaluación de aula permite modificar la enseñanza. Ningún instrumento puede sustituir a los demás. Sin una medición común no hay equidad verificable; sin evidencia de los procesos no hay comprensión pedagógica; sin continuidad temporal no hay aprendizaje institucional.
Recuperar esa arquitectura exige restablecer la relación entre currículo, progresión y evaluación. Un currículo ambiguo produce resultados difíciles de interpretar; uno saturado conduce a comprobar cobertura en lugar de comprensión; uno fragmentado acumula actividades sin construir trayectorias. Los mapas de progresión deben articular conocimientos, macrohabilidades, microhabilidades, prerrequisitos, situaciones de aplicación y evidencias de dominio. La evaluación diagnóstica localiza el punto de partida; la formativa acompaña y corrige a tiempo; y la evaluación de resultados informa qué se consiguió y qué responsabilidades siguen pendientes. Una evaluación es formativa no porque se aplique muchas veces o lleve esa etiqueta, sino porque llega a tiempo y modifica el siguiente paso de la enseñanza.
La información debe tener suficiente granularidad para revelar desigualdades por entidad, región, condición socioeconómica, tipo de localidad, modalidad escolar, lengua, pertenencia indígena, discapacidad y género, sin convertir los datos en etiquetas. El contexto debe servir para interpretar los resultados, distribuir responsabilidades y asignar apoyos; nunca para naturalizar expectativas menores. La igualdad educativa establece un horizonte común y la equidad moviliza apoyos diferentes para alcanzarlo. Un nivel de desempeño describe una situación: no define la capacidad ni la identidad de una persona.
De cada diagnóstico deben desprenderse dos movimientos complementarios. El primero es de apoyo intensivo: más tiempo, mejores materiales, tutoría, acompañamiento especializado y condiciones pertinentes para quienes todavía no alcanzan los propósitos comunes. El segundo es de enriquecimiento: desafíos de mayor profundidad para quienes muestran un dominio avanzado, sin separarlos de su comunidad ni convertir la diferencia en privilegio.
Los datos deben alimentar un expediente pedagógico, no un prontuario: una memoria del aprendizaje que ayude al maestro a decidir, a la escuela a organizar apoyos, a la familia a comprender y al gobierno a distribuir recursos con justicia. Evaluar no debe significar trasladar la responsabilidad hacia abajo, hasta depositarla exclusivamente en el estudiante o el docente. Debe permitir identificar qué corresponde resolver al aula, a la escuela, a la autoridad local y al sistema nacional.
La tecnología y la inteligencia artificial pueden ampliar esta capacidad. Permiten reunir evidencias más diversas, reconocer patrones, reducir tiempos de procesamiento y ofrecer retroalimentación oportuna. Pero una plataforma, un algoritmo o un tablero no modernizan por sí mismos la educación. La precisión estadística no corrige una pregunta pedagógica mal formulada, y un sistema de datos puede clasificar con enorme eficacia sin ayudar a nadie a aprender. La tecnología puede acelerar la medición; únicamente una visión pedagógica puede volverla inteligente.
La disyuntiva no se encuentra entre evaluar o dejar de evaluar, sino entre una evaluación que clasifica el pasado y otra que ayuda a construir el futuro. Recuperarla como bien público significa hacerla capaz de orientar, acompañar y exigir responsabilidades sin convertirla en mecanismo de castigo. Significa, sobre todo, devolver al sistema educativo la memoria necesaria para aprender de sí mismo.
La medida de una democracia
La educación es, finalmente, un pacto democrático e intergeneracional. Mediante él, una sociedad decide qué herencia cultural desea transmitir y qué capacidades públicas debe garantizar a todos. La evaluación hace observables esas aspiraciones y, por ello, ejerce poder. La cuestión democrática no consiste en negar ese poder, sino en hacerlo público, razonado, revisable y limitado por derechos. Evaluar es cuidar la promesa educativa: negarse a que un niño permanezca invisible dentro del promedio, a que un maestro quede solo frente a una dificultad que rebasa el aula o a que una autoridad describa el rezago sin hacerse cargo de él.
La disyuntiva no está entre evaluar o no, sino entre clasificar el pasado y construir el futuro. Si castiga, rompe el pacto; si informa sin intervenir, administra la desigualdad; si orienta, acompaña y obliga, mejora. México no necesita un tribunal sobre la escuela pública, sino inteligencia a su servicio; no tecnología para distribuir culpas, sino responsabilidad compartida. Un sistema no demuestra su calidad cuando identifica a quienes quedaron atrás, sino cuando posee voluntad, conocimiento e instituciones para no dejarlos ahí.