Evaluar para no devaluar
Álvaro Choi
Profesor de Economía en la Universidad de Barcelona
Diría que, por lo general, no nos gusta ser evaluados. Hacer exámenes. Pasar oposiciones. Que pongan la lupa sobre nosotros. Ver qué hacemos bien y bueno, qué no tanto. Y, sin embargo, bien diseñada, la evaluación es una de las mejores herramientas de las que disponemos para aprender y mejorar. El sistema educativo no es una excepción en este respecto. Ahora bien: ¿Qué papel debe jugar la evaluación en el sistema educativo? ¿Qué debe evaluarse? ¿Qué agentes –alumnado, profesorado, dirección, centros o, incluso, el sistema en su conjunto- deben ser evaluados y cómo? ¿Qué consecuencias debe llevar aparejada la evaluación? Las respuestas a estas preguntas no resultan evidentes y, dada la complejidad de la cuestión, no es de extrañar que se trate de uno de los puntos alrededor de los cuales existe mayor controversia en el debate educativo. Afortunadamente, en la actualidad podemos dar algunas orientaciones al respecto gracias a, precisamente, la existencia de evaluaciones anteriores sobre los efectos de la evaluación.
De forma previa a la discusión de algunas de dichas orientaciones, conviene aclarar la acepción de evaluación que emplearé a lo largo de las próximas líneas. Por evaluación entiendo al sistema de información sobre resultados –en este caso, educativos- orientado a la optimización en la utilización de los recursos limitados y a la mejora en la toma de decisiones. No incluyo, por tanto, su utilización generalizada como un sistema de castigo –el principal miedo del profesorado cuando se propone la evaluación de su actividad-. Tampoco la entiendo como un gasto, sino como una inversión ni -y eso ha sucedido de forma más habitual de lo deseado- como un mero trámite administrativo a cubrir.
Si aceptamos la definición propuesta, la primera cuestión a solventar quizás sea: ¿qué debe evaluarse? En otras palabras: ¿cuáles son los resultados relevantes del proceso educativo? Las respuestas a esta pregunta son múltiples y están vinculadas a las diversas funciones que se espera que desempeñe la educación en nuestra sociedad, tal y como resume con claridad José Saturnino Martínez en el artículo titulado 'Para pensar la política educativa' que abre este debate. Ahora bien, si queremos poner en contacto determinadas tecnologías educativas (organización de recursos físicos y humanos) con una serie de resultados, no queda más remedio que cuantificar, aunque sea de forma aproximada, dichos resultados. Así pues, deberán evaluarse resultados relevantes y medibles a partir de alguna escala.
El lector intuirá que las competencias cognitivas –como las numéricas, por ejemplo- resultan más sencillas de medir que las no cognitivas –como la empatía o el trabajo en equipo y que pueden ser, cierto, dependiendo del contexto, tan o más importantes que las cognitivas-. De ahí que buena parte de las evaluaciones existentes utilicen como medidas de resultados, como aproximaciones a la calidad de la educación o al rendimiento del alumnado, la puntuación obtenida en diversas pruebas cognitivas. A su vez, con todas sus limitaciones, resulta cada más frecuente vez la utilización de tests estandarizados -como las diversas pruebas de diagnóstico que se realizan en España o pruebas internacionales como PISA, TIMSS o PIRLS- frente a la alternativa de utilizar las notas obtenidas en los propios centros, ya que aquéllos facilitan las comparaciones entre diversos grupos de alumnado y el seguimiento del rendimiento a lo largo del tiempo. Naturalmente, el peso que se le dé a cada competencia, conocimiento y habilidad en una evaluación concreta dependerá de la orientación del currículo académico y se trata de una discusión que sobrepasa al objetivo de este artículo. Eso sí, existe cierto consenso acerca de la importancia de una serie de competencias cognitivas básicas para la trayectoria educativa del alumnado y su futuro desempeño socio-laboral. Entre éstas se encuentran las competencias numéricas, lectoras y científicas y, por ello, se utilizan a menudo como medidas de output del sistema educativo.
La evaluación del alumnado permite realizar un seguimiento en su evolución en la adquisición de contenidos. Existen no obstante discrepancias a la hora de establecer cuáles deberían ser las implicaciones de estas evaluaciones. Estas discrepancias emergen de forma recurrente, por ejemplo, cada vez que se discute la (no) incorporación de exámenes de reválida o la importancia de las calificaciones para determinar la superación de cursos o la trayectoria académica a seguir. En todo caso, la evidencia indica que la propia introducción de evaluaciones estandarizadas puede tener efectos positivos sobre el rendimiento medio del alumnado.
La comprensión de otros factores que conducen a la mejora del rendimiento constituye un segundo objetivo de las evaluaciones en el sistema educativo. La evaluación de los diversos factores del ámbito individual, familiar o escolar que pueden afectar al rendimiento del alumnado –el análisis de la denominada función de producción educativa-, ya sea de forma interna –por la propia administración- o externa ha proporcionado información valiosa para el diseño de políticas educativas relevantes y la reforma de las leyes educativas. Esta información, no obstante, a veces es tenida en cuenta y, otras, no tanto. Veamos algunos ejemplos.
La evidencia obtenida a partir de evaluaciones sí se traduce a menudo en políticas concretas. Así, la eliminación de los callejones sin salida en las trayectorias educativas (facilitando la transición entre niveles) o la apuesta por los programas de formación profesional dual serían reflejos de ello. La bien conocida relación entre el nivel socioeconómico de los hogares y el rendimiento académico también se pudo desentrañar a partir de evaluaciones y justificó la articulación de sistemas de ayudas y becas al estudio.
En otros casos, la evidencia obtenida en las evaluaciones sí se ha visto reflejada en las leyes educativas, pero éstas no se han aplicado de forma especialmente rigurosa. Piénsese, por ejemplo, en la existencia de procesos de segregación escolar por motivos socioeconómicos, en función de la titularidad del centro. Si bien es cierto que la utilización del criterio geográfico para la asignación del alumnado conduce a la segregación por motivos socioeconómicos entre centros, también lo es que la tolerancia existente respecto a los fraudes de ley realizados por algunos centros concertados -para la selección de su alumnado- exacerba la segregación entre centros. Un ejemplo similar lo tendríamos con la repetición de curso. La evidencia demuestra el efecto negativo de la repetición de curso sobre el rendimiento académico y las últimas leyes educativas han contemplado su aplicación de forma muy extraordinaria –no se trata de una novedad de esta última reforma-. A pesar de ello y de la tendencia decreciente en su aplicación a lo largo de la última década, España ha seguido siendo uno de los países occidentales donde se ha aplicado con mayor frecuencia esta política cara y nociva para el rendimiento del alumnado.
Finalmente, en nuestro sistema educativo también nos encontramos en ocasiones con algunas disposiciones normativas que resultan contrarias a lo recomendable según la evidencia obtenida a través de evaluaciones. Así, el profesorado de buena parte de los sistemas educativos líderes dispone de amplias franjas horarias de su jornada laboral para su formación y la preparación de nuevos materiales. También se ha demostrado que el aprendizaje del alumnado, especialmente en edades tempranas, se ve perjudicado si se produce en una lengua distinta a la de su hogar. No resulta difícil intuir las dificultades presupuestarias y políticas, respectivamente, de adaptar el sistema educativo español a dicha evidencia.
Un debate similar al que sucede con la evaluación del alumnado lo encontramos cuando nos planteamos la evaluación de uno de los inputs principales del sistema educativo: el profesorado. Nuevamente, existe controversia tanto en la medición de la “calidad” del profesorado (identificar cuál es la contribución de cada maestro o maestra al aprendizaje del alumnado) como la determinación de los posibles efectos de dichas evaluaciones -que pueden ir desde los efectos puramente informativos hasta las bonificaciones o penalizaciones retributivas o, incluso, el despido-. Por ejemplo, algunas evaluaciones pasadas nos permiten afirmar que diseñar sistemas de retribuciones en las que parte del salario del profesorado dependa del rendimiento del alumnado puede afectar positivamente a su efectividad. También se ha demostrado que algunos sistemas de liderazgo –equipos directivos- e inspección pueden ayudar a mejorar el rendimiento académico.
Así pues, todas las políticas y agentes educativos pueden estar sujetos a evaluación. Y, a nivel macro, también pueden ser objeto de evaluación los centros educativos. Estas evaluaciones permiten identificar mejores prácticas y premiar (o penalizar) a los centros menos eficientes en el uso de sus recursos. La evaluación de centros también ha sido ampliamente debatida, especialmente por el riesgo de realizar comparaciones injustas entre centros de características muy distintas y la creación de rankings. A pesar de dichos riesgos –existen formas de corregirlos-, la no evaluación y publicidad de los resultados de los centros seguramente no resulte la mejor de las alternativas ya que: a) estaríamos dejando de proporcionar una información valiosa tanto para la administración como para las familias; y b) en el caso de no publicar estos resultados, los hogares seguirán tomando decisiones educativas basadas en otros indicadores de “calidad” como los comentarios de familiares o amigos, y seguirán publicándose “rankings” en medios no oficiales basados en otros criterios.
En cualquier caso, el objetivo de esta discusión no ha sido dar indicaciones de políticas educativas, sino plantear la necesidad de dar un paso adelante en la evaluación de las políticas educativas. Bueno, o sí: se ha defendido la política consistente en implementar de forma sistemática la evaluación de políticas educativas, ya que conduce a mejoras en la utilización de los recursos públicos y constituye una herramienta de buen gobierno y, en definitiva, de calidad democrática. A pesar de los avances conseguidos a lo largo de los últimos lustros, resultaría deseable profundizar en la cultura de la evaluación. Una buena forma podría ser la inclusión sistemática de la evaluación de las diversas políticas educativas dentro del propio diseño de las mismas. Desde luego, ello no impediría la inclusión de políticas no apoyadas por la evidencia de existente pero, al menos, resultaría mucho más difícil de justificar en la siguiente ley educativa a aprobar.