Artículo de investigación

Diseño de algoritmos FairEduNet y calibración de evaluaciones docentes considerando la equidad en la educación superior

DOI:

10.3791/70189

21 de julio de 2026

En este artículo

Resumen

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

La investigación pretende ofrecer un nuevo enfoque para la enseñanza, la calibración de la evaluación y la equidad educativa en la educación inteligente. Los resultados experimentales indican que el modelo propuesto supera significativamente a los modelos comparativos, abordando de forma efectiva problemas de mala integración de datos multifuente y sesgo de equidad en los métodos de calibración existentes.

Resumen

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Los métodos actuales de calibración de evaluaciones docentes enfrentan desafíos como baja eficiencia de integración al procesar datos heterogéneos de evaluación multifuente, insuficiente adaptabilidad entre diferentes disciplinas y escenarios docentes, y sesgos en los resultados con garantías de equidad débiles. La investigación pretende construir un marco interpretable, transferible y escalable de corrección de la equidad para un modelado profundo y la corrección dinámica de los datos de evaluación docente. Estos problemas dificultan el cumplimiento del requisito fundamental de una enseñanza equilibrada en la educación inteligente. Este estudio propone un algoritmo de red educativa orientado a la equidad que integra una red generativa adversarial y un árbol de decisiones que impulsa el gradiente. El algoritmo construye un mecanismo de calibración de equidad y combina un modelo de representación bidireccional de codificadores con una red de atención de grafos para optimizar la extracción de características y la adaptabilidad dinámica, mejorando la eficiencia del procesamiento de datos en múltiples fuentes y la precisión de calibración de la equidad. Este enfoque logra una calibración precisa y garantía de equidad en las evaluaciones docentes. En la prueba de indicadores, el modelo alcanzó una precisión del 98,76% en la agrupación de características de evaluación, del 98,05% en la corrección de la equidad y del 0,968 en la consistencia de corrección entre escenarios en el conjunto de validación. En la tarea de prueba de valor de pérdida, la pérdida total del modelo disminuyó de 0,1237 a 0,1018 durante la tarea de corrección de evaluación docente en el conjunto de validación. En la prueba de indicadores, el modelo alcanzó una precisión del 98,76% en la agrupación de características de evaluación, del 98,05% en la corrección de la equidad y del 0,968 en la consistencia de corrección entre escenarios en el conjunto de validación. Los resultados experimentales indican que el modelo propuesto supera significativamente a los modelos comparativos, abordando de forma efectiva problemas de mala integración de datos multifuente y sesgo de equidad en los métodos de calibración existentes. Además, proporciona marcos algorítmicos innovadores para desarrolladores tecnológicos y herramientas técnicas fiables para que los administradores educativos promuevan la equidad docente. Las contribuciones a la investigación se centran en: (i) integrar tres módulos principales, incluyendo preprocesamiento de datos multifuente, verificación dinámica del índice de equidad y visualización de explicabilidad; y (ii) proponer un paradigma de corrección de equidad basado en la optimización colaborativa de redes generativas adversariales y árboles de aumento de gradientes, que rompa las limitaciones de la corrección tradicional de un solo modelo y permite el aprendizaje desacoplado del modelado de desviaciones y la toma de decisiones de corrección.

Introducción

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

La evaluación y calibración docente constituyen el núcleo para garantizar la calidad docente en la educación inteligente. A través del análisis dinámico, la corrección de errores y la calibración de resultados, proporcionan una base para la mejora de la enseñanza y el aprendizaje personalizado. Su precisión y equidad afectan directamente a si la educación inteligente puede superar los sesgos tecnológicos y proporcionar un apoyo educativoequilibrado 1,2. Sin embargo, los métodos existentes presentan varias deficiencias: dependen de una única fuente de datos, ignoran la situación real y conducen a sesgos de datos y sesgos de corrección. La falta de un mecanismo dinámico de adaptación a la equidad dificulta satisfacer las necesidades de equidad de las disciplinas y escenarios 3,4. Además, existen problemas como la falta de indicadores de equidad y el sesgo en las estrategias de corrección al tratar con datos heterogéneos de múltiples fuentes. Con este fin, los investigadores han realizado investigaciones desde múltiples dimensiones, como la evaluación de la enseñanza asistida por tenis basada en un algoritmo mejorado de trayectoriadensa 5. Yin et al. utilizaron el proceso de jerarquía analítica y un algoritmo de síntesis difusa para monitorizar la enseñanza enlínea 6. Chen analizó datos educativos de personas mayores utilizando un algoritmo mejorado de minería de datos para mejorar la calidad de laenseñanza 7.

Aunque estos estudios han avanzado, persisten problemas como el sesgo de resultados de calibración y la mala coordinación de la equidad. Por ello, construir un modelo que proporcione simultáneamente una calibración precisa de la evaluación docente y una garantía dinámica de equidad se ha convertido en un foco de investigación en educación inteligente. La red generativa adversarial (GAN) se adapta para eliminar la influencia implícita de atributos sensibles sobre los resultados mediante entrenamiento adversarial en tiempo real entre el generador y el discriminador, asegurando que las salidas estén determinadas por factores centrales en lugar de por el sesgoinducido por etiquetas 8. El GAN muestra ventajas en el manejo de sesgos de grupo en los datos de evaluación y en el modelado de restricciones de equidad no lineales. Cheng et al. propusieron un algoritmo de mejora de imágenes basado en GAN para abordar imágenes de baja resolución. El generador generaba imágenes de alta resolución desde entradas de baja resolución, y el discriminador distinguía las imágenes generadas de las imágenes reales de alta resolución. El entrenamiento adversarial optimiza los parámetros para que la salida del generador se acerque a las imágenesreales 9. Kang et al. propusieron un modelo GAN cross-modal para mejorar la eficiencia del procesamiento de datos multimodal en los campos de las energías renovables. El generador recibe datos monomodales, el discriminador distingue los generados de los datos multimodales reales, y el entrenamiento adversarial optimiza el modelo para mejorar la eficiencia10. El algoritmo de árbol de decisión de aumento de gradiente (GBDT) es un algoritmo clásico para el procesamiento de datos estructurados con una fuerte capacidad de captura de características. Al integrar iterativamente múltiples árboles de decisión, GBDT aprende con precisión patrones de error de datos y muestra ventajas en el procesamiento de información de evaluación heterogénea de múltiples fuentes y en la corrección de desviaciones no linealesde puntuación 11,12. Mizuno et al propusieron un método de predicción de trayectoria basado en GBDT para desastres de lluvias intensas, aprendiendo características de trayectorias y prediciendo trayectorias de desastres con datos en tiempo real, seleccionando predicciones óptimas a través de múltiples árboles de decisión13. Gao et al. desarrollaron un método de análisis visual basado en GBDT para la predicción de la tasa de clics publicitaria, aprendiendo la relación entre las características visuales y los datos históricos de clics para predecir tasas de clics en nuevosanuncios 14. Basándose en los desafíos anteriores, esta investigación pretende responder sistemáticamente a la siguiente pregunta científica central: ¿Cómo puede construirse un modelo inteligente de evaluación educativa para integrar de manera eficiente datos heterogéneos de múltiples fuentes, adaptarse dinámicamente a diferentes escenarios de enseñanza y, al mismo tiempo, garantizar la precisión de la calibración y la equidad en los resultados? Para responder a esta pregunta, este estudio utiliza el efecto sinérgico del mecanismo de restricción de equidad de la GAN y la capacidad precisa de calibración de errores de la GBDT. Además, se investiga cómo introducir tecnologías avanzadas, como el procesamiento del lenguaje natural (BERT), el aprendizaje por refuerzo (RL), los mecanismos de atención (AM), las redes de memoria a corto plazo (LSTM), las redes de atención de grafos (GAT) y la destilación de conocimiento (KD), para compensar las limitaciones inherentes de un único modelo en la extracción de características, adaptación dinámica y eficiencia del razonamiento. En última instancia, el objetivo es proporcionar una solución de calibración de evaluaciones docentes que sea precisa y justa, y que cuente con una fuerte capacidad de generalización para el campo de la educación inteligente.

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Protocolo

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Diseño y optimización del algoritmo FairEduNet
El estudio combina GAN y GBDT para construir el algoritmo FairEduNet, logrando los objetivos duales de corrección de equidad y corrección de precisión, en lugar del compromiso de la optimización unidireccional. FairEduNet adopta una arquitectura colaborativa de doble canal: el canal troncal GBDT es responsable del modelado estructurado de errores y la corrección precisa, mientras que el canal auxiliar GAN se centra en desacoplar atributos sensibles y ajustar dinámicamente la equidad. La arquitectura del algoritmo FairEduNet, que combina GAN y GBDT, se muestra en la Figura 1.

figure-protocol-1
Figura 1: Arquitectura del algoritmo FairEduNet que combina GAN y GBDT. Por favor, haga clic aquí para ver una versión ampliada de esta figura.

Como se muestra en la Figura 1, FairEduNet primero recopila y preprocesa datos de evaluación multifuente. GBDT utiliza múltiples árboles de decisión para aprender iterativamente los patrones de error de evaluación, emite resultados iniciales de calibración y los pasa al módulo GAN. El GAN entrena al discriminador para aprender la relación entre los resultados iniciales de calibración y los atributos sensibles, mientras que el generador ajusta dinámicamente los parámetros de calibración. A través de múltiples rondas de entrenamiento adversarial y verificación de equidad, se optimiza el sesgo de equidad. Finalmente, los resultados calibrados por equidad se envían al módulo GBDT, que ajusta para precisión y equidad, generando la base de calibración de la evaluación docente y el informe. GBDT calcula los residuos como se muestra en la Ecuación (1).

figure-protocol-2(1)

En la ecuación (1), figure-protocol-3 representa el residuo de la i-ésima muestra en la t-ésima iteración, yi representa el valor verdadero, y figure-protocol-4 representa el valor de predicción de la t-1-ésima iteración. El proceso adversarial GAN se muestra en la Ecuación (2).

figure-protocol-5(2)

En la ecuación (2), x representa el resultado inicial de la calibración, z representa características de atributos sensibles, Pdata(x)  representa la verdadera distribución de características no sensibles, Pz(z) representa la distribución de atributos sensibles, D representa el discriminador y G representa el generador15. La salida inicial de calibración de GBDT se muestra en la Ecuación (3).

figure-protocol-6(3)

En la ecuación (3), figure-protocol-7 representa la predicción de la i-ésima muestra por el árbol de decisión inicial, K representa el número total de árboles de decisión, γk representa el peso del k-ésimo árbol y hk(xi) representa la salida de predicción del k-ésimo árbol para el i-La muestra. El algoritmo FairEduNet puede proporcionar calibración precisa y garantía de equidad para la enseñanza de los datos de evaluación. Sin embargo, al procesar datos de evaluación no estructurados y adaptarse a escenarios dinámicos, FairEduNet muestra una capacidad débil de extracción de características para características no estructuradas, lo que resulta en sesgo de calibración. Además, los indicadores de equidad y parámetros de calibración de FairEduNet se establecen estáticamente, limitando su adaptabilidad a diferentes escenarios de enseñanza y afectando la calidad general de la calibración. La combinación de representaciones bidireccionales de codificadores de transformadores (BERT) y aprendizaje por refuerzo (RL), el algoritmo BERT-RL, puede extraer con precisión características profundas de texto no estructurado y adaptar dinámicamente parámetros de escenarios sin establecer manualmente umbrales estáticos, mejorando aún más la fiabilidad de las salidas del algoritmo enlos escenarios 16,17. Métodos tradicionales como TF-IDF se basan en la frecuencia de palabras pero carecen de un entendimiento contextual profundo y no pueden distinguir direcciones específicas de "equidad" en diferentes escenarios. Word2Vec produce vectores de palabras estáticos, que luchan por adaptarse a cambios contextuales complejos y reconocen sesgos indirectos. BERT utiliza autoatención multicapa para codificar contexto bidireccional, capturando tanto términos explícitos sesgados como lógica implícita sesgada. Los enfoques tradicionales requieren listas de palabras de sesgo construidas manualmente, dependen de la experiencia subjetiva y cubren escenarios limitados. Mediante aprendizaje preentrenado por transferencia de modelos, BERT aprende automáticamente características semánticas profundas sin un esfuerzo manual extenso, ofreciendo una mayor generalización para reconocer sesgos ambiguos. Además, los métodos tradicionales a menudo pierden información con textos largos, mientras que BERT soporta hasta 512 tokens, preservando relaciones contextuales, localizando con precisión características de sesgo y permitiendo una corrección de equidad de grano fino. El proceso de funcionamiento de BERT-RL se muestra en la Figura 2.

figure-protocol-8
Figura 2: Diagrama de flujo de operaciones del algoritmo BERT-RL. Por favor, haga clic aquí para ver una versión ampliada de esta figura.

Como se muestra en la Figura 2, BERT-RL primero estandariza los datos de evaluación de texto no estructurados y los introduce en el modelo BERT. BERT utiliza un codificador Transformer para modelado semántico bidireccional para extraer características clave y construir una matriz de características. La matriz de características se introduce entonces en el módulo RL, que aprende la estrategia óptima a través de múltiples iteraciones. La configuración optimizada de parámetros finalmente se introduce en FairEduNet, mejorando su adaptabilidad. El cálculo del peso de la característica de autoatención BERT se muestra en la Ecuación (4).

figure-protocol-9(4)

En la ecuación (4), dk representa la dimensión del vector K. La función de recompensa multiobjetivo RL se expresa en la Ecuación (5).

figure-protocol-10(5)

En la ecuación (5), ω1, ω2 y ω3 representan coeficientes de peso, figure-protocol-11 el error de calibración, Dt es la desviación de equidad, Del objetivo es la desviación de equidad del objetivo, y Tt es el tiempode ejecución 18. Este estudio combina BERT-RL con FairEduNet para formar el algoritmo BERT-RL-FairEduNet, conocido como BFEN. BFEN logra calibración precisa y garantía de equidad en la enseñanza de los datos de evaluación mediante iteraciones de características GBDT y entrenamiento adversarial en tiempo real GAN, mientras que BERT-RL optimiza FairEduNet en el manejo de datos no estructurados y adaptándose dinámicamente a escenarios, abordando debilidades en la extracción de características y limitaciones estáticas de parámetros. El estudio utilizó el modelo BERT-base-chino y preentrenó el corpus de registros docentes reales, textos grabados en aula y documentos de política educativa de la Plataforma Nacional de Educación Inteligente para el curso académico 2024 a 2025, con un tamaño de vocabulario de 21128. La dimensión de capa oculta del modelo es 768, con 12 cabezas de atención y 12 capas. La profundidad del árbol GBDT se estableció en 8, el número de árboles era 200 y la tasa de aprendizaje era 0,1. El ciclo de entrenamiento de GAN es de 150 disparos, y el discriminador utiliza una red totalmente conectada de 3 capas con tamaños de 512, 256 y 1. El generador utiliza una red totalmente conectada de 4 capas con tamaños 1024, 512, 256 y 1. El número de unidades ocultas en LSTM es 128, y la longitud de la secuencia es 512. El GAT tiene 2 capas y 4 cabezas de atención. La temperatura para la destilación del conocimiento está fijada en 3,0. Los coeficientes de peso de recompensa en RL ω1 = 0,4, ω2 = 0,35 y ω3 = 0,25. Los criterios de selección de pesos son equilibrar el equilibrio frontal de Pareto de la optimización multiobjetivo con los requisitos de interpretabilidad de las prácticas de equidad educativa. Los experimentos se completaron mediante una división de datos del 50% mediante validación cruzada y ajuste de hiperparámetros. El proceso BFEN para la calibración de la evaluación docente se muestra en la Figura 3.

figure-protocol-12
Figura 3: Proceso de corrección del algoritmo BFEN para la educación inteligente y la evaluación de la enseñanza. Por favor, haga clic aquí para ver una versión ampliada de esta figura.

Como se muestra en la Figura 3, BFEN primero preprocesa datos de evaluación docente multifuente. BERT optimiza la capacidad de extracción de características de FairEduNet calculando la similitud semántica del texto y los pesos profundos de características basándose en una ventana semántica, seleccionando características importantes para construir una matriz de características semánticas de alta dimensión. RL establece entonces una función de recompensa multiobjetivo y calcula los gradientes de adaptabilidad de escenarios y ajustes de parámetros para optimizar aún más los umbrales de equidad y los parámetros de calibración. FairEduNet calcula las desviaciones entre los datos de evaluación y los modelos de patrones de error, actualiza iterativamente los pesos del árbol de decisión y ajusta estrategias de calibración hasta que los errores se estabilizan dentro de umbrales preestablecidos. El resultado final incluye el modelo de calibración de errores y el informe de verificación de equidad. El modelo de calibración se aplica a los datos de evaluación docente, generando tablas comparativas pre y post-calibración, que se combinan con la biblioteca de estándares de equidad educativa inteligente para determinar los parámetros de calibración objetivo, proporcionando una base científica para la calibración de evaluaciones docentes en educación inteligente. Esta biblioteca estándar cubre tres dimensiones: equidad en oportunidades educativas, equidad en procesos y equidad en resultados, e incluye 12 indicadores principales. Estos indicadores incluyen el equilibrio de la asignación de recursos educativos entre regiones, la diferencia en la cobertura de infraestructura digital entre escuelas urbanas y rurales, el umbral de tolerancia para la respuesta tardía al diagnóstico de situaciones de aprendizaje (≤200 ms), la tolerancia a la falta de datos en la evaluación multimodal (≤3,5%), la sensibilidad a la detección de sesgos de algoritmos (desviación AUC para el etiquetado de género/región/etapa ≤ 0,02), el umbral de divergencia KL para la distribución de puntuaciones antes y después de la corrección (≤0,08), la puntuación de interpretabilidad de las sugerencias de intervención docente (≥4,2/5,0), la puntualidad de las actualizaciones del perfil de los estudiantes (completadas en T + 1 días), el coeficiente de consistencia del reconocimiento de créditos multiplataforma (≥0,93), la precisión del alineamiento semántico de las políticas educativas (puntuación BERT ≥ 0,86) y la completitud de la generación de informes de verificación de equidad (incluida la atribución de sesgos, intervalos de confianza y instantáneas de parámetros reproducibles), así como la tasa dinámica de validación de adaptación de escenarios que cubre tres escenarios típicos: aulas en vivo, tareas asíncronas y asistentes de enseñanza con IA. El cálculo de similitud semántica de características se muestra en la Ecuación (6).

figure-protocol-13(6)

En la ecuación (6), fi representa el valor de la i-ésima dimensión semántica de la característica, gi representa el valor de la i-ésima dimensión importante de la característica de evaluación, y n representa el número total de dimensiones de características. El cálculo del parámetro de adaptación del escenario RL se muestra en la Ecuación (7).

figure-protocol-14(7)

En la ecuación (7), θt representa el valor del parámetro en la t-ésima iteración, α representa la tasa de aprendizaje y figure-protocol-15 representa el gradiente de parámetros basado en la función de recompensa R(θt).

Construcción del modelo de calibración de evaluación docente
Aunque BFEN demuestra ciertas ventajas en la calibración de evaluaciones docentes, aún se enfrenta a baja eficiencia de integración para datos heterogéneos de evaluación multifuente y una adaptación dinámica insuficiente de la equidad en aplicaciones prácticas. El algoritmo AM-LSTM, que combina el Mecanismo de Atención (AM) y la Memoria a Corto Plazo Largo (LSTM), asigna pesos a características clave de los datos de evaluación multifuente a través de AM y captura los patrones dinámicos de cambio de los datos de evaluación a lo largo del tiempo utilizando la capacidad de memoria secuencial de LSTM. Este enfoque mejora eficazmente la eficiencia en la integración de datos multifuente y el aprendizaje dinámico de características19,20. El proceso operativo del AM-LSTM se muestra en la Figura 4.

figure-protocol-16
Figura 4: Diagrama de flujo de operación AM-LSTM. Por favor, haga clic aquí para ver una versión ampliada de esta figura.

Como se muestra en la Figura 4, AM-LSTM primero preprocesa datos heterogéneos de evaluación docente multifuente para formar un conjunto de datos estandarizado. AM calcula los pesos de atención de características de diferentes fuentes de datos para seleccionar características importantes y construye una matriz ponderada de características. La matriz de características ponderada se introduce entonces en LSTM, que utiliza su mecanismo de acceso para aprender patrones dinámicos a lo largo del tiempo, capturando relaciones entre datos de evaluación en diferentes etapas y generando vectores dinámicos de características. Finalmente, estos vectores dinámicos de características se combinan con restricciones de equidad para generar resultados intermedios de calibración que se adaptan a la integración de datos multifuente y a escenarios dinámicos, proporcionando una base para la optimización posterior del modelo. El cálculo del peso de atención se muestra en la Ecuación (8).

figure-protocol-17(8)

En la ecuación (8), n representa la asignación de atención para la n-ésima característica, xn representa la similitud, q representa el vector de consulta y softmax representa la función de activación. La puerta de olvido del LSTM se expresa en la Ecuación (9).

figure-protocol-18(9)

En la ecuación (9), Wf es el peso de la puerta de olvido, bf es el sesgo de la puerta de olvido, xt es la entrada en el tiempo t, ht-1 es la variable de estado externa en el tiempo t-1, y σ representa la funciónsigmoide 21. Este estudio combina AM-LSTM con BFEN para construir el modelo de calibración de evaluación docente AM-LSTM-BFEN, conocido como FBFEN. En este modelo, AM-LSTM aborda las limitaciones de BFEN en la eficiencia de integración heterogénea de datos multifuente y la extracción dinámica de características. También integra restricciones de equidad para optimizar los resultados de calibración intermedia, permitiendo a BFEN lograr una calibración precisa y una garantía dinámica de equidad para la enseñanza de los datos de evaluación. El proceso de funcionamiento de FBFEN se muestra en la Figura 5.

figure-protocol-19
Figura 5: Proceso operativo del modelo de evaluación y corrección de la enseñanza FBFEN. Por favor, haga clic aquí para ver una versión ampliada de esta figura.

Como se muestra en la Figura 5, FBFEN primero preprocesa los datos originales de evaluación docente multifuente e introduce el conjunto de datos estandarizado en el módulo AM-LSTM. AM calcula los pesos de atención de las características, mientras que LSTM aprende patrones dinámicos, generando resultados intermedios de calibración que integran información multifuente y características dinámicas. Los resultados intermedios se introducen entonces en el módulo BFEN. GBDT aprende iterativamente los patrones de error de los datos de evaluación basándose en los resultados intermedios y en el modelo de error preestablecido, generando resultados preliminares de calibración. Mientras tanto, GAN analiza el sesgo de equidad causado por atributos sensibles en los resultados preliminares mediante entrenamiento adversarial entre el generador y el discriminador, ajustando dinámicamente los parámetros de calibración para eliminar el sesgo. Finalmente, los parámetros de calibración optimizados para GAN se envían a GBDT para actualizar los pesos del árbol de decisión y las estrategias de calibración, produciendo un resultado de calibración secundario que equilibra precisión y equidad. La estandarización de datos se expresa en la Ecuación (10).

figure-protocol-20(10)

En la ecuación (10), z' representa el valor estandarizado, z representa el valor original, y zmin y zmax representan los valores mínimo y máximo. La función objetivo final del generador GAN se expresa en la Ecuación (11).

figure-protocol-21(11)

En la ecuación (11), N representa el número de iteraciones, λ representa el factor de peso de pérdida, ωi representa el factor de peso de la i-ésima iteración, figure-protocol-22 representa la función de pérdida adversarial y figure-protocol-23 representa la pérdida binaria de entropíacruzada 22.

Optimización del modelo de calibración de evaluación de la enseñanza de FBFEN
Aunque FBFEN demuestra una fuerte integración de datos multifuente y garantía dinámica de equidad en la calibración de evaluaciones docentes, sigue enfrentándose a una correlación de características débil y baja eficiencia en formación e inferencia debido a la compleja estructura del modelo en escenarios educativos complejos. El algoritmo GAT-KD, que combina la Red de Atención de Grafos (GAT) y la Destilación de Conocimiento (KD), construye dinámicamente un grafo de asociación semántica entre características a través del mecanismo de atención de GAT, mejorando la alineación semántica de datos multifuente. KD comprime el conocimiento del modelo complejo en una red ligera, mejorando significativamente la eficiencia de la inferencia mientras mantiene el rendimiento delmodelo 23,24. El proceso operativo de GAT-KD se muestra en la Figura 6.

figure-protocol-24
Figura 6: Diagrama de flujo de operación GAT-KD. Haz clic aquí para ver una versión ampliada de esta figura.

Como se muestra en la Figura 6, GAT-KD construye un grafo semántico de asociación entre características a través del módulo GAT, agrega dinámicamente información de características vecinales usando el mecanismo de atención y mejora la representación semántica de características locales. KD utiliza entonces las etiquetas blandas de salida como señales de supervisión, minimizando la pérdida de divergencia entre las distribuciones de salida y la pérdida de entropía cruzada entre sus predicciones y etiquetas verdaderas, logrando la transferencia de conocimiento y compresión del modelo. La salida final es un modelo de calibración ligero con alta precisión y eficiencia. El cálculo del coeficiente de atención de la GAT se muestra en la ecuación (12).

figure-protocol-25(12)

En la ecuación (12), figure-protocol-26 y figure-protocol-27 representan los vectores de características de los nodos i y j, W representa la matriz de pesos aprendible, a representa el vector de pesos de atención, figure-protocol-28 representa la operación de concatenación y LeakyReLU representa la funciónde activación 25. El cálculo de la función de pérdida KD se muestra en la Ecuación (13).

figure-protocol-29(13)

En la ecuación (13), KL representa la pérdida por divergencia, T2 representa el balance de escalado del gradiente, pstudent representa la probabilidad de etiqueta blanda del modelo ligero, y pprofesor representa la probabilidad de etiqueta blanda del modelocomplejo 26. Al combinar la asociación de características mejorada por atención y la transferencia ligera de conocimiento, GAT-KD aborda eficazmente el sesgo semántico de características y la alta complejidad computacional. Este estudio integra GAT-KD en FBFEN para formar el modelo de calibración de evaluación docente GAT-KD-FBFEN, conocido como GFBFEN. GAT-KD optimiza las deficiencias de FBFEN en la captura incompleta de correlación de características multifuente y la baja eficiencia de inferencia. El proceso de funcionamiento de GFBFEN se muestra en la Figura 7.

figure-protocol-30
Figura 7: Proceso de evaluación y corrección del modelo de evaluación y corrección de la enseñanza del GFBFEN. Por favor, haga clic aquí para ver una versión ampliada de esta figura.

Como se muestra en la Figura 7, GFBFEN estandariza los datos de evaluación docente de múltiples fuentes. La GAT modela relaciones complejas entre características y calcula dinámicamente los pesos de asociación semántica entre nodos utilizando mecanismos de atención. KD comprime el conocimiento del modelo complejo en una red ligera, mejorando significativamente la eficiencia de la inferencia manteniendo la precisión. El módulo AM-LSTM asigna pesos de importancia a características multifuente y captura patrones dinámicos temporales de los datos de evaluación, generando resultados intermedios de calibración que integran información de múltiples fuentes. Estos resultados se introducen en el módulo BFEN para su procesamiento profundo. Específicamente, BERT extrae características semánticas de texto no estructurado, RL optimiza dinámicamente umbrales de equidad y parámetros de calibración, GBDT aprende iterativamente patrones de error para la calibración preliminar, y GAN elimina sesgos causados por atributos sensibles mediante entrenamiento adversarial. El mecanismo dinámico de ajuste de parámetros calibra automáticamente la sensibilidad de respuesta y los pesos de equidad de cada módulo detectando en tiempo real los cambios temporales y la distribución de grupos en la escena docente, resolviendo así el problema de la insuficiente adaptabilidad causada por la configuración estática de parámetros y asegurando que el modelo pueda mantener robustez y equidad en diferentes etapas de enseñanza, grupos de estudiantes y escenarios de evaluación. El tipo de evaluación afecta directamente a la granularidad y al ciclo de retroalimentación del modelado de series temporales, mientras que la evaluación formativa enfatiza la naturaleza dinámica del proceso. Las diferencias en disciplinas determinan la asignación de características entre los módulos BERT y GBDT. Por lo tanto, adoptar un mecanismo de ajuste dinámico puede adaptarse eficazmente a diferentes tipos de evaluación y características disciplinares. Finalmente, a través de múltiples rondas de retroalimentación de parámetros y optimización iterativa, el modelo produce resultados precisos y justos de calibración de evaluaciones docentes. La función de optimización de restricciones de equidad dinámica se expresa en la Ecuación (14).

figure-protocol-31(14)

En la ecuación (14), S representa el conjunto de atributos sensibles, figure-protocol-32 representa el resultado de calibración de salida previsto, figure-protocol-33 representa la varianza de las predicciones dentro de los grupos, γ representa parámetros intergrupos y figure-protocol-34 representa el valor esperado global. El cálculo adaptativo de los pesos de fusión de características multifuente se muestra en la Ecuación (15).

figure-protocol-35(15)

En la ecuación (15), wk representa el peso de características de la k-ésima fuente de datos, β representa el parámetro de peso, Sim representa la función de medición de similitud de características, fk representa el vector de características extraído de la k-ésima fuente de datos, fglobal representa el centro global de características y K  representa el número total de fuentes de datos. El estudio estableció los pesos de atributos sensibles, incluyendo género, etnia, región, situación económica familiar y origen en lengua materna. Los pesos se determinan en función de los resultados del análisis de correlación. El estudio utilizó el coeficiente de correlación de Pearson y el coeficiente de correlación de rango Spearman como indicadores duales para la evaluación conjunta, combinados con experiencia experta en el campo de la educación para calibración de peso. La determinación final de los pesos para cada atributo sensible arrojó valores de 0,18 para género, 0,22 para etnia, 0,25 para región, 0,19 para la situación económica familiar y 0,16 para el origen de lengua materna. Género: Identidad de género según registro legal y autoidentificación, binario (hombre/mujer) con opciones no binarias; Campo de datos "género". Etnia: Basada en la identificación étnica nacional de 56 grupos, compatibles con grupos no identificados y transfronterizos; Campo de datos "etnicidad". Región: División administrativa del registro de hogares o residencia a largo plazo, que abarca los niveles provincial, municipal y de condado, considerando la estructura dual urbano-rural y la población migrante; Campo de datos "región". Estado económico familiar: Según estándares estadísticos nacionales e indicadores de asistencia educativa, utilizando una clasificación de cinco niveles; Campo de datos "economic_status". Antecedentes de la lengua materna: Enseñanza primaria y comunicación familiar durante la educación básica, abarcando mandarín, lenguas minoritarias, dialectos y lenguas extranjeras, ponderados según la edad y frecuencia de adquisición; Campo de datos "mother_tongue."

El proceso de corrección adoptó un mecanismo dinámico de ponderación de tres etapas. La primera etapa implementó la identificación inicial de desviaciones basada en la matriz de pesos de atributos sensibles, marcando puntos de datos que se desviaban significativamente del centro global de características en dimensiones como género, etnia y región. La segunda etapa introduce restricciones educativas del contexto para recalificar la intensidad de la desviación de manera consciente del contexto. La tercera etapa verifica la estabilidad de corrección mediante pruebas de perturbación contrafactual, reemplazando sistemáticamente los valores de atributos sensibles manteniendo sin cambios las características no sensibles, y observando si el cambio en las puntuaciones de evaluación se mantiene dentro del umbral del ±±3,2%.

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Resultados

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Análisis del rendimiento del algoritmo BFEN
Los indicadores evaluados en los experimentos incluyeron los siguientes:

La precisión de la corrección de la evaluación (ECA) denota la proporción de ítems de desviación correctamente identificados y corregidos por el modelo dentro de los resultados de la evaluación docente, reflejando así la efectividad global del mecanismo de corrección. Valores más altos indican una precisión de corrección supe...

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Discusión

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

El algoritmo BFEN propuesto en este estudio demostró un rendimiento superior en experimentos comparativos. Desde la perspectiva de ECA y FDR, superó significativamente a los algoritmos PRF, EAB y DBLR. Al calibrar los registros de evaluación de 421, BFEN aumentó el ECA al 98,75% y mantuvo la estabilidad, mientras que FDR disminuyó al 2,87%. Este rendimiento resultó de la integración de BERT-RL para la optimización de características y la adaptación dinámica. BERT extrajo con precisión in...

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Divulgaciones

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

El autor no tiene nada que revelar.

Agradecimientos

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

El autor declara que no existe conflicto de intereses.

Acceso restringido. Inicie sesión o comience una prueba gratuita para ver este contenido.

Materiales

Lista de materiales utilizados en este artículo
NombreEmpresaNúmero de catálogoComentarios
Global Education Monitoring Report datasetUNESCOhttps://www.education-progress.org/Dataset
NumPyNumPyhttps://numpy.org/Preprocesamiento de datos
PandasPandas, NumPyhttps://pandas.pydata.org/Preprocesamiento de datos
PyCharm Professional 2023.1PyCharm Versión 2023.1Entorno de desarrollo
Python 3.9Python Versión 3.9‌Lenguaje de programación
Scikit-learnScikit-learnhttps://scikit-learn.org/stable/index.htmlAprendizaje automático
SeabornSeabornhttps://seaborn.pydata.org/Visualización
Spanish middle school student academic performance datasetUC Irvine Machine Learning Repositoryhttps://archive.ics.uci.edu/dataset/320/student+performanceDataset
TensorFlowTensorFlowhttps://www.tensorflow.org/Aprendizaje profundo
Windows 11MicrosoftVersión 11Sistema operativo

Reimpresiones y permisos

Solicitar permiso para reutilizar el texto o las figuras de este artículo de JoVE

Solicitar permiso

Etiquetas

Ingenier aN mero 233N mero 233Valor vac oN meroEducaci n inteligenteRed generativa antag nicarbol de decisi n de potenciaci n del gradiente

Artículos relacionados