Исследовательская статья

Разработка алгоритмов FairEduNet и калибровка оценки в преподавании с учётом равенства в высшем образовании

DOI:

10.3791/70189

21 июля 2026 г.

В этой статье

Краткое содержание

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Цель исследования — предложить новый подход к обучению, калибровке оценки и образовательной справедливости в интеллектуальном образовании. Экспериментальные результаты показывают, что предлагаемая модель значительно превосходит сравнительные модели, эффективно решая проблемы плохой интеграции данных из нескольких источников и справедливости в существующих методах калибровки.

Аннотация

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Современные методы калибровки оценки преподавания сталкиваются с такими трудностями, как низкая эффективность интеграции при обработке многоуровневых гетерогенных оценочных данных, недостаточная адаптивность между различными дисциплинами и сценариями преподавания, а также предвзятость в результатах с низкой гарантией справедливости. Цель исследования — создать интерпретируемую, переносимую и масштабируемую рамку коррекции справедливости для глубокого моделирования и динамической коррекции данных оценки преподавания. Эти проблемы затрудняют выполнение основных требований сбалансированного преподавания в интеллектуальном образовании. В данном исследовании предлагается ориентированный на справедливость алгоритм образовательной сети, интегрирующий генеративную состязательную сеть и дерево решений с ускорением градиента. Алгоритм строит механизм калибровки справедливости и сочетает двунаправленную модель представления энкодеров с сетью внимания графов для оптимизации извлечения признаков и динамической адаптивности, повышая эффективность обработки данных в нескольких источниках и точность калибровки справедливости. Такой подход обеспечивает точную калибровку и обеспечение справедливости в учебных оценках. В индикаторном тесте модель достигла точности 98,76% в признаках оценки кластеризации, 98,05% в коррекции справедливости и 0,968% согласованности коррекции между сценариями в наборе валидации. В задаче тестирования стоимости потерь общая потеря модели снизилась с 0,1237 до 0,1018 во время задачи коррекции оценки в валидационном наборе. В индикаторном тесте модель достигла точности 98,76% в признаках оценки кластеризации, 98,05% в коррекции справедливости и 0,968% согласованности коррекции между сценариями в наборе валидации. Экспериментальные результаты показывают, что предлагаемая модель значительно превосходит сравнительные модели, эффективно решая проблемы плохой интеграции данных из нескольких источников и справедливости в существующих методах калибровки. Кроме того, он предоставляет инновационные алгоритмические рамки для разработчиков технологий и надёжные технические инструменты для образовательных администраторов для продвижения равенства в преподавании. Вклад в исследования заключается в: (i) интеграции трёх основных модулей, включая многоисточниковую предобработку данных, динамическую верификацию индекса справедливости и визуализацию объяснимости; и (ii) предложение парадигмы коррекции справедливости, основанной на совместной оптимизации генеративных состязательных сетей и деревьев градиентного бустинга, что преодолевает ограничения традиционной коррекции с одной моделью и позволяет развязанное обучение моделированию отклонений и принятия решений по коррекции.

Введение

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Оценка и калибровка преподавания составляют основу обеспечения качества преподавания в интеллектуальном образовании. Благодаря динамическому анализу, коррекции ошибок и калибровке результатов они создают основу для улучшения преподавания и персонализированного обучения. Их точность и справедливость напрямую влияют на то, сможет ли интеллектуальное образование преодолеть технологические предвзятости и обеспечить сбалансированную образовательную поддержку 1,2. Однако существующие методы имеют несколько недостатков: они опираются на один источник данных, игнорируют реальную ситуацию и приводят к смещению данных и коррекционной ошибке. Отсутствие динамического механизма адаптации справедливости затрудняет удовлетворение потребностей дисциплин исценариев 3,4. Кроме того, существуют такие проблемы, как отсутствие индикаторов справедливости и смещение в стратегиях коррекции при работе с гетерогенными данными из нескольких источников. С этой целью учёные проводили исследования по нескольким направлениям, например, оценивая обучение с теннисом на основе улучшенного алгоритма плотнойтраектории 5. Йин и др. использовали процесс аналитической иерархии и алгоритм нечеткого синтеза для мониторинга онлайн-обучения6. Чен проанализировал образовательные данные для пожилых людей с помощью усовершенствованного алгоритма анализа данных для повышения качестваобучения 7.

Хотя эти исследования добились прогресса, такие проблемы, как смещение результатов калибровки и плохая координация справедливости, остаются. Поэтому создание модели, которая одновременно обеспечивает точную калибровку оценки преподавания и динамическую гарантию справедливости, стало направлением исследований в интеллектуальном образовании. Генеративная состязательная сеть (GAN) адаптируется для устранения неявного влияния чувствительных атрибутов на результаты посредством сопернического обучения в реальном времени между генератором и дискриминатором, обеспечивая определение результатов основными факторами, а не смещениями, вызваннымиметками 8. GAN демонстрирует преимущества в работе с групповыми предвзятостями в оценочных данных и моделировании нелинейных ограничений справедливости. Ченг и др. предложили алгоритм улучшения изображения на базе GAN для работы с изображениями низкого разрешения. Генератор выводит изображения высокого разрешения с низкоразрешённых входов, а дискриминатор отличает сгенерированные изображения от реальных высокоразрешающих изображений. Состязательное обучение оптимизирует параметры так, чтобы выход генератора приближался к реальнымизображениям 9. Канг и др. предложили кроссмодальную модель GAN для повышения эффективности мультимодальной обработки данных в областях возобновляемой энергетики. Генератор получает одномодальные данные, дискриминатор отличает генерируемые данные от реальных мультимодальных данных, а adpersarial training оптимизирует модель для повышения эффективности10. Алгоритм дерева решений градиентного усиления (GBDT) — это классический алгоритм структурированной обработки данных с сильными возможностями захвата признаков. Итеративно интегрируя несколько деревьев решений, GBDT точно изучает паттерны ошибок данных и демонстрирует преимущества в обработке многоисточниковой гетерогенной оценочной информации и исправлении нелинейных отклоненийбаллов 11,12. Мизуно и соавторы предложили метод прогнозирования путей на основе GBDT для бедствий с сильными осадками, изучая особенности путей и прогнозируя пути катастроф с помощью данных в реальном времени, выбирая оптимальные прогнозы через несколько деревьеврешений 13. Гао и др. разработали метод визуального анализа на основе GBDT для прогнозирования частоты кликов в рекламе, изучая связь между визуальными признаками и историческими данными кликов для прогнозирования частоты кликовдля новых объявлений 14. Исходя из вышеуказанных задач, данное исследование направлено на систематический ответ на следующий основной научный вопрос: как можно построить интеллектуальную модель оценки образования для эффективной интеграции многоисточниковых гетерогенных данных, динамической адаптации к различным сценариям преподавания и одновременного обеспечения точности калибровки и справедливости результатов. Для ответа на этот вопрос в исследовании используется синергетический эффект механизма ограничения справедливости GAN и точную возможность калибровки ошибок GBDT. Кроме того, проводятся исследования по внедрению передовых технологий, таких как обработка естественного языка (BERT), обучение с подкреплением (RL), механизмы внимания (AM), сети длительной краткосрочной памяти (LSTM), графовые сети внимания (GAT) и дистилляция знаний (KD), чтобы компенсировать внутренние ограничения одной модели в области извлечения признаков, динамической адаптации и эффективности рассуждения. В конечном итоге цель — предоставить решение для калибровки оценки преподавания, которое будет одновременно точным и справедливым, а также обладает сильными возможностями обобщения для области интеллектуального образования.

Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.

Протокол

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Проектирование и оптимизация алгоритмов FairEduNet
Исследование объединяет GAN и GBDT для построения алгоритма FairEduNet, достигая двойных целей — коррекции справедливости и коррекции точности, а не компромисса односторонней оптимизации. FairEduNet использует двухканальную совместную архитектуру: основной канал GBDT отвечает за структурированное моделирование ошибок и точную коррекцию, тогда как вспомогательный канал GAN сосредоточен на разделении чувствительных атрибутов и динамической корректировке справедливости. Архитектура алгоритмов FairEduNet, объединяющая GAN и GBDT, показана на рисунке 1.

figure-protocol-1
Рисунок 1: Архитектура алгоритма FairEduNet, объединяющая GAN и GBDT. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этой картины.

Как показано на рисунке 1, FairEduNet сначала собирает и предварительно обрабатывает данные многоисточниковой оценки. GBDT использует несколько деревьев решений для итеративного изучения паттернов ошибок оценки, выводит начальные результаты калибровки и передаёт их в модуль GAN. GAN обучает дискриминатор изучению связи между исходными результатами калибровки и чувствительными атрибутами, в то время как генератор динамически корректирует параметры калибровки. Через несколько раундов противоположного тренинга и проверки справедливости оптимизируется предвзятость справедливости. Наконец, результаты, откалиброванные по справедливости, возвращаются в модуль GBDT, который корректирует для точности и справедливости, выводя калибровку и отчёт для оценки преподавания. GBDT вычисляет остатки, как показано в уравнении (1).

figure-protocol-2(1)

В уравнении (1) figure-protocol-3 представляет собой остаток i-й выборки в t-й итерации, yi — истинное значение, а figure-protocol-4 — предсказывающее значение t-1-й итерации. Состязательный процесс GAN показан в уравнении (2).

figure-protocol-5(2)

В уравнении (2) x — исходный результат калибровки, z — признаки чувствительных атрибутов, Pdata(x)  — истинное распределение нечувствительных признаков, Pz(z) — распределение чувствительных атрибутов, D — дискриминатор, а G — генератор15. Начальный выход калибровки GBDT показан в уравнении (3).

figure-protocol-6(3)

В уравнении (3) figure-protocol-7 представляет предсказание i-й выборки исходным деревом решений, K — общее количество деревьев решений, γk — вес k-го дерева, а hk(xi) — результат предсказания k-го дерева для i-Этот образец. Алгоритм FairEduNet может обеспечивать точную калибровку и обеспечение справедливости для обучающих данных оценки. Однако при обработке неструктурированных оценочных данных и адаптации к динамическим сценариям FairEduNet демонстрирует слабые возможности по извлечению признаков для неструктурированных признаков, что приводит к калибровочному смещению. Кроме того, индикаторы справедливости и параметры калибровки FairEduNet устанавливаются статически, что ограничивает адаптивность к различным сценариям преподавания и влияет на общее качество калибровки. Сочетание двунаправленных представлений энкодеров из трансформаторов (BERT) и усиленного обучения (RL), алгоритма BERT-RL, позволяет точно извлекать глубокие признаки из неструктурированного текста и динамически адаптировать параметры сценария без ручной установки статических порогов, что дополнительно повышает надёжность выходных данных алгоритмов всценариях 16,17. Традиционные методы, такие как TF-IDF, опираются на частоту слов, но не обладают глубоким пониманием контекста и не могут выделить конкретные направления «справедливости» в разных ситуациях. Word2Vec создаёт статические векторы слов, которые с трудом адаптируются к сложным контекстуальным изменениям и распознают косвенные предвзятости. BERT использует многоуровневую самоконцентрацию для кодирования двунаправленного контекста, фиксируя как явные предвзятые термины, так и неявную предвзятую логику. Традиционные подходы требуют ручного составления списков слов с предвзятостью, зависят от субъективного опыта и охватывают ограниченные сценарии. Благодаря предварительно обученному обучению переноса моделей BERT автоматически осваивает глубокие семантические признаки без значительных ручных усилий, что обеспечивает более сильное обобщение в распознавании неоднозначных искажений. Кроме того, традиционные методы часто теряют информацию при длинных текстах, тогда как BERT поддерживает до 512 токенов, сохраняя контекстуальные отношения, точно определяя признаки смещения и обеспечивая тонкую коррекцию справедливости. Процесс работы BERT-RL показан на рисунке 2.

figure-protocol-8
Рисунок 2: Схема операций алгоритма BERT-RL. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этого рисунка.

Как показано на рисунке 2, BERT-RL сначала стандартизирует данные оценки неструктурированного текста и вводит их в модель BERT. BERT использует кодировщик трансформатора для двунаправленного семантического моделирования с целью извлечения ключевых признаков и построения матрицы признаков. Матрица признаков затем вводится в модуль RL, который учится оптимальной стратегии через несколько итераций. Оптимизированная конфигурация параметров наконец подаётся в FairEduNet, что повышает его адаптивность. Расчёт веса признака самовнимания BERT показан в уравнении (4).

figure-protocol-9(4)

В уравнении (4) dk представляет размерность вектора K. Многоцелевая функция вознаграждения RL выражена в уравнении (5).

figure-protocol-10(5)

В уравнении (5) ω1, ω2 и ω3 представляют коэффициенты веса, figure-protocol-11 представляют ошибку калибровки, D t — отклонение справедливости, D целевой — отклонение целевой справедливости, а Tt — время выполнения18. Это исследование объединяет BERT-RL с FairEduNet для создания алгоритма BERT-RL-FairEduNet, называемого BFEN. BFEN обеспечивает точную калибровку и обеспечение справедливости данных оценки преподавания с помощью итерации признаков GBDT и обучения противника в реальном времени GAN, в то время как BERT-RL оптимизирует FairEduNet для работы с неструктурированными данными и динамической адаптации к сценариям, устраняя слабые места в извлечении признаков и ограничениях статических параметров. В исследовании использовалась модель BERT-базовой китайской и была предварительно обучена корпус реальных учебных журналов, учебников, записанных в классах, и документов образовательной политики Национальной платформы умного образования на учебный год 2024–2025, с объёмом словарного запаса 21128. Размер скрытого слоя модели составляет 768, с 12 головами внимания и 12 слоями. Глубина дерева GBDT была установлена на 8, количество деревьев — 200, а скорость обучения — 0,1. Учебный цикл GAN состоит из 150 патронов, а дискриминатор использует трёхслойную полностью связанную сеть размерами 512, 256 и 1. Генератор использует полностью подключённую сеть с четырьмя уровнями 1024, 512, 256 и 1. Количество скрытых единиц в LSTM составляет 128, а длина последовательности — 512. GAT имеет 2 слоя и 4 головы внимания. Температура для дистилляции знаний установлена на уровне 3.0. Коэффициенты вознаграждения вознаграждения ω1 = 0,4, ω2 = 0,35 и ω3 = 0,25. Критерии выбора веса направлены на баланс равновесия фронта Парето многоцелевой оптимизации с требованиями к интерпретации практик образовательного равенства. Эксперименты проводились с использованием 50% разделения данных с помощью перекрёстной валидации и настройки гиперпараметров. Процесс BFEN для обучения калибровке оценивания показан на рисунке 3.

figure-protocol-12
Рисунок 3: Процесс коррекции алгоритма BFEN для оценки интеллектуального образования и преподавания. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этого рисунка.

Как показано на рисунке 3, BFEN сначала предварительно обрабатывает данные многоисточниковой оценки для преподавания. BERT оптимизирует возможности FairEduNet по извлечению признаков, вычисляя текстовое семантическое сходство и глубокие веса признаков на основе семантического окна, выбирая важные признаки для построения семантической матрицы признаков с высокой размерностью. RL затем устанавливает многоцелевой функцию вознаграждения и вычисляет адаптивность сценариев и градиенты корректировки параметров для дальнейшей оптимизации порогов справедливости и параметров калибровки. FairEduNet вычисляет отклонения между данными оценки и моделями шаблонов ошибок, итеративно обновляет веса дерева принятия решений и корректирует стратегии калибровки до тех пор, пока ошибки не стабилизируются в пределах заранее установленных порогов. Итоговый результат включает модель калибровки ошибок и отчет по проверке справедливости. Калибровочная модель применяется для преподавания данных оценки, создавая таблицы сравнения до и после калибровки, которые объединяются с библиотекой стандартов интеллектуального образования для определения целевых калибровочных параметров, предоставляя научную основу для обучения калибровке оценки в интеллектуальном образовании. Эта стандартная библиотека охватывает три измерения: справедливость образовательных возможностей, справедливость процессов и справедливость результатов и включает 12 основных индикаторов. К этим показателям относятся баланс распределения образовательных ресурсов между регионами, разница в охвате цифровой инфраструктуры между городскими и сельскими школами, порог толерантности к задержке реакции на диагностику учебных ситуаций (≤200 мс), толерантность к отсутствующим данным в мультимодальном оценивании (≤3,5%), чувствительность обнаружения алгоритмических искажений (отклонение AUC для маркировки гендера/региона/стадий ≤ 0,02), порог расхождения KL для распределения баллов до и после коррекции (≤0,08), показатель интерпретируемости рекомендаций по вмешательству учителя (≥4,2/5,0), своевременность обновления профиля учеников (завершённые в течение T + 1 дня), коэффициент согласованности кроссплатформенного признания кредитов (≥0,93), точность семантического согласования образовательной политики (балл BERT ≥ 0,86) и полнота подготовки отчетов по проверке справедливости (включая атрибуцию предвзятости, доверительных интервалов и воспроизводимых снимков параметров), а также динамическую валидацию адаптации сценариев, охватывающую три типичных сценария: живой класс, асинхронные задания и ассистентов преподавателей ИИ. Расчёт семантического сходства признаков показан в уравнении (6).

figure-protocol-13(6)

В уравнении (6) fi представляет значение i-й семантической размерности признака, gi — значение i-го важного размера признака, а n — общее количество размерностей признаков. Расчёт параметра адаптации сценариев RL показан в уравнении (7).

figure-protocol-14(7)

В уравнении (7) θt представляет значение параметра на t-й итерации, α — скорость обучения, а figure-protocol-15 градиент параметров на основе функции вознаграждения R(θt).

Построение модели калибровки оценки в преподавании
Хотя BFEN демонстрирует определённые преимущества в обучении калибровке оценки, он всё ещё сталкивается с низкой эффективностью интеграции для многоисточниковых гетерогенных данных оценки и недостаточной адаптацией к динамической справедливости на практике. Алгоритм AM-LSTM, объединяющий механизм внимания (AM) и долгосрочную кратковременную память (LSTM), присваивает веса ключевым особенностям многоисточниковых данных оценки через AM и фиксирует динамические изменения данных оценки со временем с помощью последовательной памяти LSTM. Этот подход эффективно повышает эффективность интеграции данных с несколькими источниками и динамическое обучениефункциям 19,20. Процесс работы AM-LSTM показан на рисунке 4.

figure-protocol-16
Рисунок 4: Блок-схема работы AM-LSTM. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этого рисунка.

Как показано на рисунке 4, AM-LSTM сначала предварительно обрабатывает многоисточниковые данные по разнородным образовательным оцениванию для формирования стандартизированного набора данных. AM рассчитывает веса внимания для признаков из различных источников данных для выбора важных признаков и строит взвешенную матрицу признаков. Взвешенная матрица признаков затем вводится в LSTM, который использует механизм гейтинга для изучения динамических паттернов с течением времени, фиксируя взаимосвязи между оценочными данными на разных стадиях и выводя динамические векторы признаков. Наконец, эти динамические векторы признаков сочетаются с ограничениями справедливости для получения промежуточных результатов калибровки, адаптированных к многоисточникной интеграции данных и динамическим сценариям, что служит основой для последующей оптимизации модели. Расчёт веса внимания показан в уравнении (8).

figure-protocol-17(8)

В уравнении (8) n обозначает распределение внимания для n-го признака, xn — сходство, q — вектор запроса, а softmax — функцию активации. Элемент забывки LSTM выражен в уравнении (9).

figure-protocol-18(9)

В уравнении (9) Wf — это вес забытого элемента, bf — смещение забытого затвора, xt — вход в момент времени t, ht-1 — внешняя переменная состояния в момент t-1, а σ — сигмоиднуюфункцию 21. В данном исследовании AM-LSTM и BFEN объединяются для создания калибровочной модели оценки для преподавания AM-LSTM-BFEN, известной как FBFEN. В этой модели AM-LSTM решает ограничения BFEN в эффективности интеграции данных с множеством источников и динамической извлечении признаков. Он также интегрирует ограничения справедливости для оптимизации результатов промежуточной калибровки, что позволяет BFEN дополнительно достичь точной калибровки и динамического обеспечения справедливости для учебных данных оценки. Процесс работы FBFEN показан на рисунке 5.

figure-protocol-19
Рисунок 5: Процесс работы модели оценки и коррекции обучения FBFEN. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этого рисунка.

Как показано на рисунке 5, FBFEN сначала предварительно обрабатывает исходные многоисточниковые данные оценки для преподавания и вводит стандартизированный набор данных в модуль AM-LSTM. AM рассчитывает веса внимания признаков, в то время как LSTM изучает динамические паттерны, выдавая промежуточные калибровочные результаты, интегрирующие мультиисточниковую информацию и динамические особенности. Промежуточные результаты затем вводятся в модуль BFEN. GBDT итеративно изучает паттерны ошибок данных оценки на основе промежуточных результатов и заранее установленной модели ошибок, выдавая предварительные результаты калибровки. В то же время GAN анализирует смещённость справедливости, вызванную чувствительными атрибутами в предварительных результатах, с помощью противостояния между генератором и дискриминатором, динамически корректируя параметры калибровки для устранения смещения. Наконец, оптимальные для GAN параметры калибровки возвращаются в GBDT для обновления весов дерева принятия решений и стратегий калибровки, что приводит к вторичному результату калибровки, который балансирует точность и справедливость. Стандартизация данных выражена в уравнении (10).

figure-protocol-20(10)

В уравнении (10) z' представляет стандартизированное значение, z — исходное значение, а zmin и zmax — минимальные и максимальные значения. Итоговая целевая функция генератора GAN выражена в уравнении (11).

figure-protocol-21(11)

В уравнении (11) N обозначает количество итераций, λ — коэффициент потери веса, ωi — коэффициент веса i-й итературы, figure-protocol-22 — функцию потерь противника и figure-protocol-23 — бинарную потерю по перекрестной энтропии22.

Оптимизация калибровочной модели оценки в FBFEN
Хотя FBFEN демонстрирует сильную многоисточниковую интеграцию данных и динамическую справедливость в калибровке оценки обучения, он всё ещё сталкивается с слабой корреляцией признаков и низкой эффективностью обучения и выводов из-за сложной структуры модели в сложных образовательных сценариях. Алгоритм GAT-KD, объединяющий сеть внимания графа (GAT) и дистилляцию знаний (KD), динамически строит граф семантических ассоциаций между признаками с помощью механизма внимания GAT, улучшая семантическое согласование многоисточниковых данных. KD сжимает знания о сложной модели в легкую сеть, значительно повышая эффективность вывода при сохранении производительностимодели 23,24. Процесс работы GAT-KD показан на рисунке 6.

figure-protocol-24
Рисунок 6: Блок-схема работы GAT-KD. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этого рисунка.

Как показано на рисунке 6, GAT-KD строит граф семантических ассоциаций между признаками через модуль ГАТ, динамически агрегирует информацию о признаках окрестностей с помощью механизма внимания и улучшает семантическое представление локальных признаков. KD затем использует выходные мягкие метки в качестве сигналов супервизии, минимизируя потери дивергенции между выходными распределениями и потерю перекрестной энтропии между своими прогнозами и истинными метками, обеспечивая передачу знаний и сжатие модели. Итоговый результат — лёгкая калибровочная модель с высокой точностью и эффективностью. Расчет коэффициента внимания GAT показан в уравнении (12).

figure-protocol-25(12)

В уравнении (12 figure-protocol-26 ) и figure-protocol-27 представляют векторы признаков узлов i и j, W — обучаемая матрица веса, a — вектор веса внимания, figure-protocol-28 — операцию конкатенации, а LeakyReLU — функциюактивации 25. Расчёт функции потерь KD показан в уравнении (13).

figure-protocol-29(13)

В уравнении (13) KL обозначает потерю дивергенции, T2 — баланс градиентного масштабирования, p student — мягкую вероятность легкой модели, а p teacher — вероятность мягкой метки комплексноймодели 26. Объединяя ассоциацию признаков с повышенным вниманием и лёгкую передачу знаний, GAT-KD эффективно решает семантическую смещённость признаков и высокую вычислительную сложность. В данном исследовании интегрируется GAT-KD в FBFEN для формирования модели калибровки оценки обучения GAT-KD-FBFEN, известной как GFBFEN. GAT-KD оптимизирует недостатки FBFEN в неполном многоисточникном захвате корреляции признаков и низкой эффективности вывода. Процесс работы GFBFEN показан на рисунке 7.

figure-protocol-30
Рисунок 7: Процесс обучения оценки и работы модели коррекции GFBFEN. Пожалуйста, нажмите здесь, чтобы увидеть увеличенную версию этого рисунка.

Как показано на рисунке 7, GFBFEN стандартизирует данные многоисточников по оценке преподавания. GAT моделирует сложные отношения между признаками и динамически рассчитывает веса семантических ассоциаций между узлами с помощью механизмов внимания. KD сжимает знания о сложной модели в легкую сеть, значительно повышая эффективность вывода при сохранении точности. Модуль AM-LSTM присваивает значения важности многоисточниковым характеристикам и фиксирует временные динамические паттерны оценочных данных, выводя промежуточные калибровочные результаты, интегрирующие многоисточниковую информацию. Эти результаты вводятся в модуль BFEN для глубокой обработки. В частности, BERT извлекает семантические признаки из неструктурированного текста, RL динамически оптимизирует пороги справедливости и параметры калибровки, GBDT итеративно изучает шаблоны ошибок для предварительной калибровки, а GAN устраняет искажения, вызванные чувствительными атрибутами, с помощью состязательного обучения. Механизм динамической корректировки параметров автоматически калибрует чувствительность отклика и веса справедливости каждого модуля, фиксируя временные изменения и сдвиги распределения групп в обучающей сцене в реальном времени, решая тем самым проблему недостаточной адаптивности, вызванную статической конфигурацией параметров, и обеспечивая устойчивость и справедливость модели на разных этапах обучения, Студенческие группы и сценарии оценки. Тип оценки напрямую влияет на детализацию и цикл обратной связи моделирования временных рядов, тогда как формативная оценка подчёркивает динамичный характер процесса. Различия в дисциплинах определяют распределение характеристик между модулями BERT и GBDT. Таким образом, использование динамического механизма корректировки может эффективно адаптироваться к различным типам оценки и дисциплинарным характеристикам. Наконец, через несколько раундов обратной связи параметров и итеративной оптимизации модель даёт точные и справедливые результаты калибровки оценки преподавания. Функция оптимизации по ограничению по динамической справедливости выражена в уравнении (14).

figure-protocol-31(14)

В уравнении (14) S представляет набор чувствительных атрибутов, figure-protocol-32 прогнозируемый результат калибровки выхода, figure-protocol-33 дисперсию предсказаний внутри групп, γ — межгрупповые параметры и figure-protocol-34 общее ожидаемое значение. Адаптивный расчет масс слияния многоисточникных признаков показан в уравнении (15).

figure-protocol-35(15)

В уравнении (15) wk представляет вес признаков k-го источника данных, β — параметр веса, Sim — функцию измерения сходства признаков, fk — вектор признаков, извлеченный из k-го источника данных, fглобальный — глобальный центр признаков, а K представляет общее количество источников данных. В исследовании были определены веса чувствительных признаков, включая пол, этническую принадлежность, регион, экономический статус семьи и происхождение родного языка. Веса определяются на основе результатов корреляционного анализа. В исследовании использовались коэффициенты корреляции Пирсона и коэффициент корреляции ранга Спирмана как двойные индикаторы для оценки суставов, в сочетании с экспертным опытом в области образования калибровки веса. Окончательное определение весов для каждого чувствительного признака дало значения 0,18 для пола, 0,22 для этнической принадлежности, 0,25 для региона, 0,19 для семейного экономического положения и 0,16 для родного языка. Пол: гендерная идентичность по юридической регистрации и самоидентификации, бинарная (мужчина/женщина) с небинарными вариантами; поле данных «гендер». Этническая принадлежность: основана на национальной этнической идентификации 56 групп, совместимой с неидентифицированными и трансграничными группами; поле данных «этничность». Регион: Административное деление по регистрации домохозяйства или длительного проживания, охватывающее провинциальный, муниципальный и уездный уровень, с учётом двойной структуры городского и сельского района и миграционного населения; поле данных «регион». Семейный экономический статус: Согласно национальным статистическим стандартам и показателям образовательной помощи, используя пятиуровневую классификацию; поле данных «economic_status». Происхождение родного языка: основное преподавание и язык общения с семьёй во время базового образования, охватывающий мандарин, языки меньшинств, диалекты и иностранные языки, взвешенные по возрасту и частоте освоения; Поле данных «mother_tongue».

Процесс коррекции использовал трёхступенчатый механизм динамического взвешивания. Первый этап реализовал начальную идентификацию отклонений на основе матрицы веса чувствительных признаков, отмечая точки данных, существенно отклоняющиеся от глобального центра признаков по таким измерениям, как пол, этническая принадлежность и регион. Второй этап вводит ограничения образовательного контекста для повторной квалификации интенсивности отклонений с учетом контекста. Третий этап проверяет устойчивость коррекции с помощью контрфактических возмущений, систематически заменяя значения чувствительных признаков при сохранении нечувствительных признаков без изменений, и наблюдая, находится ли изменение оценочных баллов в пределах порога ±±3,2%.

Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.

Результаты

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Анализ производительности алгоритмов BFEN
Показатели, оценённые в экспериментах, включали следующее:

Точность коррекции оценки (ECA) обозначает долю элементов отклонения, правильно выявленных и исправленных моделью в результатах оценки преподавания, что отражает общую эффективность механизма коррекции. Более высокие значения указывают на лучшую точность коррекции.

Коэффициент отклонения справедливости (FDR) измер...

Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.

Обсуждение

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Алгоритм BFEN, предложенный в этом исследовании, продемонстрировал превосходную производительность в сравнительных экспериментах. С точки зрения ECA и FDR, он значительно превосходил алгоритмы PRF, EAB и DBLR. При калибровке 421 оценочных записей BFEN увеличил ECA до 98,75% и сохранил стабильность, тогда как FDR снизился до 2,87%. Эта производительность была результатом интеграции BERT-RL для оптимизации функций и динамической адаптации. BERT точно извлекал информацию о глубокой семантич...

Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.

Раскрытие информации

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Автору нечего раскрывать.

Благодарности

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Автор заявляет, что конфликта интересов нет.

Доступ ограничен. Войдите в систему или начните пробный период, чтобы просмотреть этот контент.

Материалы

Список материалов, использованных в этой статье
ИмяКомпанияКаталожный номерКомментарии
Набор данных отчет о мониторинге глобального образованияUNESCOhttps://www.education-progress.org/Набор данных
NumPyNumPyhttps://numpy.org/Предварительная обработка данных
PandasPandas, NumPyhttps://pandas.pydata.org/Предварительная обработка данных
PyCharm Professional 2023.1PyCharm Версия 2023.1Разработчик окружения
Python 3.9Python Версия 3.9‌Язык программирования
Scikit-learnScikit-learnhttps://scikit-learn.org/stable/index.htmlМашинное обучение
SeabornSeabornhttps://seaborn.pydata.org/Визуализация
Набор данных академической успеваемости учеников средней школы ИспанииРепозиторий машинного обучения UC Irvinehttps://archive.ics.uci.edu/dataset/320/student+performanceНабор данных
TensorFlowTensorFlowhttps://www.tensorflow.org/Глубокое обучение
Windows 11MicrosoftВерсия 11Операционная система

Перепечатки и разрешения

Запросить разрешение на повторное использование текста или иллюстраций этой статьи JoVE

Запросить разрешение

Теги

233233

Похожие статьи