$$\rightleftharpoonup{xx}$$
$$\longleftharp{xx}$$,
$$\longrightharp{xx}$$,
Afin de tester la validité des opérateurs neuronaux informés par la physique, des tests de performance supplémentaires ont été réalisés afin de comparer les performances du FNO et du modèle d'opérateur neuronal dans la modélisation de la dynamique d'un système d'écoulement multiphasique non linéaire. Les résultats ont montré que le FNO offre une meilleure cohérence spatiale globale, tandis que le modèle d'opérateur neuronal présente une meilleure adaptabilité aux entrées hétérogènes.
Afin de garantir un entraînement et une évaluation efficaces du cadre de jumeau numérique proposé, toutes les expériences ont été réalisées dans un environnement de calcul haute performance. Python a été utilisé comme langage de programmation principal pour l'implémentation. Un cadre d'apprentissage profond populaire avec accélération GPU activée par CUDA et une bibliothèque optimisée de réseaux neuronaux profonds a été utilisé pour créer des modèles d'apprentissage profond, tels que des opérateurs neuronaux informés par la physique, des réseaux neuronaux graphiques spatiotemporels et des modules d'apprentissage par renforcement. Afin de faciliter le traitement de données chronologiques multivariées à grande échelle et l'entraînement des modèles, les tests ont été effectués sur une station de travail équipée d'un processeur multi-cœurs, d'une unité de traitement graphique (GPU) haute performance dotée de mémoire dédiée et d'au moins 64 Go de mémoire système. Pour assurer la compatibilité avec l'écosystème d'apprentissage profond, l'environnement système d'exploitation a été construit sur une distribution Linux.
Une optimisation basée sur le gradient par mini-lots a été utilisée pour entraîner les modèles, et de nombreux essais indépendants des expériences ont été réalisés afin de garantir la fiabilité statistique. La méthodologie proposée peut être reproduite dans des environnements comparables de calcul haute performance grâce à la configuration informatique fournie.
Afin de valider les résultats par des essais répétés, toutes les expériences ont été reproduites selon plusieurs exécutions indépendantes avec différentes valeurs d'initialisation aléatoires. Dans le cas des expériences utilisant des données simulées, le modèle a été exécuté pour (N) essais indépendants, et les valeurs sont indiquées avec la performance moyenne et l'écart type. Dans le cas des expériences utilisant les jeux de données de référence SWAT et WADI, les métriques d'évaluation MAE, RMSE, F1 Score et AUROC ont été calculées sur les données de test et moyennées sur les expériences répétées afin de rendre les résultats statistiquement robustes. Ceci a été fait pour obtenir une estimation fiable de la performance du modèle et s'assurer que les améliorations observées ne sont pas dues à une seule expérience.
Néanmoins, les résultats ont confirmé que la combinaison de l'apprentissage informé par la physique, de la modélisation spatiotemporelle et des techniques d'assimilation de données au sein d'un système intégré de jumeau numérique conduit systématiquement à une amélioration des performances de surveillance dans les conditions évaluées, à une convergence plus rapide et à des décisions optimales en temps réel par rapport aux méthodes conventionnelles. Tableau 4 présente l'environnement de simulation du travail proposé.
L'environnement de simulation est modélisé pour représenter fidèlement le fonctionnement en temps réel dans l'industrie. Les données provenant des capteurs sont collectées à des intervalles courts afin de refléter un environnement de flux de données, et des quantités contrôlées de bruit sont ajoutées pour tester la robustesse. Divers cas de défauts et de perturbations sont simulés afin d'évaluer la détection d'anomalies et les capacités de contrôle. Une approche par fenêtre glissante est utilisée pour l'évaluation, afin de représenter de manière continue le fonctionnement en temps réel, convenant aux mises à jour dynamiques par le jumeau numérique proposé pour les prévisions et les synchronisations d'état, ainsi que pour la production d'actions de contrôle.
Dans la conception du modèle de jumeau numérique tenant compte de la commande, plusieurs critères d'évaluation doivent être pris en compte pour une évaluation simultanée. Premièrement, concernant la capacité de surveillance et de prédiction d'état de l'architecture du jumeau numérique, des critères de régression tels que l'Erreur Absolue Moyenne (MAE), l'Erreur Quadratique Moyenne (RMSE) et l'Erreur Moyenne en Pourcentage Absolu (MAPE) sont utilisés. La MAE et la MAPE calculent la précision des opérateurs neuronaux et des modèles de graphes spatio-temporels sur des paramètres clés du système tels que la pression, le débit et la température, et sont valables pour les données multivariées continues provenant des capteurs utilisés dans le processus de production pétrolière et gazière.
Deuxièmement, le processus de synchronisation du jumeau numérique lui-même, en ce qui concerne l'erreur d'estimation d'état et l'élimination de la dérive de prédiction, est également évalué. L'erreur d'estimation d'état mesure le degré d'erreur entre l'état réel du système et l'état du jumeau numérique synchronisé, ce qui constitue un indicateur de l'efficacité avec laquelle le module neuronal 4D-Var développé utilise les observations de l'état réel du système pour améliorer les prévisions de la dynamique du système. Enfin, la réduction de la dérive de prédiction indique le gain de performance de l'approche proposée par rapport au système de jumeau numérique non synchronisé, grâce à la capacité de cette approche à résister à des observations bruitées ou peu nombreuses du système.
Troisièmement, en ce qui concerne la détection des anomalies et le diagnostic des pannes, des paramètres d'évaluation orientés classification tels que la précision, le rappel, le score F1 et la surface sous la courbe ROC (AUC) sont utilisés. Alors que le rappel fait référence à la capacité de diagnostiquer avec précision les erreurs réelles sans en omettre aucune, la précision peut être considérée comme une mesure de la validité d'une anomalie reconnue. La performance peut être correctement évaluée à l'aide du score F1. Ces paramètres d'évaluation sont généralement adoptés dans les systèmes SWAT et WADI.
Tableau 5 sert à évaluer l'efficacité du module de synchronisation neuronal 4D-Var proposé pour réduire la dérive de prédiction entre les modèles physique et cybernétique pour trois ensembles de données. L'erreur d'état initial correspond à l'erreur entre les modèles sans synchronisation, et l'erreur d'état final correspond à l'erreur du modèle après application de la synchronisation. On observe une amélioration significative de l'erreur d'état pour les trois ensembles de données, la plus forte amélioration (72,2 %) étant obtenue pour le modèle simulé de système pétrolier et gazier en raison de sa simplicité relative par rapport à SWAT (63,6 %) et WADI (57,7 %). Ces résultats sont cohérents avec leurs niveaux respectifs de complexité et de « bruit ». Le taux accru de réduction de la dérive pour l'ensemble de données simulé pétrolier et gazier peut s'expliquer par le fait que l'environnement simulé implique généralement un niveau de bruit réduit, moins de perturbations aléatoires et un comportement du système bien défini, comparé à d'autres systèmes cyber-physiques réalistes comme SWAT et WADI. Toutefois, ce raisonnement doit être considéré comme une hypothèse et ne saurait être prouvé quantitativement à partir des résultats de cette étude. Dans des travaux futurs, des mesures de complexité telles que l'entropie, la variance du bruit et la dimensionnalité du système pourraient être utilisées pour valider cet argument.

Figure 4 : Surveillance des performances sur différents ensembles de données (pétrole et gaz simulés, SWAT et WADI) évaluée à l’aide des métriques d’erreur MAE, RMSE et MAPE (%). Les barres représentent les valeurs moyennes obtenues à partir de plusieurs exécutions indépendantes (n = 5). Les barres d’erreur indiquent l’écart type (SD), tandis que les barres d’erreur superposées plus fines représentent l’erreur type de la moyenne (SEM = SD/√n). Les valeurs de SD et de SEM pour chaque métrique sont explicitement indiquées dans la légende. La signification statistique est évaluée à l’aide de tests t indépendants par rapport à l’ensemble de données de référence (pétrole et gaz simulés), et les valeurs p correspondantes sont affichées au-dessus des barres. Veuillez cliquer ici pour visualiser une version agrandie de cette figure.
L'analyse des performances du processus de surveillance effectué par le modèle de jumeau numérique proposé sur des ensembles de données tels que Simulated Oil and Gas, SWAT et WADI, en tenant compte des critères d'évaluation MAE, RMSE et MAPE, est présentée dans la Figure 4. L'ensemble de données Simulated Oil and Gas présente la mesure d'erreur la plus faible pour tous les critères, ce qui manifeste clairement la précision de la surveillance de l'état du système dans un environnement simulé où les paramètres du système sont modélisés avec exactitude. Les ensembles de données SWAT et WADI montrent des erreurs de surveillance du système qui augmentent progressivement en raison de la complexité des systèmes réels, ainsi que de leur bruit intrinsèque et de leurs non-linéarités, éléments absents dans les systèmes simulés. Toutefois, la légère augmentation des mesures d'erreur MAE et RMSE confirme la stabilité des performances du système du modèle de jumeau numérique dans de telles conditions.

Figure 5 : Performances de détection d'anomalies sur différents ensembles de données (pétrole et gaz simulés, SWAT et WADI) évaluées à l'aide du score F1 et de l'AUC. Les barres représentent les valeurs moyennes obtenues à partir de plusieurs exécutions indépendantes (n = 5). Les barres d'erreur indiquent l'ET, tandis que les barres d'erreur superposées plus fines représentent l'EMA = ET/√n. Veuillez cliquer ici pour visualiser une version agrandie de cette figure.
Figure 5 présente l'analyse d'évaluation du système proposé pour la détection d'anomalies, basée sur le score F1 et l'AUC pour les trois jeux de données. Le jeu de données Oil and Gas, qui est un jeu de données simulé, obtient les meilleurs résultats enregistrant le score F1 et l'AUC les plus élevés. Bien qu'une légère baisse progressive des performances soit observée, le système atteint une performance élevée en termes d'AUC sur l'ensemble des jeux de données, avec de légères variations selon la complexité de chaque jeu. L'alignement des courbes du score F1 et de l'AUC pour les trois jeux de données révèle un point optimal, indiquant un bon compromis, ce qui fait du système proposé une solution fiable pour la détection précoce des défaillances et des intrusions. Le système proposé se distingue par une reconnaissance remarquable des anomalies sur les trois jeux de données.
La précision, le rappel et les scores F1 du modèle de jumeau numérique proposé pour la détection d'anomalies sur différents ensembles de données sont présentés dans le Tableau 6 ci-dessous. Bien que des valeurs élevées de précision indiquent que la plupart des points d'intérêt identifiés sont effectivement des vrais points d'intérêt, des valeurs élevées de rappel montrent que la majorité des points d'intérêt réels sont correctement identifiés, sans omission des éléments importants. L'environnement de démonstration dans le domaine pétrolier et gazier enregistre le score F1 le plus élevé, de 0,94, tandis que des résultats légèrement inférieurs sur SWAT et WADI peuvent être attribués à des niveaux plus élevés de bruit et à des interdépendances accrues entre les capteurs et les schémas d'attaque. Toutefois, les scores F1 élevés confirment qu'une modélisation robuste des graphes spatio-temporels et une synchronisation efficace pour la détection d'anomalies ont été atteintes.

Figure 6 : Courbes caractéristiques de fonctionnement du récepteur (ROC) pour la détection d'anomalies sur les jeux de données simulés Oil and Gas, SWAT et WADI. Les performances sont évaluées à l'aide de la surface sous la courbe (AUC). L'écart-type (SD) et l'erreur-type de la moyenne (SEM = SD/√n, n = 5) des valeurs d'AUC sont indiqués dans la légende pour chaque jeu de données. La ligne pointillée diagonale représente une performance de classification aléatoire. Veuillez cliquer ici pour afficher une version agrandie de cette figure.
Figure 6 présente les courbes caractéristiques de fonctionnement du récepteur (ROC), ainsi que les mesures associées d'aire sous la courbe ROC (AUROC) pour les trois jeux de données différents, évaluant la précision de la détection d'anomalies indépendamment du choix du seuil. Dans la courbe ROC du jeu de données simulé du secteur pétrolier et gazier, la région s'approche remarquablement de l'origine, ce qui établit une valeur AUROC de 0,99, confirmant ainsi une capacité de classification quasiment parfaite. Pour les jeux de données SWAT et WADI, les valeurs AUROC s'élèvent respectivement à 0,97 et 0,95, démontrant une bonne capacité de classification malgré la présence d'incertitudes plus élevées. Le fait que les courbes ROC soient nettement éloignées des droites représentant une classification aléatoire garantit que le modèle de jumeau numérique développé fonctionne nettement mieux que le niveau du hasard pour une détection précise des anomalies. Les courbes caractéristiques de fonctionnement du récepteur (ROC) de la Figure 6 illustrent les performances du modèle de jumeau numérique proposé en matière de détection d'anomalies sur les trois jeux de données. Les scores AUROC sont de 0,99 pour le jeu de données simulé pétrolier et gazier, de 0,97 pour le jeu de données SWAT et de 0,95 pour le jeu de données WADI, indiquant la capacité discriminante du modèle dans des systèmes de contrôle industriels à la fois simulés et de référence.
Tableau 7 présente une description concise des récompenses cumulées et des violations des contraintes pour le module d'apprentissage par renforcement utilisé dans la commande en boucle fermée intégrée au jumeau numérique. La récompense cumulée obtenue reflète la performance globale de la commande fondée sur les objectifs opérationnels, tandis que les violations des contraintes représentent le nombre total de violations survenues pendant le fonctionnement. Les récompenses cumulées accompagnées d'aucune violation de contrainte atteignent leur valeur maximale (96,5) dans l'environnement de notre modèle pétrolier et gazier, attestant ainsi d'une commande et d'une performance opérationnelle optimales.
Même si les ensembles de données SWaT et WADI présentent des récompenses cumulées légèrement inférieures et certaines violations de contraintes, l'amélioration globale des économies de coûts opérationnels démontre que le cadre de jumeau numérique proposé reste efficace pour un contrôle sûr et optimal dans des environnements dynamiques.
La faisabilité en temps réel du système de contrôle proposé, piloté par un apprentissage par renforcement (RL), a été évaluée en analysant la latence d'inférence de bout en bout de tous les modules informatiques utilisés dans le système proposé. Les observations expérimentales du Tableau 8 montrent que le module d'opérateur neuronal, le modèle d'opérateur neuronal (FNO), ainsi que le module de réseau neuronal graphique spatio-temporel (ST-GNN) présentent des surcharges computationnelles modérées dues aux caractéristiques temporelles utilisées durant le processus. En revanche, le module de prise de décision par politique d'apprentissage par renforcement présente une surcharge computationnelle très faible. Le temps cumulé d'inférence de bout en bout de l'ensemble des modules utilisés dans le système proposé se situe dans la plage des cycles de contrôle industriels typiques. Plus précisément, la latence moyenne d'inférence de bout en bout observée est comprise entre 50 et 150 millisecondes par cycle de contrôle, ce qui est compatible avec les exigences standard des systèmes de contrôle industriels. Cela démontre que le système proposé peut être utilisé pour des applications en temps réel et quasi temps réel. Toutefois, noter que le temps d'inférence de bout en bout peut varier selon le matériel utilisé. À cet égard, le système proposé convient aux applications en temps réel.
Une comparaison quantitative des approches FNO, modèle d'opérateur neuronal et méthodes de référence, telles que les solveurs numériques traditionnels et les techniques actuelles d'apprentissage d'opérateurs, est réalisée afin de confirmer davantage l'efficacité des opérateurs neuronaux informés par la physique. L'évaluation présentée dans le Tableau 9 porte sur la capacité de chaque modèle à reproduire la dynamique du système et ses dynamiques non linéaires. Des métriques standard telles que l'erreur quadratique moyenne (MSE), l'erreur absolue moyenne (MAE) et l'erreur relative entre les états du système prédits et les états réels de référence sont utilisées pour évaluer les performances. Selon les résultats expérimentaux, le FNO et le modèle d'opérateur neuronal surpassent tous deux les approches de référence dans la modélisation des dynamiques complexes multiphasiques en obtenant des valeurs d'erreur réduites. Plus précisément, le modèle d'opérateur neuronal parvient à capturer avec succès les applications opératorielle non linéaires sous différentes conditions d'entrée, tandis que le FNO excelle dans l'apprentissage des dépendances spatiales globales.
L'efficacité des modèles d'opérateurs neuronaux proposés est illustrée par les résultats comparatifs quantitatifs présentés dans le Tableau 9. Par rapport aux solveurs numériques de référence et aux techniques actuelles d'apprentissage d'opérateurs, les deux modèles, FNO et l'opérateur neuronal, atteignent des métriques d'erreur nettement plus faibles. En particulier, FNO présente l'erreur relative et l'erreur quadratique moyenne les plus faibles, démontrant ainsi sa capacité supérieure à capturer la dynamique de systèmes non linéaires complexes. De plus, le modèle d'opérateur neuronal montre des gains significatifs, notamment en ce qui concerne l'apprentissage de mappages d'opérateurs non linéaires dans différentes conditions. Des tests t indépendants sont utilisés pour évaluer la signification statistique ; des valeurs de p inférieures à 0,05 indiquent une amélioration substantielle par rapport au solveur numérique de référence. Les valeurs de p obtenues par les deux modèles proposés sont inférieures à 0,001, ce qui signifie que les améliorations observées en termes de performance sont statistiquement significatives et ne sont pas dues au hasard. En outre, les techniques proposées présentent des temps d'inférence nettement plus courts, démontrant ainsi leur pertinence pour des applications de jumeau numérique en temps réel.
Afin d'améliorer davantage la clarté de l'évaluation expérimentale du modèle de jumeau numérique sensible au contrôle proposé, une comparaison quantitative complète de l'approche proposée avec d'autres méthodes est fournie sous un format tabulaire intégré. Cette comparaison de divers paramètres de performance, tels que l'erreur absolue moyenne (MAE), l'erreur quadratique moyenne (RMSE), le score F1, l'aire sous la courbe (AUC), la réduction de la dérive de prédiction et la récompense cumulée, permettra une évaluation intégrée de la précision du suivi, de la capacité de détection des anomalies, de l'efficacité de la synchronisation et de la performance de contrôle des méthodes dans Table 10. De plus, divers paramètres de la procédure d'apprentissage, tels que la taille du lot, le taux d'apprentissage, le nombre d'époques et la configuration d'apprentissage par module, sont explicitement indiqués afin d'améliorer la transparence de l'évaluation expérimentale dans Table 11. En outre, la scalabilité et l'efficacité computationnelle en termes de latence d'inférence, d'utilisation du GPU et de faisabilité en temps réel de l'approche proposée sont également évaluées dans Table 12.
Le jumeau numérique proposé peut être comparé de manière exhaustive à d'autres méthodes telles que la méthode de synchronisation basée sur la physique, les modèles LSTM et GNN en termes de précision de surveillance, de capacité de synchronisation, de détection d'anomalies et de performance de contrôle, comme illustré dans le tableau 13. Les jumeaux numériques physiques sont moins adaptatifs et présentent une marge d'erreur plus élevée en raison d'approches statiques. Les approches neuronales, telles que LSTM et GNN, sont meilleures mais ne parviennent pas à combiner efficacement physique, synchronisation et contrôle. Le jumeau numérique proposé a atteint les meilleures valeurs avec un RMSE de 0,20, une réduction de la dérive de 72,2 %, un AUROC de 0,94, un score-F1 de 0,92 et une récompense cumulative de 95,5. Ces résultats indiquent clairement que la combinaison efficace d'opérateurs neuronaux intégrant les lois physiques, de modélisation graphique pour l'espace et le temps, d'assimilation neuronale de données et d'apprentissage par renforcement peut améliorer significativement un système de jumeau numérique précis, robuste et tenant compte du contrôle.

Figure 7 : Coût d'entraînement et utilisation des ressources pour différents composants du système proposé, incluant le FNO, le modèle d'opérateur neuronal, le GNN, le module d'apprentissage par renforcement (RL) et l'ensemble du cadre. Les métriques comprennent le temps d'entraînement (heures) et l'utilisation de la mémoire GPU (Go). Les valeurs représentent les résultats moyens obtenus lors de plusieurs exécutions indépendantes (n = 5). Les barres d'erreur indiquent l'ET, tandis que les barres d'erreur superposées plus fines représentent l'EMA = ET/√n, reflétant la variabilité entre les exécutions. Veuillez cliquer ici pour visualiser une version agrandie de cette figure.
La Figure 7 présente les coûts d'apprentissage et l'utilisation des ressources de l'approche proposée en fonction de leurs composantes principales. On observe que les modèles d'opérateurs neuronaux, tels que FNO et le modèle d'opérateur neuronal, entraînent des coûts d'apprentissage et une utilisation de la mémoire GPU importantes par rapport au système dans son ensemble. Ce coût élevé d'apprentissage est dû à la capacité d'apprentissage en haute dimension des opérateurs. Les modules de réseau neuronal graphique et d'apprentissage par renforcement présentent un coût d'apprentissage plus faible, mais ils sont essentiels pour l'apprentissage des dépendances spatiales et du contrôle adaptatif. Bien que le système proposé entraîne des coûts d'apprentissage plus élevés, le temps d'inférence s'avère efficace. Par rapport aux méthodes de référence telles que les modèles LSTM ou GNN autonomes, le système proposé implique un coût d'apprentissage plus élevé en raison de l'intégration multi-module, mais atteint une précision et une robustesse améliorées, comme le montre la Table 13.
Dans l'ensemble, la structure de jumeau numérique proposée combine plusieurs éléments, dont chacun aborde un problème distinct dans la modélisation et la commande de systèmes industriels complexes. Contrairement aux solveurs numériques traditionnels, souvent coûteux en calcul et moins adaptés aux applications en temps réel, des opérateurs neuronaux intégrant les lois physiques, tels que l'opérateur neuronal de Fourier et le réseau profond d'opérateurs (Deep Operator Network), sont utilisés pour capturer plus efficacement les dynamiques de systèmes non linéaires et de grande dimension. Des modèles d'apprentissage automatique plus simples, comme les réseaux neuronaux feedforward ou récurrents, peuvent être employés, mais ils n'apprennent généralement pas les opérateurs physiques fondamentaux et ne parviennent pas à généraliser à différentes configurations du système. Les dépendances entre capteurs distribués, intrinsèquement liées dans les systèmes de production pétrolière et gazière, sont modélisées à l'aide d'un réseau neuronal graphique spatio-temporel. Les méthodes classiques, telles que des modèles de séries chronologiques indépendants ou des architectures récurrentes simples, peuvent entraîner une précision moindre dans l'estimation d'état et la détection d'anomalies, car elles ne prennent pas explicitement en compte les relations spatiales. La commande adaptative, qui exploite le module d'apprentissage par renforcement, permet au système d'optimiser les décisions opérationnelles dans des environnements dynamiques et incertains. Les stratégies de commande basées sur des règles ou statiques, en revanche, sont rigides et incapables de s'ajuster à des conditions changeantes du système ou à des perturbations imprévues. Bien qu'il existe des alternatives moins complexes, celles-ci traitent généralement uniquement certaines parties du problème et ne suffisent pas à offrir une solution intégrée combinant modélisation précise, surveillance en temps réel et commande adaptative. En garantissant que chaque composant contribue à la performance globale du système, la conception modulaire proposée améliore la précision, la scalabilité et la robustesse dans des environnements industriels exigeants.
| Étude / Travail | Techniques utilisées | Résultats | Limites |
| Opérateur neuronal profond pour jumeau numérique26 | Opérateur neuronal DeepONet comme modèle de substitution | Prédiction en temps réel ; des ordres de grandeur plus rapide que les simulateurs physiques | Nécessite un positionnement précis des capteurs ; les méthodes d'évaluation doivent être améliorées |
| Jumeau numérique activé par la détection virtuelle avec DeepONet27 | Capteurs virtuels DeepONet dans le jumeau numérique | Prédictions rapides ; inférence en temps réel ; estimation complète de l'état | Le biais spectral affecte les phénomènes à haute fréquence ; une modélisation hybride est nécessaire |
| Jumeau numérique avec DRL + CMNP en commande28 | Apprentissage par renforcement profond & Intégration de la commande prédictive non linéaire | Meilleure performance de contrôle ; erreur de suivi réduite et mises à jour adaptatives des jumeaux | Application limitée aux vaisseaux ; une extension aux systèmes de production est nécessaire |
| Jumeau numérique piloté par l'intelligence artificielle dans l'automatisation industrielle29 | Apprentissage supervisé / non supervisé (LSTM, CNN, RF, etc.) | Grande précision dans la prédiction des défauts & surveillance | Principalement apprentissage machine classique ; absence de modèles profonds avancés spatio-temporels |
| Huile & Revue du jumeau numérique gazeux16 | Divers IA/ML & modélisation mécanistique | Taxonomie complète des stratégies de modélisation | Principalement conceptuel ; implémentations pratiques limitées avec un apprentissage profond avancé |
Tableau 1 : Analyse comparative de la production et de la gestion du contrôle du pétrole et du gaz avec les méthodes existantes. Un aperçu des stratégies pertinentes de jumeau numérique et de contrôle, mettant l'accent sur les méthodes utilisées, les résultats obtenus et les inconvénients majeurs.
| Nom du jeu de données | Domaine / Système | Nombre de caractéristiques | Durée & Taille | Caractéristiques des données |
| Huile simulée & Données de production de gaz | Huile & Système de production de gaz (simulation) | Multivariée (pression, débit, température, etc.) | Conçu pour cette recherche | Capteur simulé en temps réel & signaux de contrôle, normaux & états de défaut |
| SWaT | Traitement sécurisé de l'eau CPS | ~51 capteurs + actionneurs | ~11 jours (~450k+ échantillons) | Normal & ; anomalie (36 scénarios d'attaque) |
| WADI | Système cyber-physique de distribution d'eau | ~123 capteurs + actionneurs | ~16 jours (~1M+ échantillons) | Normal & anomalie (15 crises) |
Tableau 2 : Description du jeu de données.
Description du jeu de données. Résumé des jeux de données de l'étude, incluant le domaine, le nombre de caractéristiques, la durée et les attributs des données.
| Composant | Hyperparamètre | Valeur |
| ST-GNN | Nombre de couches | 3 |
| ST-GNN | Dimension cachée | 64 |
| ST-GNN | Longueur de la fenêtre temporelle | 12 |
| Opérateur neuronal (FNO) | Nombre de modes de Fourier | 16 |
| Opérateur neuronal (FNO) | Nombre de couches | 4 |
| DeepONet | Taille du réseau de la branche | [128, 128] |
| DeepONet | Taille du réseau du tronc | [128, 128] |
| Assimilation de données | Fenêtre d'assimilation | 10 pas de temps |
| Optimiseur | Adam | |
| Taux d'apprentissage | 0,001 | |
| Taille du lot | 64 | |
| Contrôleur RL | Facteur d'actualisation (γ) | 0,99 |
| Contrôleur RL | Couches du réseau de politique | [128, 64] |
Tableau 3 : Architecture du modèle et hyperparamètres. Configurations architecturales importantes et réglages des hyperparamètres pour les opérateurs neuronaux, l'assimilation de données, l'apprentissage par renforcement et les composants de réseau neuronal graphique spatiotemporel.
| Paramètre | Description |
| Plateforme de simulation | Python (v3.10) avec PyTorch (v2.1) |
| Bibliothèques complémentaires | NumPy (v1.24), SciPy (v1.10), Pandas (v1.5) |
| Matériel | GPU de la série NVIDIA RTX (par exemple, RTX 3090, 24 Go de mémoire VRAM), processeur Intel Core i7/i9, 32 à 128 Go de RAM |
| Accélération GPU | CUDA Toolkit (v11.8), cuDNN (v8.x) |
| Système d'exploitation | Linux (Ubuntu 20.04) / Windows 10 |
| Environnement de développement | Jupyter Notebook / VS Code |
| Intervalle d'échantillonnage | 1 à 10 secondes (configurable pour la simulation en temps réel) |
| Modélisation du bruit des capteurs | Bruit gaussien (σ = 0,01 à 0,05) |
| Scénarios de défaillance | Défauts de capteurs, perturbations d'écoulement et anomalies de commande |
| Mode d'évaluation | Simulation en temps réel basée sur une fenêtre glissante |
| Disponibilité du code | Le lien vers le dépôt sera fourni sur demande / publication pour assurer la reproductibilité |
Tableau 4 : Environnement de simulation. Informations concernant la configuration matérielle, la plateforme logicielle, l'intervalle d'échantillonnage, la modélisation du bruit et les scénarios de défaillance dans le dispositif expérimental.
| Jeu de données | Erreur de l'état initial | Erreur de l'état final | Réduction de la dérive (%) |
| Simulation Pétrole & Gaz | 0,9 | 0,25 | 72,2 |
| SWAT | 1,1 | 0,4 | 63,6 |
| WADI | 1,3 | 0,55 | 57,7 |
Tableau 5 : Résultat expérimental de la synchronisation du jumeau numérique. Évaluation quantitative de la performance de synchronisation montrant la réduction de la dérive de prédiction à travers les jeux de données, ainsi que les erreurs d'estimation des états initial et final.
| Jeu de données | Précision | Rappel | Score F1 |
| Simulation Pétrole & Gaz | 0,95 | 0,93 | 0,94 ± 0,01 |
| SWAT | 0,9 | 0,88 | 0,92 ± 0,02 |
| WADI | 0,87 | 0,85 | 0,90 ± 0,02 |
Tableau 6 : Performance de la détection d'anomalies. Résultats de la détection d'anomalies sur les jeux de données simulés d'huile et de gaz, SWAT et WADI, incluant la précision, le rappel et le score F1.
| Jeu de données | Récompense cumulative ↑ | Violations des contraintes ↓ | Réduction des coûts (%) ↑ |
| Simulation Pétrole & Gaz | 96,5 ± 0,8 | 0 | 18,7 |
| SWAT | 92,1 ± 1,2 | 1 | 14,3 |
| WADI | 89,7 ± 1,5 | 2 | 11,6 |
Tableau 7 : Résultats expérimentaux du contrôle en boucle fermée et de l'optimisation. La récompense cumulative, les violations des contraintes et la réduction des coûts opérationnels sont utilisées pour évaluer les performances du contrôle en boucle fermée.
| Module | Latence moyenne (ms) | Description |
| Neural Operator (FNO/DeepONet) | 18-25 ms | Apprentissage des opérateurs et prédiction de l'état du système |
| ST-GNN | 22–35 ms | Modélisation des dépendances spatio-temporelles |
| RL Policy Network | 5–10 ms | Génération des décisions de contrôle |
| Prétraitement des données | 8–12 ms | Normalisation des entrées et préparation des caractéristiques |
| Latence totale de la boucle de contrôle | 55–82 ms | Durée d'exécution de l'action de contrôle de bout en bout |
Tableau 8 : Évaluation des performances de contrôle en temps réel. Les valeurs de latence représentent les temps d'inférence moyens mesurés par étape de contrôle dans une configuration matérielle standard.
| Modèle | MSE ↓ | MAE ↓ | Erreur relative (%) ↓ | Temps d'inférence (ms) ↓ | Valeur p (par rapport au modèle de référence) |
| Solveur numérique (modèle de référence) | 0.0125 ± 0.0012 | 0.089 ± 0.006 | 8.75 ± 0.54 | 120.5 ± 5.2 | — |
| Modèle d'apprentissage automatique classique | 0.0098 ± 0.0009 | 0.072 ± 0.005 | 6.42 ± 0.48 | 85.3 ± 4.7 | 0.021 |
| Apprentissage d'opérateur existant | 0.0076 ± 0.0007 | 0.061 ± 0.004 | 5.18 ± 0.41 | 42.8 ± 3.1 | 0.008 |
| DeepONet (proposé) | 0.0052 ± 0.0005 | 0.044 ± 0.003 | 3.67 ± 0.32 | 18.6 ± 2.4 | < 0.001 |
| FNO (proposé) | 0.0047 ± 0.0004 | 0.039 ± 0.002 | 3.21 ± 0.28 | 15.2 ± 2.1 | < 0.001 |
Tableau 9 : Comparaison des modèles de base et du modèle proposé en termes de précision de prédiction (MSE, MAE, erreur relative) et d'efficacité computationnelle (temps d'inférence). Les valeurs sont indiquées sous la forme moyenne ± écart-type sur plusieurs exécutions. Des valeurs plus faibles indiquent une meilleure performance. Les valeurs p indiquent la signification statistique par rapport au solveur numérique de référence.
| Méthode | MAE ↓ | RMSE ↓ | F1-Score ↑ | AUC ↑ | Réduction de la dérive (%) ↑ | Récompense cumulative ↑ |
| DT basé sur la physique | 0.45 | 0.62 | 0.78 | 0.82 | 35.4 | 65.2 |
| LSTM | 0.32 | 0.48 | 0.85 | 0.88 | 48.7 | 74.5 |
| GNN | 0.28 | 0.41 | 0.88 | 0.91 | 55.3 | 81.3 |
| Cadre proposé | 0.2 | 0.3 | 0.94 | 0.97 | 72.2 | 95.5 |
Tableau 10 : Comparaison complète des performances. Comparaison complète des performances du modèle de jumeau numérique intégrant la commande proposé avec d'autres approches de référence pour la surveillance, la détection d'anomalies, la synchronisation et la commande. En ce qui concerne la précision de prédiction, des valeurs plus faibles de MAE et de RMSE sont préférables. Pour la détection d'anomalies et la performance de synchronisation, des valeurs plus élevées du score F1, de l'AUC, de la réduction de la dérive et de la récompense sont préférables.
| Composant | Paramètre | Valeur/Réglage |
| Opérateurs neuronaux (FNO/DeepONet) | Époques | 100–200 |
| Taille du lot | 32–64 |
| Taux d'apprentissage | 0,001 |
| ST-GNN | Couches | 3 |
| Unités cachées | 64 |
| Fenêtre temporelle | 10–20 pas de temps |
| Neural 4D-Var | Fenêtre d'assimilation | Fixe (fenêtre glissante) |
| Optimisation | Descente de gradient |
| Apprentissage par renforcement | Facteur d'actualisation (γ) | 0,95 |
| Poids de la récompense (α,β,γ) | 0,6, 0,25, 0,15 |
| Entraînement général | Optimiseur | Adam |
| Matériel | NVIDIA RTX GPU |
Tableau 11 : Configuration et paramètres de mise en œuvre utilisés pour les différents composants du cadre de jumeau numérique proposé. Le tableau fournit un aperçu des différents hyperparamètres et paramètres d'apprentissage utilisés afin d'assurer la reproductibilité du système proposé pour les différents composants.
| Composant | Durée d'entraînement (heures) | Latence d'inférence (ms) | Utilisation du GPU (%) | Évolutivité |
| Neural Operators | 6–8 | 25–40 | 80–90 | Élevée |
| ST-GNN | 3–4 | 15–25 | 60–70 | Élevée |
| Neural 4D-Var | 2–3 | 20–30 | 65–75 | Modérée |
| Contrôleur RL | 1–2 | 10–20 | 50–60 | Élevée |
| Système global | 12–16 | <100 ms | 70–85 | Évolutif |
Tableau 12 : Analyse des performances computationnelles et de la scalabilité du modèle de jumeau numérique proposé pour différents composants. La latence est utilisée pour représenter les performances d'inférence en temps réel, le GPU pour représenter les performances computationnelles, et la scalabilité indique la capacité du modèle proposé à être utilisé dans des applications à l'échelle industrielle.
| Méthode | RMSE de surveillance | Réduction de la dérive de synchronisation (%) | AUROC | Score-F1 | Récompense cumulative |
| Jumeau numérique basé sur la physique | 0.45 | 28,6 | 0,78 | 0,74 | 42,3 |
| Modèle basé sur LSTM | 0,31 | 41,2 | 0,86 | 0,83 | 61,7 |
| Modèle basé sur GNN | 0,26 | 53,4 | 0,91 | 0,88 | 74,5 |
| Jumeau numérique proposé | 0,2 | 72,2 | 0,94 | 0,92 | 95,5 |
Tableau 13 : Évaluation comparative des travaux proposés avec les méthodes existantes. Les performances du modèle de jumeau numérique suggéré, en termes de surveillance, de synchronisation, de détection d'anomalies et de métriques de contrôle, sont comparées aux approches de référence et aux approches fondées sur l'apprentissage.
| Configuration du modèle | Erreur de surveillance (RMSE) | Détection d'anomalies (F1) | Performance de contrôle (Récompense) |
| Modèle complet (tous les modules) | 0.2 | 0.92 | 95.5 |
| – Sans assimilation de données | 0.29 | 0.88 | 89.2 |
| – Sans ST-GNN | 0.27 | 0.85 | 87.1 |
| – Sans apprentissage par renforcement | 0.21 | 0.9 | 78.4 |
| – Sans apprentissage continu | 0.23 | 0.91 | 92.3 |
Tableau 14 : Résultats expérimentaux et étude d'ablation. Étude d'ablation examinant la contribution de chaque composante du modèle de jumeau numérique proposé à la performance globale du système.
| Scénario | Disponibilité des données | RMSE | Précision | Gestion des intervalles d'observation |
| Normal | 100 % | Faible | Élevée | Stable |
| Perte partielle | 50–70 % | Modérée | Élevée | Interpolation robuste |
| Perte sévère | 20–30 % | Accrue | Modérée | Dégradation progressive |
| Défaillance du capteur | Régionale, 0 % | Plus élevée | Modérée | Généralisation spatiale |
Tableau 15 : Analyse de la robustesse en situation de rareté de données. Le tableau suivant indique les performances du cadre neuronal 4D-Var proposé dans différentes situations de disponibilité des données. Le tableau illustre la robustesse du modèle en montrant comment les erreurs évoluent en cas de perte partielle, de forte esparsité ou de perte totale des données capteurs.