Aller au contenu principal
Ce que l'IA apprend vraiment quand elle semble apprendre un système complexe

Nominal, résidus, représentation enrichie : pourquoi la taille du modèle n'est pas le seul levier de performance. Une démonstration pédagogique sur l'apprentissage du comportement nominal en environnement industriel, et ce que cela dit réellement de l'intelligence artificielle utile. Frugale. Située. Validée. Proportionnée au réel

Temps de lecture : environ 19 min
Réseau neuronal 128x128

Cet article propose une démonstration pédagogique rigoureuse d'un sujet fondamental et souvent mal posé en IA industrielle : ce qu'un réseau neuronal apprend réellement lorsqu'il semble apprendre un système complexe. Son ambition : montrer que la performance d'un modèle dépend autant de la représentation des données en entrée que de la taille de l'architecture, illustrer ce que signifie apprendre une référence nominale, et montrer comment un résidu structuré trahit un biais de représentation bien plus qu'une simple erreur numérique.

Car, au-delà des discours sur la puissance des modèles et la promesse de la maintenance prévisionnelle, l'IA industrielle utile commence toujours par une question beaucoup plus sobre : à quoi ressemble le comportement normal d'un système ? Tant que cette question n'a pas de réponse rigoureuse, mesurée et validée, aucun modèle, aussi grand soit-il, ne peut prétendre détecter une dérive ou anticiper une défaillance. Un modèle frugal, bien représenté et bien validé, peut souvent surpasser un modèle plus massif lorsque ce dernier est alimenté par une représentation pauvre, mal contextualisée ou insuffisamment qualifiée.

« Avant de détecter une anomalie, encore faut-il savoir ce que signifie fonctionner normalement. »

⏱️ L'essentiel en 30 secondes

  • Un réseau neuronal n'apprend pas « l'intelligence » d'un système ; il apprend une approximation de son comportement sur un domaine observé.
  • Avant de détecter une dérive, il faut construire une référence fiable du comportement nominal : c'est le premier étage, souvent négligé, de toute démarche de maintenance conditionnelle ou prévisionnelle.
  • La performance dépend autant de la représentation des données que de la taille du modèle : c'est le résultat central de cette démonstration.
  • Dans la configuration observée, un petit réseau enrichi (8 × 8 neurones) surpasse un grand réseau minimal (128 × 128) par un facteur 20 sur l'erreur finale.
  • Un résidu structuré ne signale pas seulement une erreur numérique : il révèle un biais de représentation, c'est-à-dire une dynamique que le modèle n'a pas réussi à absorber.
  • L'enrichissement fréquentiel est un acte d'ingénierie guidé par la connaissance du phénomène, non une recette universelle : il suppose des hypothèses sur la structure du signal et une validation sur des régimes non vus.
  • La maintenance prévisionnelle suppose trois étages distincts : apprendre le nominal ; surveiller l'écart au nominal ; relier cet écart à une trajectoire de défaillance et à une criticité opérationnelle.
  • L'IA frugale n'est pas une IA au rabais : c'est une IA dimensionnée, validée et proportionnée au réel. Et le réel ne se comprend jamais sans métier, mesure et validation.
Image
Comparatif architectures neurones minimal vs enrichi
Époque 0 : les dix réseaux partent du même point. En haut, le mode minimal : cinq architectures, de la plus petite à la plus grande. En bas, le mode enrichi. Dès les premières époques, la différence n'est pas là où on l'attend : ce n'est pas la taille du réseau qui sépare les courbes. C'est la qualité de ce qu'on lui donne à apprendre. Prométhée T&I

L'IA chez Prométhée T&I

Il y a ce que l'on montre de l'IA, et ce que l'on en fait réellement.

Chez Prométhée Technologies & Ingénierie, une part significative de nos interventions porte sur des systèmes instrumentés, des chaînes de production et des environnements où les données sont rares, bruitées, contextualisées par la physique d'un procédé et par la mémoire d'une machine. C'est là que travaillent nos équipes au quotidien. L'article que je vous propose aujourd'hui est construit dans une perspective délibérément pédagogique : vous montrer ce qu'il y a sous le capot, et vous donner, en creux, un aperçu fidèle de ce que nous mettons en œuvre chez nos clients industriels.

 

Entre promettre l'IA et la faire fonctionner, il y a la physique d'un procédé, la qualité d'un capteur, et beaucoup de rigueur... L'ingénierie commence là où le discours s'arrête

1. Avant de détecter une dérive, il faut savoir ce que signifie fonctionner normalement

C'est peut-être l'une des questions les plus sobres, et pourtant les plus fondamentales, de l'IA industrielle.

Non pas, d'abord : « comment prédire une panne ? » Mais plutôt : à quoi ressemble le comportement nominal d'un système ?

Une machine, un procédé, une armoire électrique, un serveur, un moteur ou un capteur produit des signaux qui varient en permanence. Ces variations ne sont pas nécessairement des anomalies. Elles peuvent traduire la charge, le régime, la température, l'environnement, l'usure normale, un cycle de production ou une condition d'exploitation particulière.

L'enjeu n'est donc pas de promettre une prédiction de panne comme par magie. L'enjeu est plus exigeant, plus discret, mais beaucoup plus fondateur : construire une référence fiable du comportement attendu.

C'est l'un des socles de la surveillance du nominal, de la maintenance conditionnelle et, lorsque l'historique, la physique du système et la validation le permettent, de la maintenance prévisionnelle.

Dans la démonstration que j'ai construite, le signal cible est volontairement synthétique. Il ne prétend pas représenter une machine réelle. Il combine une dérive lente, des oscillations, des harmoniques et une composante localisée, comme on pourrait en rencontrer dans certains signaux industriels instrumentés.

Le but n'est pas de faire croire qu'un réseau neuronal « comprend » le système. Le but est de montrer comment un modèle peut apprendre une signature nominale, puis jusqu'où il peut la restituer selon deux facteurs : la taille du réseau ; la qualité de la représentation fournie en entrée.

Pour cela, j'ai comparé plusieurs architectures très simples : 8 × 8 neurones ; 16 × 16 ; 32 × 32 ; 64 × 64 ; 128 × 128 neurones.

Pour chaque taille, deux situations ont été testées.

Dans la première, le réseau reçoit une représentation minimale de la variable de régime. Dans la seconde, il reçoit une représentation enrichie, avec des composantes construites, notamment polynomiales et fréquentielles.

L'objectif est volontairement pédagogique : observer ce que change la représentation du problème, à architecture comparable.

Et c'est là que les choses deviennent intéressantes.

Le mode minimal apprend une partie du comportement. Il capte certaines tendances générales, mais peine à restituer les oscillations fines et les structures locales. Le mode enrichi converge beaucoup plus vite et restitue plus fidèlement la signature nominale, parfois avec des réseaux très petits.

Le réseau n'est pas devenu magiquement plus intelligent. Le problème a été mieux représenté.

Dans le mode minimal, le réseau reçoit une information volontairement sobre : une variable de régime normalisée et quelques termes polynomiaux simples. Dans le mode enrichi, il reçoit aussi des variables construites : sinus, cosinus, composantes cohérentes avec la structure fréquentielle du signal.

Cela ne signifie pas que l'on « triche ». Cela illustre un principe fondamental en apprentissage statistique et en ingénierie des systèmes : la performance dépend autant de la représentation des données que de la puissance du modèle.

Un réseau neuronal n'apprend jamais dans le vide. Il apprend à partir d'une représentation du réel. Et cette représentation n'est jamais neutre.

2. Ce que les courbes montrent

Les chiffres obtenus sur cette démonstration sont très parlants.

Courbe des erreurs quadratiques moyennes finales

À architecture égale, l'écart entre les deux modes n'est pas marginal. Dans la configuration observée, à 128 × 128 neurones, le mode enrichi atteint une erreur environ 50 à 60 fois plus faible que le mode minimal. Plus frappant encore : un petit réseau enrichi de 8 × 8 neurones surpasse le réseau minimal de 128 × 128 neurones, avec un écart de l'ordre d'un facteur 20 sur l'erreur finale.

Ce n'est pas un gain cosmétique. C'est un changement de régime.

Et ce résultat porte un message très simple : ajouter des neurones ne compense pas une représentation insuffisante du problème. À l'inverse, une représentation pertinente peut permettre à un modèle très modeste de produire une approximation fidèle sur le domaine étudié.

Mais il y a un second enseignement, moins visible dans une simple courbe d'erreur, et pourtant tout aussi important : la nature des résidus.

Résidus finaux fonction du nombre de neurones et de l'initialisation

Dans le mode minimal, les résidus ne sont pas seulement plus grands. Ils restent structurés. On y observe des oscillations cohérentes, des motifs persistants, une organisation qui suit encore la dynamique du signal. Ce n'est pas seulement de l'erreur. C'est un biais de représentation : le modèle a appris une partie de la tendance, mais n'a pas absorbé la structure complète du phénomène.

Dans le mode enrichi, les résidus deviennent beaucoup plus faibles et nettement moins structurés. Visuellement, ils se rapprochent d'un résidu centré de nature bruitée (ce qui suggère que le modèle a mieux capté la régularité utile du signal). Pour être rigoureux, cette observation visuelle mériterait d'être complétée par des indicateurs statistiques : autocorrélation ; distribution ; stabilité par sous-domaines. La courbe oriente l'analyse. La validation la clôt.

Cette distinction est pourtant essentielle dès la lecture visuelle.

Un résidu structuré indique souvent que quelque chose reste à apprendre : une variable absente ; un régime mal représenté ; une dynamique négligée ; un effet physique non modélisé. Un résidu faible et peu structuré indique, au contraire, que le modèle a probablement capté l'essentiel de la régularité disponible dans le périmètre observé.

3. Ce que la représentation ne garantit pas

Il faut cependant nommer une nuance importante.

Lorsque l'enrichissement est construit à partir de composantes fréquentielles cohérentes avec la structure connue du signal, on fait du feature engineering guidé par la connaissance du phénomène. C'est une force considérable. Mais c'est aussi une hypothèse implicite sur la forme du signal.

En production, si le régime change, si la machine évolue, si la fréquence de cycle se décale ou si un capteur dérive, ces variables construites peuvent devenir moins pertinentes (voire un biais, précisément parce qu'elles étaient très adaptées au domaine d'entraînement).

La frugalité peut donc avoir un coût de généralisation si elle repose sur des hypothèses trop étroites. C'est pourquoi l'enrichissement de la représentation n'est pas une recette universelle. C'est un acte d'ingénierie, qui suppose une connaissance du système, une hypothèse sur sa structure et une discipline de validation sur des régimes non vus.

Cette démonstration rappelle donc une idée simple, mais souvent négligée : la taille du modèle n'est pas le seul levier de performance.

On peut augmenter le nombre de neurones, élargir les couches, complexifier l'architecture. Mais si les données d'entrée sont pauvres, mal représentées ou mal contextualisées, le modèle risque surtout d'apprendre difficilement, lentement, ou de manière peu fiable.

La question n'est pas toujours : quel est le modèle le plus puissant ? Elle est souvent : quel est le modèle suffisant, robuste, maintenable, explicable et proportionné au problème réel ?

Cette question relève pleinement d'une logique d'éco-ingénierie. Non pas faire moins bien avec moins. Mais faire juste, avec le bon niveau de complexité. Éviter la surenchère computationnelle ; réduire les besoins de calcul ; faciliter la maintenance ; améliorer la lisibilité opérationnelle ; adapter le système technique au besoin réel plutôt que compenser une mauvaise formulation par un modèle toujours plus gros.

Il faut toutefois rester prudent.

Approximer fidèlement une signature nominale sur un domaine observé ne signifie pas comprendre la physique complète du système. Cela ne signifie pas non plus extrapoler correctement hors du domaine d'entraînement.

C'est pourquoi la démonstration ne doit pas être interprétée comme une promesse automatique de maintenance prévisionnelle.

Elle illustre un premier étage : apprendre le nominal. Puis un deuxième : surveiller l'écart au nominal.

La maintenance prévisionnelle, au sens strict, suppose un étage supplémentaire : relier les écarts observés à une trajectoire future, à un risque de défaillance, à une criticité opérationnelle ou à une durée résiduelle avant défaut. C'est un autre niveau d'exigence ; et c'est souvent là que se joue la différence entre une démonstration convaincante et un dispositif industriel fiable.

4. L'ingénierie, pas la magie

Une IA située, instrumentée, validée : c'est là que commence le vrai travail.

Le message de cette démonstration est donc volontairement sobre.

Un réseau neuronal peut approximer un comportement complexe. Mais ce qu'il apprend dépend fortement de ce qu'on lui donne à apprendre (du signal, du domaine, de la normalisation, de l'architecture, et surtout de la représentation du problème).

En industrie, l'intelligence ne réside donc pas uniquement dans le modèle. Elle réside aussi dans l'instrumentation ; dans la qualité de la mesure ; dans la compréhension du système ; dans le choix des variables ; dans l'analyse des résidus ; dans la discipline de validation ; dans la capacité à relier un résultat numérique à une décision opérationnelle utile.

La démonstration devient alors moins une histoire d'IA spectaculaire qu'une histoire d'ingénierie.

Un petit réseau, bien dimensionné, bien alimenté et bien validé, peut déjà produire des résultats remarquables sur un périmètre clairement défini. À l'inverse, un modèle massif appliqué à des données pauvres ou mal cadrées risque surtout d'apprendre très vite des choses peu fiables.

Ce type de démonstration rappelle qu'un modèle apprend toujours dans un périmètre, à partir d'une représentation donnée, sous des hypothèses qu'il faut connaître.

Et c'est précisément là que commence l'ingénierie. Non pas dans la fascination pour la taille du modèle. Mais dans la rigueur avec laquelle on pose le problème, on mesure le réel, on représente les données, on analyse les résidus, on valide les résultats et on décide jusqu'où l'on peut faire confiance à ce que l'on voit.

L'IA frugale n'est pas une IA au rabais. C'est une IA ajustée au réel.

Et le réel ne se comprend jamais sans métier, mesure et validation.

Pour Prométhée T&I, ce type de démonstration n'est pas une fin en soi. C'est un point de départ : qualifier le nominal, comprendre les régimes, instrumenter avec discernement, modéliser sans surenchère, puis relier les écarts observés à des décisions opérationnelles utiles. C'est dans cette articulation entre mesure, modèle, métier et décision que l'IA industrielle devient réellement productive.

Stéphane COUTANSON Prométhée T&I © 2026