Une route dans le brouillard — et deux façons de la voir

Imaginez une route de montagne, la nuit. Le brouillard s'épaissit. Un conducteur humain plisse les yeux, ajuste son regard, et continue de distinguer les feux arrière du véhicule devant lui. Un système d'intelligence artificielle de conduite autonome, lui, peut littéralement perdre de vue la route. Pas parce qu'il manque de données ou de puissance de calcul — mais parce qu'il lui manque quelque chose de plus fondamental : un mécanisme que le cerveau humain a perfectionné au fil de millions d'années d'évolution.
C'est le point de départ d'une recherche menée à l'Université de Valence par Pablo Hernández Cámara et son équipe. Leur idée : plutôt que d'entraîner une IA sur des millions d'images de brouillard, de pluie et de nuit — une course sans fin —, importer directement dans le réseau artificiel le mécanisme biologique qui rend le cerveau humain si robuste. Le résultat, publié dans Neurocomputing, dépasse les 20 % d'amélioration en conditions défavorables. Mais pour comprendre pourquoi, il faut d'abord entrer dans la mécanique du regard.

Le problème des IA qui voient trop bien par beau temps

Les systèmes de vision artificielle modernes — ceux qui permettent à une voiture autonome de reconnaître un piéton, un panneau ou un feu rouge — sont des réseaux de neurones profonds. En clair : des empilements de couches mathématiques qui apprennent à associer des motifs visuels à des catégories. Entraînés sur des milliers d'images bien éclairées, ils deviennent redoutablement précis. Par beau temps, un tel système peut surpasser l'œil humain.
Le problème, c'est que cette précision est fragile. Quand la luminosité baisse, quand un voile de brouillard atténue les contrastes, quand la pluie crée des reflets parasites, les valeurs numériques que le réseau a appris à reconnaître changent brutalement. Le réseau ne voit plus ce qu'il a appris à voir. Il ne s'adapte pas — il se trompe. Un conducteur humain, lui, n'a pas ce problème. Pourquoi ?

Le « contrôle de volume » du cortex visuel

La réponse tient en deux mots : normalisation divisive. Ce mécanisme, décrit comme une computation neuronale canonique par les neuroscientifiques Matteo Carandini et David J. Heeger dans une revue de synthèse publiée dans Nature Reviews Neuroscience, est présent dans de nombreux systèmes sensoriels. Son principe est élégamment simple.
Dans le cortex visuel, chaque neurone ne travaille pas en solitaire. Sa réponse est constamment mise en rapport avec l'activité de ses voisins. Mathématiquement, cela revient à diviser le signal d'un neurone par une somme pondérée des signaux environnants. Le numérateur, c'est ce que le neurone voit localement. Le dénominateur, c'est le contexte ambiant. Résultat : si tout le voisinage est sombre, le neurone amplifie son signal pour faire ressortir les détails. Si tout est éblouissant, il l'atténue pour ne pas saturer. C'est exactement un contrôle de volume automatique — celui que Hernández Cámara décrit ainsi : « le cerveau baisse le volume pour éviter d'être ébloui ».
Ce mécanisme n'est pas une curiosité de laboratoire. Comme l'a montré le neuroscientifique David J. Heeger dès le début des années 1990 — dans un article fondateur sur le cortex strié du chat, aujourd'hui référencé par le NASA Technical Reports Server —, les cellules visuelles s'inhibent mutuellement pour normaliser leurs réponses par rapport au contraste du stimulus. Ce n'est pas un détail de physiologie : c'est le mécanisme qui permet au système visuel de fonctionner sur plusieurs décades de luminance, du clair de lune à la lumière directe du soleil.
Les réseaux de neurones artificiels, eux, ont progressivement abandonné cette inspiration biologique au profit de la vitesse et de la précision en conditions idéales. Gain à court terme, fragilité à long terme.

Greffer le mécanisme biologique sur un réseau artificiel

L'équipe valencienne a donc fait le chemin inverse. Elle a pris des architectures de réseaux de neurones profonds couramment utilisées pour la segmentation sémantique — c'est-à-dire la tâche qui consiste à étiqueter chaque pixel d'une image (« voiture », « route », « piéton ») — et y a ajouté des couches qui simulent la normalisation divisive. Concrètement, les neurones artificiels sont forcés à communiquer avec leurs voisins et à ajuster leurs activations en fonction du contexte local. Exactement comme le font les neurones biologiques.
Pour tester la robustesse du système, les chercheurs ont soumis les deux versions — classique et bio-inspirée — à une batterie d'épreuves. Des bases de données de conduite réelle en villes européennes, des images de conduite nocturne en Suisse, et des simulateurs de conduite virtuelle. Les perturbations appliquées aux images couvraient systématiquement plusieurs dimensions visuelles : luminance, contraste achromatique, contraste chromatique, changements d'illumination spectrale. Ces jeux de données, dont les ensembles IPL-Cityscapes-LuminanceContrasts et IPL-CARLA-dataset, sont accessibles publiquement sur Hugging Face, ce qui permet à d'autres équipes de reproduire et d'étendre les expériences.
La logique expérimentale est mathématiquement propre : on fixe les conditions d'entraînement, on fait varier une dimension visuelle de façon contrôlée, et on mesure la stabilité de la sortie. Si le modèle est vraiment robuste, sa segmentation ne doit pas s'effondrer quand la luminance baisse d'un facteur deux. C'est précisément ce que l'étude mesure — et ce que le modèle bio-inspiré réussit là où le modèle classique échoue.

Plus de 20 % d'écart — et une explication qui tient

Les résultats sont nets. En conditions normales, les deux systèmes se valent. Mais dès que le brouillard s'épaissit ou que la nuit tombe, l'écart se creuse : le système bio-inspiré affiche des performances supérieures de plus de 20 % à son homologue classique, selon les résultats publiés dans Neurocomputing. Et ce n'est pas une boîte noire qui produit ce résultat par accident — les chercheurs ont analysé les représentations internes du réseau et vérifié qu'il amplifiait bien les détails des véhicules cachés dans la brume, là où le modèle standard les laissait disparaître.
Ce point mérite qu'on s'y arrête. En apprentissage automatique, il est fréquent d'obtenir un gain de performance sans comprendre pourquoi. Ici, le gain est expliqué par deux mécanismes mesurables : une invariance accrue des représentations internes face aux perturbations, et une non-linéarité adaptative qui dépend de l'activité locale. C'est précisément ce que Carandini et Heeger avaient prédit pour les systèmes biologiques. La boucle est bouclée.
Pour Hernández Cámara, la leçon est plus large que la conduite autonome : « La nature a déjà résolu certains des problèmes auxquels l'intelligence artificielle est confrontée aujourd'hui. Il suffit d'apprendre d'elle. » Ce n'est pas un plaidoyer contre la puissance de calcul — c'est un argument pour la structure. Parfois, la bonne opération mathématique vaut mieux qu'un milliard d'exemples supplémentaires.

Concepts à emporter

  • Votre cerveau utilise en permanence un « contrôle de volume » automatique pour voir dans le brouillard ou la nuit : chaque neurone visuel divise son signal par l'activité de ses voisins pour s'adapter au contexte. Les IA de conduite autonome avaient abandonné ce mécanisme — et c'est pour ça qu'elles deviennent « aveugles » dès que la météo se dégrade.
  • Ajouter ce mécanisme biologique à un réseau de neurones artificiel améliore ses performances de plus de 20 % en conditions de brouillard ou d'obscurité, sans lui donner plus de données ni plus de puissance de calcul.
  • Ce mécanisme — la normalisation divisive — est connu des neuroscientifiques depuis les années 1990. Il a fallu attendre 2025 pour que des chercheurs l'intègrent sérieusement dans les réseaux de vision pour voitures autonomes.
  • La robustesse d'une IA ne se mesure pas seulement par sa précision par beau temps : elle se mesure par la stabilité de ses représentations internes quand les conditions changent. C'est une question mathématique autant qu'une question de sécurité.

La division qui stabilise tout : ce que fait vraiment la normalisation divisive

Pour aller un cran plus loin dans la mécanique, voici ce que l'opération réalise concrètement dans un réseau de neurones.
Soit ri la réponse brute d'un neurone (ou d'un filtre, dans un réseau artificiel) à un stimulus local. Sans normalisation, cette valeur est transmise telle quelle à la couche suivante. Avec normalisation divisive, la réponse effective devient :
ŷi = rin / (σn + Σj wij · rjn)
où la somme au dénominateur porte sur un voisinage de neurones j, pondérés par des coefficients wij, et où σ est un paramètre de seuil qui évite la division par zéro. L'exposant n (souvent égal à 2) introduit une non-linéarité qui rend le mécanisme sensible aux niveaux d'activité locale.
Ce que cette formule produit est géométriquement intéressant. Sans normalisation, les activations d'un réseau de vision sont fortement corrélées entre elles : si la luminance globale augmente, tous les neurones répondent plus fort ensemble. Avec normalisation, chaque réponse est mise en contexte par ses voisines — ce qui tend à rendre les composantes du signal plus indépendantes statistiquement. Les neuroscientifiques computationnels Odelia Schwartz et Eero P. Simoncelli ont montré, dans un article publié dans Nature Neuroscience, que « les réponses résultantes sont significativement plus indépendantes » — ce qui correspond à une réduction de la redondance dans la représentation.
Pour la conduite autonome, cela se traduit directement : quand la luminance globale chute (nuit, brouillard), le dénominateur chute aussi, et les réponses des neurones restent dans une plage exploitable. Le réseau ne « voit » pas moins — il recalibre automatiquement son échelle de référence. C'est cette propriété d'invariance mesurable, quantifiée dans l'étude de Neurocomputing sur les ensembles IPL-Cityscapes-LuminanceContrasts, qui explique les gains observés dans les conditions extrêmes.
Ce que cette recherche met en lumière, au fond, c'est que les réseaux de neurones profonds ne sont pas des cerveaux — mais qu'ils peuvent emprunter à la biologie des opérations mathématiques précises, dont les effets sont mesurables et interprétables. Pas une métaphore. Une équation.