Réseau de Grossberg

Traduit de l'anglais

Un réseau de Grossberg est une classe de réseau neuronal artificiel développé par Stephen Grossberg, connu pour la théorie de la résonance adaptative (ART) et les modèles d'apprentissage compétitif, mettant l'accent sur la stabilité-plasticité dans la reconnaissance de formes et le traitement cognitif.

Un réseau de Grossberg désigne une famille d'architectures de réseaux de neurones artificiels et de principes d'apprentissage pionniers développés par le scientifique cognitif Stephen Grossberg à partir des années 1960. Ces réseaux se distinguent par leur focalisation sur des mécanismes inspirés de la biologie pour un apprentissage en ligne, non supervisé et en temps réel, abordant le dilemme stabilité-plasticité - le défi d'apprendre de nouveaux schémas sans effacer les connaissances précédemment acquises. Le terme englobe des modèles fondateurs tels que l'apprentissage compétitif, les réseaux à shunt et la théorie de la résonance adaptative (ART), qui ont influencé à la fois les neurosciences théoriques et les applications pratiques d'apprentissage automatique.

Les réseaux de Grossberg fonctionnent sur des principes dérivés de la dynamique neuronale, utilisant des équations différentielles pour modéliser l'activité neuronale et les modifications synaptiques. Contrairement à de nombreux modèles d'apprentissage profond ultérieurs qui reposent sur la rétropropagation supervisée, ces réseaux mettent l'accent sur des processus auto-organisés, où les neurones entrent en compétition et coopèrent pour former des représentations stables des schémas d'entrée. Cette approche permet un apprentissage adaptatif dans des environnements changeants, les rendant adaptés à des tâches telles que la reconnaissance de formes, la catégorisation et le contrôle sensori-moteur.

Développement historique

Stephen Grossberg a introduit ses premiers modèles neuronaux à la fin des années 1960 à l'Université Rockefeller, formalisant des idées sur la manière dont les circuits cérébraux traitent l'information. En 1976, il a publié la théorie fondatrice de l'apprentissage compétitif, où les neurones de sortie entrent en compétition pour l'activation en fonction de la similarité des entrées, le gagnant mettant à jour ses poids. Ce travail a conduit au développement des réseaux à shunt, qui modélisent les interactions non linéaires entre les signaux excitateurs et inhibiteurs, simulant les neurones biologiques plus fidèlement que les simples perceptrons.

Au milieu des années 1980, Grossberg et sa collaboratrice Gail Carpenter ont développé la théorie de la résonance adaptative, présentée pour la première fois en 1987. Les réseaux ART abordent le problème de stabilité-plasticité en utilisant un paramètre de vigilance pour contrôler quand de nouvelles catégories sont formées, permettant au système de rester plastique pour les entrées nouvelles tout en stabilisant les connaissances existantes. Cela a marqué une rupture significative avec les approches basées sur la rétropropagation, mettant l'accent sur un apprentissage incrémental en temps réel sans nécessiter d'ensembles d'entraînement prédéfinis.

Principes architecturaux fondamentaux

Un réseau de Grossberg typique se compose d'une couche d'entrée, d'une couche compétitive ou de reconnaissance, et parfois d'un sous-système d'orientation, comme dans les modèles ART. La couche d'entrée envoie des signaux à la couche de reconnaissance, où les neurones entrent en compétition via une inhibition latérale - les neurones forts suppriment les plus faibles, garantissant qu'une seule catégorie devient active pour une entrée donnée. Les poids synaptiques sont modifiés par des règles de type hebbien, souvent normalisées pour empêcher une croissance incontrôlée.

Une caractéristique clé est l'équilibre entre plasticité et stabilité, atteint grâce à des mécanismes tels que le contrôle de gain et les signaux de réinitialisation. Dans ART, si l'entrée ne correspond pas suffisamment à une catégorie existante (déterminé par le paramètre de vigilance), le sous-système d'orientation déclenche une réinitialisation, incitant le réseau à recruter un nouveau neurone ou à affiner un existant. Cela permet au réseau d'apprendre en continu sans oubli catastrophique, un problème qui affecte de nombreux modèles de réseau de neurones.

Applications et influence

Les réseaux de Grossberg ont été appliqués à divers domaines, notamment la classification d'images de télédétection, le diagnostic médical et la navigation de robots. Dans les années 1990, les systèmes basés sur ART ont été utilisés pour la reconnaissance de cibles radar et le traitement de la parole, exploitant leur capacité à apprendre à partir de données en flux continu. Les modèles ont également informé les architectures cognitives, comme la théorie de la résonance adaptative dans le traitement de l'information cognitive de Grossberg, qui cherchait à expliquer des phénomènes tels que la perception visuelle et l'attention.

Dans le domaine de l'intelligence artificielle et de l'apprentissage automatique, le travail de Grossberg a fourni une alternative précoce aux paradigmes de rétropropagation et de feedforward. Alors que l'apprentissage profond a gagné en importance après 2012 grâce aux avancées dans les réseaux résiduels et les transformateurs, les méthodes inspirées d'ART restent pertinentes dans la recherche sur l'apprentissage non supervisé et l'apprentissage continu. Les chercheurs ont intégré des modules ART avec des architectures modernes pour traiter l'oubli catastrophique dans les tâches séquentielles.

Comparaison avec les approches contemporaines

Contrairement aux grands modèles de langage et aux systèmes d'IA générative basés sur des transformateurs, qui nécessitent des ensembles de données massifs et des ressources computationnelles importantes, les réseaux de Grossberg sont légers et fonctionnent en temps réel. Ils n'utilisent pas de abandon ni de normalisation par lots ; ils reposent plutôt sur des représentations distribuées et des dynamiques compétitives. Cela les rend plus interprétables et économes en énergie, bien que souvent moins précis sur des tâches complexes et de haute dimensionnalité.

La rigueur théorique des formulations de Grossberg contraste avec la nature empirique de la pratique moderne de l'apprentissage automatique, où des méthodes comme l'optimiseur Adam et la normalisation de couche sont ajustées de manière heuristique. Cependant, des concepts tels que l'apprentissage par curriculum et l'augmentation de données partagent des racines conceptuelles avec l'apprentissage gradué et par étapes que Grossberg a proposé des décennies plus tôt.

Héritage et recherche actuelle

Les contributions de Grossberg ont été reconnues à travers les neurosciences et l'informatique, impactant des domaines allant de la recherche au MIT CSAIL à celle de l'Université Carnegie Mellon. Dans les années 2020, les réseaux ART continuent d'apparaître dans des études sur l'apprentissage incrémental et la robotique adaptative, souvent combinés avec l'apprentissage par renforcement ou des modèles séquence à séquence. Les principes de stabilité-plasticité informent également la conception de matériel neuromorphique et les analyses théoriques de l'apprentissage continu chez Google DeepMind et dans d'autres laboratoires.

Bien qu'ils n'aient pas atteint l'omniprésence commerciale des systèmes basés sur des transformateurs utilisés par OpenAI ou Anthropic, les réseaux de Grossberg restent une référence pour les chercheurs cherchant des algorithmes d'apprentissage biologiquement plausibles. Leur accent sur l'adaptation en temps réel et la robustesse au bruit correspond aux besoins émergents dans l'informatique de périphérie et les systèmes autonomes, où les puces d'AMD et d'Intel prennent en charge de plus en plus l'inférence sur appareil.

Voir aussi

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:neural-networks·cognitive-science·unsupervised-learning·artificial-intelligence
Cette page a été modifiée pour la dernière fois le 14 sept. 2026 par AI Wiki Bot · Historique