L'intelligence computationnelle est une branche de l'intelligence artificielle qui concerne la conception et l'étude de systèmes adaptatifs et auto-organisés qui résolvent des problèmes par l'apprentissage, l'évolution ou le raisonnement flou. Contrairement à l'IA symbolique classique, qui repose sur des règles et une logique explicites, l'intelligence computationnelle met l'accent sur des mécanismes inspirés de processus biologiques ou physiques, tels que les réseaux neuronaux, les algorithmes évolutionnaires et la logique floue. Le domaine a émergé au début des années 1990 comme un domaine de recherche distinct, l'IEEE établissant le Conseil des réseaux neuronaux en 1991, rebaptisé plus tard la Société IEEE d'intelligence computationnelle en 2001.
Le terme a gagné en popularité lorsque les chercheurs ont cherché à unifier les travaux sur les réseaux neuronaux, les systèmes flous et le calcul évolutionnaire sous un cadre commun. Ces trois piliers partagent un accent sur la robustesse, l'adaptabilité et la capacité à gérer l'incertitude ou les informations incomplètes. Les méthodes d'intelligence computationnelle sont souvent contrastées avec les approches algorithmiques traditionnelles car elles ne nécessitent pas de connaissance a priori de la structure du problème ; au lieu de cela, elles apprennent à partir des données ou explorent de manière itérative les espaces de solutions.
Paradigmes principaux
Le premier paradigme majeur est celui des réseaux neuronaux artificiels, qui sont des modèles computationnels inspirés par la structure des cerveaux biologiques. Ces réseaux consistent en des nœuds interconnectés (neurones) qui traitent les informations par le biais de connexions pondérées. L'formation ajuste ces poids à l'aide d'algorithmes tels que la rétropropagation, qui a été popularisée par Bernard Widrow et d'autres dans les années 1960 et raffinée dans les années 1980. L'apprentissage profond moderne, un sous-domaine de l'apprentissage machine, repose sur des réseaux neuronaux multicouches et a conduit à des avancées dans la reconnaissance d'images, le traitement du langage naturel et les jeux de jeu.
Le deuxième paradigme est le calcul évolutionnaire, qui inclut les algorithmes génétiques, les stratégies évolutionnaires et la programmation génétique. Ces méthodes imitent la sélection naturelle en maintenant une population de solutions candidates, en appliquant des opérateurs comme la mutation et le croisement, et en sélectionnant les survivants par une fonction de fitness. Les travaux pionnier des chercheurs dans les années 1960 et 1970, tels que John Holland et Ingo Rechenberg, ont jeté les bases, et le domaine a depuis été appliqué à des problèmes d'optimisation en ingénierie, finance et logistique.
Le troisième paradigme est la logique floue, introduite par Lotfi Zadeh en 1965. Les systèmes flous utilisent des fonctions d'appartenance qui permettent des valeurs de vérité partielles entre 0 et 1, permettant un raisonnement avec des données imprécises ou vagues. Ils sont largement utilisés dans les systèmes de contrôle, comme ceux des appareils électroménagers et des processus industriels, où ils fournissent une prise de décision douce et semblable à celle de l'homme.
Relation avec l'apprentissage machine et l'apprentissage profond
L'intelligence computationnelle cheche une vision significative avec l'apprentissage machine, mais les deux ne sont pas identiques. L'apprentissage machine se concentre sur les algorithmes qui s'améliorent avec l'expérience, utilisant souvent des méthodes statistiques. L'intelligence computationnelle, par contraste, met davantage l'accent sur les mécanismes inspirés biologiquement ou physiquement et inclut souvent une optimisation non basée sur le gradientque. L'apprentissage profond, un sous-ensemble de l'apprentissage machine qui utilise des réseaux neuronaux multicouches, est devenu une force dominante au sein de l'intelligence computationnelle depuis les années 2010, propulsé par les avances dans le matériel et la disponibilité de grands ensembles de données.
Les innovations clés de l'apprentissage profond incluent l'architecture Transformer (architecture), présentée dans l'article de 2017 « Attention Is All You Need » par des chercheurs incluant Jakob Uszkoreit, Lukasz Kaiser et Niki Parmar. Les transformers reposent sur l'attention multi-tête et le encodage positionnel pour traiter les séquences, permettant le développement de grands modèles de langage tels que ceux créés par OpenAI, Anthropic et Google DeepMind. Ces modèles ont révolutionné le traitement du langage naturel et l'IA générative, mais ils ne représentent qu'un sous-ensemble des techniques d'intelligence computationnelle.
Applications et impact
Les méthodes d'intelligence computationnelle sont déployées dans_various_sectors variés. En robotique, Waymo et Tesla Autopilot utilisent des réseaux neuronaux pour la perception et la prise de décision dans les véhicules autonomes. Dans la santé, Intuitive Surgical intègre l'apprentissage machine dans les robots chirurgicaux, et Commure applique l'IA aux processus cliniques. Les institutions financières utilisent des algorithmes évolutionnaires pour l'optimisation de portefeuille et l'évaluation des risques. Amazon Web Services et Microsoft Azure offrent des services de cloud IA qui s'appuient sur des techniques d'intelligence computationnelle, y compris du matériel spécialisé comme les puces AWS Trainium.
Dans le domaine du matériel, des entreprises comme AMD, Intel], NVIDIA et Qualcomm conçoivent des processeurs optimisés pour l'inférence et l'entraînement en réseau neuronal. TSMC fabrique des chips avancés pour ces applications, tandis queGroq et SambaNova développent des accélérateurs spécialisés. Des institutions de recherche comme MIT CSAIL, Stanford AI Lab et Berkeley AI Research contribuent des travaux fondamentaux, et Nokia Bell Labs et Xerox PARC ont une signification historique dans les débuts de l'IA et de la l'informatique.
Défis et orientations futures
Malgré les succès, l'intelligence computationnelle fait face à plusieurs défis. Les réseaux neuronaux sont souvent opaques, suscitant des préoccupations concernant l'interprétabilité et le biais. Des chercheurs commeMelanie Mitchell et Joshua Tenenbaum préconisent des mécanismes d'apprentissage plus robustes et similaires à l'humain. Aleksander Madry étudie la robustesse adversariale, tandis que Anima Anandkumar travaille sur des algorithmes extensibles et efficaces. Le domaine fait également face à la consommation d'énergie, suscitant l'intérêt pour la calcul neuromorphique et des techniques de taille de modèle leave des modèles.
Les orientations futures incluent des systèmes hybrides qui combinent des réseaux neuronaux avec un raisonnement symbolique, comme exploré par Brendan Lake et Rafael Calvo. D-Wave et d'autres entreprises de informatique quantique exigent une optimisation inspirée des quantiques, qui pourrait renforcer les algorithmes évolutionnaires. Alors que l'intelligence computationnelle continue d'évoluer, ses méthodes deviennent probablement sèrement intégrées dans la technologie quotidienne, des téléphones aux services blockchain.
Voir aussi
- Intelligence artificielleartificielle
- Apprentissage machinemachine
- Réseau neuronal
- Algorithme évolutionnaire (non inclus, mais connexes)
Références
- Histoire de la Société IEEE d'intelligence computationnelle.
- Zadeh, L. (1965). F où ens. Information and Control.
- Vaswani, A. et al. (2017). Attention Is All You Need.