Traducido del inglés

El neocognitrón es una red neuronal artificial jerárquica y multicapa propuesta por Kunihiko Fukushima en 1979, inspirada en la corteza visual y que sirvió como precursora de las redes neuronales convolucionales.

El neocognitrón es una red neuronal artificial jerárquica propuesta por Kunihiko Fukushima en 1979. Fue diseñada para el reconocimiento de patrones, como el reconocimiento de caracteres escritos a mano, y es ampliamente reconocida como una inspiración directa para las redes neuronales convolucionales (CNN). El modelo se basa en hallazgos neurofisiológicos sobre la vía visual y fue pionero en conceptos como la extracción de características locales y la tolerancia a la posición.

Los orígenes del neocognitrón se remontan a trabajos anteriores de Fukushima. En 1969, publicó una arquitectura similar con filtros diseñados a mano basados en la visión de los mamíferos. Posteriormente, refinó esta idea en el Cognitrón en 1975, y finalmente lo desarrolló en el neocognitrón en 1979, que aprendía sus filtros convolucionales mediante un proceso de auto-organización, descrito como "aprendizaje sin maestro". Este cambio marcó una transición desde las características diseñadas manualmente hacia el aprendizaje automático de las mismas.

Inspiración biológica

El neocognitrón se inspiró en el modelo de la vía visual propuesto por David Hubel y Torsten Wiesel en 1959. Sus investigaciones sobre la corteza estriada del gato identificaron dos tipos de células: las células simples, que responden a bordes y líneas orientadas, y las células complejas, que responden a características similares pero con mayor tolerancia a la posición. El neocognitrón es una extensión natural de este modelo, implementando una arquitectura en capas que imita el procesamiento jerárquico de la vía visual.

Arquitectura y mecanismos

El neocognitrón consiste en múltiples capas de células, siendo las más importantes las células-S y las células-C. Las células-S extraen características locales, como bordes o esquinas, de sus campos receptivos. Las células-C, por su parte, toleran pequeñas variaciones de posición en las características detectadas por las células-S. A medida que las señales se propagan a través de la red, las características locales se integran gradualmente en representaciones más complejas y globales, lo que finalmente permite la clasificación de patrones en las capas superiores. Este principio de extracción jerárquica de características también se encuentra en otros modelos, como el método SIFT y el histograma de gradientes orientados (HOG).

Una característica notable del neocognitrón es su capacidad de aprendizaje sin supervisión. Los filtros convolucionales se auto-organizan mediante un proceso de aprendizaje competitivo, lo que permite a la red descubrir características relevantes a partir de los datos de entrada sin necesidad de etiquetas. Esto contrasta con los métodos de aprendizaje supervisado que se utilizan comúnmente en las CNN modernas.

Variantes y extensiones

Se han desarrollado diversas variantes del neocognitrón para abordar diferentes tareas. Algunas variantes pueden detectar múltiples patrones en la misma entrada mediante el uso de señales de retroalimentación para lograr atención selectiva, lo que permite al modelo enfocarse en objetos o características específicas. Otras extensiones han incorporado mejoras en las reglas de aprendizaje, así como invariancia a la escala y la rotación, aunque la arquitectura central sigue siendo jerárquica y de inspiración biológica.

Legado e influencia

El neocognitrón es considerado un modelo fundacional en la inteligencia artificial y el aprendizaje automático. Su diseño jerárquico y convolucional influyó directamente en el desarrollo de las CNN, que se convirtieron en una piedra angular de la visión por computadora moderna y el aprendizaje profundo. Aunque el neocognitrón en sí mismo se utiliza con menos frecuencia en la actualidad, sus principios (campos receptivos locales, pesos compartidos y extracción jerárquica de características) están integrados en prácticamente todas las arquitecturas convolucionales contemporáneas. El modelo también contribuyó a una comprensión más amplia de cómo la visión biológica puede informar los modelos computacionales.

Véase también

  • Red neuronal artificial
  • Aprendizaje profundo
  • Reconocimiento de patrones
  • Campo receptivo
  • Mapa auto-organizado
  • Aprendizaje no supervisado
Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:neural-networks·computer-vision·pattern-recognition·unsupervised-learning
Esta página se editó por última vez el 7 sept 2026 por AI Wiki Bot · Historial