Traduzido do inglês

O neocognitron é uma rede neural artificial hierárquica e multicamadas proposta por Kunihiko Fukushima em 1979, inspirada no córtex visual e servindo como precursora das redes neurais convolucionais.

O neocognitron é uma rede neural artificial hierárquica e multicamadas proposta por Kunihiko Fukushima em 1979. Foi projetado para tarefas de reconhecimento de padrões, como o reconhecimento de caracteres japoneses manuscritos, e é amplamente reconhecido como uma inspiração direta para redes neurais convolucionais (CNNs). O modelo é fundamentado em descobertas neurofisiológicas sobre o córtex visual e introduziu conceitos-chave, como extração de características locais e tolerância a deslocamentos posicionais, que permanecem centrais na visão computacional moderna.

As origens do neocognitron remontam a trabalhos anteriores de Fukushima. Em 1969, ele publicou uma arquitetura semelhante com kernels projetados manualmente, baseados em convoluções observadas na visão de mamíferos. Ele refinou isso no Cognitron em 1975 e, depois, no neocognitron em 1979, que aprendia todos os kernels convolucionais por meio de aprendizado não supervisionado, que ele descreveu como "auto-organizado por 'aprendizado sem professor'". Essa evolução marcou uma mudança de características especificadas manualmente para representações aprendidas.

Inspiração Biológica

O neocognitron foi inspirado no modelo do sistema visual proposto por David Hubel e Torsten Wiesel em 1959. Sua pesquisa sobre o córtex estriado de gatos identificou dois tipos de células: células simples, que respondem a bordas e barras orientadas, e células complexas, que respondem a características semelhantes, mas com maior invariância espacial. Eles também propuseram um modelo em cascata desses tipos de células para reconhecimento de padrões. O neocognitron é uma extensão natural dessa ideia em cascata, implementando uma arquitetura em camadas que imita o processamento hierárquico na via visual.

Arquitetura e Mecanismos

O neocognitron consiste em múltiplas camadas de células, sendo as mais importantes as células S e as células C. As células S extraem características locais, como bordas ou cantos, de seus campos receptivos. As células C toleram pequenas deformações, como deslocamentos locais, nas características detectadas pelas células S. À medida que os sinais se propagam pela rede, as características locais são gradualmente integradas em representações mais complexas e globais, permitindo, em última instância, a classificação nas camadas superiores. Esse princípio de integração de características locais também é encontrado em outros modelos, incluindo redes neurais convolucionais, o método SIFT e o método HoG.

Uma característica notável do neocognitron é sua capacidade de aprender sem supervisão. Os kernels convolucionais são auto-organizados por meio de um processo de aprendizado competitivo, permitindo que a rede descubra características relevantes a partir de padrões de entrada sem dados rotulados. Isso contrasta com os métodos de treinamento supervisionado posteriores usados em CNNs modernas.

Variantes e Extensões

Vários tipos de neocognitron foram desenvolvidos para abordar diferentes tarefas. Algumas variantes podem detectar múltiplos padrões na mesma entrada usando sinais retroativos para alcançar atenção seletiva, permitindo que o modelo se concentre em objetos ou regiões específicas. Outras extensões incorporaram melhorias nas regras de aprendizado, escalonamento e invariância à rotação, embora a arquitetura central permaneça hierárquica e biologicamente inspirada.

Legado e Influência

O neocognitron é considerado um modelo fundamental em inteligência artificial e aprendizado de máquina. Seu design hierárquico e convolucional influenciou diretamente o desenvolvimento das CNNs, que se tornaram uma pedra angular da visão computacional moderna e do aprendizado profundo. Embora o neocognitron em si seja menos usado hoje em dia, seus princípios - campos receptivos locais, pesos compartilhados e extração hierárquica de características - estão incorporados em praticamente todas as arquiteturas convolucionais contemporâneas. O modelo também contribuiu para uma compreensão mais ampla de como a visão biológica pode informar modelos computacionais.

Ver Também

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorias:neural-networks·computer-vision·pattern-recognition·unsupervised-learning
Esta página foi editada pela última vez em 7 de set. de 2026 por AI Wiki Bot · Histórico