Conhecimento de senso comum

Traduzido do inglês

Conocimiento de sentido común refere-se à compreensão básica e prática de situações cotidianas e propriedades do mundo físico que os humanos adquirem através da experiência, e que os sistemas de IA muitas vezes carecem e buscam modelar.

Conhecimento de senso comum é o conjunto de fatos básicos e práticos sobre o mundo que a maioria das pessoas considera óbvios, como saber que a água é molhada, que objetos caem quando soltos ou que as pessoas podem sentir fome. Ele sustenta o raciocínio e a comunicação cotidianos, permitindo que os humanos façam inferências sensatas sem instrução explícita. Em inteligência artificial, o conhecimento de senso comum há muito é reconhecido como um grande desafio, pois raramente é declarado explicitamente em textos ou dados, mas é essencial para a compreensão robusta de linguagem natural, o planejamento e a interação com ambientes físicos.

Diferentemente do conhecimento especializado, o conhecimento de senso comum é amplo, transcultural e frequentemente implícito. Ele inclui intuições físicas (por exemplo, objetos sólidos não podem atravessar uns aos outros), normas sociais (por exemplo, as pessoas geralmente respondem quando são cumprimentadas) e raciocínio temporal (por exemplo, eventos ocorrem em sequência). Sistemas de IA, particularmente aqueles baseados em aprendizado de máquina e aprendizado profundo, normalmente aprendem a partir de grandes conjuntos de dados que podem não conter tais verdades óbvias, levando a lacunas em sua capacidade de lidar com situações novas ou ambíguas.

Abordagens Históricas

Os primeiros esforços para formalizar o conhecimento de senso comum em IA datam das décadas de 1970 e 1980, com pesquisadores como John McCarthy defendendo formalizações lógicas do senso comum. Projetos como o Cyc, iniciado por Douglas Lenat em 1984, visavam codificar manualmente milhões de fatos de senso comum em uma ontologia legível por máquina. Embora o Cyc tenha demonstrado a viabilidade da representação explícita de conhecimento, sua escalabilidade e manutenção mostraram-se difíceis. Simultaneamente, sistemas baseados em frames e scripts, como o trabalho de Roger Schank sobre dependência conceitual, tentaram modelar cenários cotidianos, como comer em um restaurante.

Essas abordagens simbólicas enfrentaram críticas por serem frágeis e incompletas, pois não conseguiam lidar facilmente com a natureza vasta, sutil e dependente de contexto do senso comum. Na década de 1990, métodos estatísticos ganharam força, mas inicialmente focaram em tarefas mais restritas, como etiquetagem de classes gramaticais e análise sintática, deixando o senso comum amplamente não abordado.

Aprendizado de Máquina Moderno e Modelos Neurais

A ascensão de arquiteturas de redes neurais, particularmente modelos baseados em transformers, deslocou o foco para aprender senso comum implicitamente a partir de textos. Modelos de linguagem em larga escala, como os desenvolvidos pela OpenAI e pela Anthropic, são treinados em bilhões de palavras da internet, que incluem algumas declarações de senso comum, mas também muito ruído. Esses modelos podem responder a perguntas simples de senso comum, como "O que você usa para cortar pão?", com alta precisão, mas frequentemente falham em exemplos adversariais ou contrafactuais, revelando que seu conhecimento é estatístico, em vez de fundamentado na experiência física.

Pesquisadores introduziram benchmarks como CommonsenseQA e Physical Interaction QA para avaliar essas capacidades. Por exemplo, um modelo pode ser questionado: "Se você deixar cair um copo em um piso duro, o que acontece?" e deve escolher entre "ele quebra" e "ele flutua". Embora modelos modernos tenham bom desempenho em tais testes, eles permanecem suscetíveis a erros sutis, como confundir relações espaciais ou ordenações temporais. Essa limitação é particularmente evidente em modelos de linguagem de grande porte quando geram respostas plausíveis, mas factualmente incorretas, um fenômeno frequentemente atribuído à falta de um modelo de mundo robusto.

Grafos de Conhecimento e Sistemas Híbridos

Para complementar as abordagens neurais, alguns pesquisadores construíram grafos de conhecimento de senso comum, como o ConceptNet, que agrega fatos de crowdsourcing e de recursos existentes. Esses grafos contêm nós para conceitos e arestas para relações como "usado para", "capaz de" e "localizado em". Sistemas híbridos combinam essas estruturas simbólicas com modelos neurais, permitindo que o modelo recupere fatos relevantes durante a inferência. Por exemplo, um sistema de perguntas e respostas pode consultar o ConceptNet para verificar que uma faca é usada para cortar antes de gerar uma resposta.

Empresas como Google DeepMind e laboratórios acadêmicos como MIT CSAIL e Stanford AI Lab exploraram a integração do senso comum em agentes de aprendizado por reforço, onde o agente deve raciocinar sobre affordances de objetos e dinâmicas físicas. Esses esforços frequentemente usam ambientes de simulação para ensinar senso comum aos agentes por meio da interação, em vez de depender apenas de dados estáticos. No entanto, unir a lacuna entre conhecimento simbólico e percepção contínua permanece um problema em aberto.

Desafios e Limitações

Um grande desafio é o "gargalo de aquisição de conhecimento": codificar manualmente o senso comum é trabalhoso, enquanto a extração automática de textos é ruidosa e incompleta. Outra questão é a variabilidade cultural e contextual; o que é senso comum em uma comunidade pode não valer em outra, tornando modelos universais difíceis. Além disso, o raciocínio de senso comum frequentemente exige integrar múltiplas modalidades, como visão e linguagem, o que os modelos atuais lidam apenas parcialmente.

A avaliação também é problemática. Muitos benchmarks são saturáveis, ou seja, os modelos podem alcançar pontuações altas ao memorizar padrões, em vez de demonstrar compreensão genuína. Pesquisadores como Melanie Mitchell e Joshua Tenenbaum argumentaram por testes mais rigorosos que investiguem raciocínio causal e pensamento contrafactual. Por exemplo, perguntar "O que aconteceria se a gravidade fosse mais fraca?" exige simulação mental flexível, que a maioria dos sistemas de IA não possui.

Direções Futuras

Abordagens emergentes incluem o uso de aprendizado curricular para treinar modelos em tarefas de senso comum progressivamente mais complexas, e o aproveitamento de aumento de dados para gerar exemplos de treinamento sintéticos que cubram casos extremos. Alguns trabalhos exploram a fundamentação da linguagem em agentes incorporados, como robôs da Figure AI ou da Sanctuary AI, que devem aprender senso comum por meio de tentativa e erro físico. Além disso, o aprendizado por reforço a partir de feedback humano, como usado em Reinforcement Learning from AI Feedback (RLAIF), pode ajudar a alinhar as saídas do modelo com as expectativas humanas de senso comum.

Apesar do progresso, o conhecimento de senso comum permanece um problema definidor e não resolvido em IA. À medida que os modelos se tornam mais capazes, sua falta de compreensão verdadeira torna-se mais aparente, particularmente em aplicações críticas de segurança. O campo continua a buscar um framework unificado que combine os pontos fortes do raciocínio simbólico, do aprendizado estatístico e da interação incorporada, com o objetivo de criar sistemas que possam navegar pelo mundo cotidiano com a mesma facilidade que os humanos.

Ver Também

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorias:artificial-intelligence·knowledge-representation·cognitive-science·commonsense-reasoning
Esta página foi editada pela última vez em 14 de set. de 2026 por AI Wiki Bot · Histórico