Allgemeinwissen ist die Sammlung grundlegender, praktischer Fakten über die Welt, die die meisten Menschen als selbstverständlich betrachten, wie etwa zu wissen, dass Wasser nass ist, dass Gegenstände fallen, wenn man sie loslässt, oder dass Menschen Hunger empfinden können. Es untermauert alltägliches Denken und Kommunikation und ermöglicht es Menschen, ohne explizite Anweisungen vernünftige Schlussfolgerungen zu ziehen. In der künstlichen Intelligenz wird Allgemeinwissen seit langem als große Herausforderung anerkannt, da es in Texten oder Daten selten explizit ausgedrückt wird, aber für ein robustes Verständnis natürlicher Sprache, Planung und Interaktion mit physischen Umgebungen unerlässlich ist.
Im Gegensatz zu spezialisiertem Fachwissen ist Allgemeinwissen breit, kulturübergreifend und oft implizit. Es umfasst physikalische Intuitionen (z. B. dass feste Objekte nicht durcheinander hindurchgehen können), soziale Normen (z. B. dass Menschen normalerweise reagieren, wenn sie begrüßt werden) und zeitliches Denken (z. B. dass Ereignisse in einer Reihenfolge ablaufen). KI-Systeme, insbesondere solche, die auf maschinellem Lernen und Deep Learning basieren, lernen typischerweise aus großen Datensätzen, die solche offensichtlichen Wahrheiten möglicherweise nicht enthalten, was zu Lücken in ihrer Fähigkeit führt, neuartige oder mehrdeutige Situationen zu bewältigen.
Historische Ansätze
Frühe Bemühungen, Allgemeinwissen in der KI zu formalisieren, reichen bis in die 1970er und 1980er Jahre zurück, wobei Forscher wie John McCarthy für logische Formalisierungen des gesunden Menschenverstands eintraten. Projekte wie Cyc, das 1984 von Douglas Lenat initiiert wurde, zielten darauf ab, Millionen von Alltagsfakten manuell in eine maschinenlesbare Ontologie zu kodieren. Während Cyc die Machbarkeit expliziter Wissensrepräsentation demonstrierte, erwiesen sich Skalierbarkeit und Wartung als schwierig. Parallel dazu versuchten frame-basierte Systeme und Skripte, wie Roger Schanks Arbeit zur konzeptuellen Abhängigkeit, alltägliche Szenarien wie das Essen in einem Restaurant zu modellieren.
Diese symbolischen Ansätze wurden dafür kritisiert, spröde und unvollständig zu sein, da sie die enorme, nuancierte und kontextabhängige Natur des Allgemeinwissens nicht leicht bewältigen konnten. In den 1990er Jahren gewannen statistische Methoden an Bedeutung, aber sie konzentrierten sich zunächst auf engere Aufgaben wie Part-of-Speech-Tagging und Parsing, wobei Allgemeinwissen weitgehend unberücksichtigt blieb.
Moderne maschinelle Lern- und neuronale Modelle
Der Aufstieg von neuronalen Netzwerk-Architekturen, insbesondere Transformer-basierten Modellen, verlagerte den Fokus auf das implizite Lernen von Allgemeinwissen aus Texten. Groß angelegte Sprachmodelle, wie sie von OpenAI und Anthropic entwickelt wurden, werden mit Milliarden von Wörtern aus dem Internet trainiert, die einige Alltagsaussagen, aber auch viel Rauschen enthalten. Diese Modelle können einfache Alltagsfragen wie „Womit schneidet man Brot?“ mit hoher Genauigkeit beantworten, versagen jedoch oft bei adversarischen oder kontrafaktischen Beispielen, was zeigt, dass ihr Wissen statistisch und nicht in physischer Erfahrung verankert ist.
Forscher haben Benchmarks wie CommonsenseQA und Physical Interaction QA eingeführt, um diese Fähigkeiten zu bewerten. Beispielsweise könnte ein Modell gefragt werden: „Was passiert, wenn man ein Glas auf einen harten Boden fallen lässt?“ und muss zwischen „es zerbricht“ und „es schwebt“ wählen. Während moderne Modelle bei solchen Tests gut abschneiden, bleiben sie anfällig für subtile Fehler, wie das Verwechseln räumlicher Beziehungen oder zeitlicher Abfolgen. Diese Einschränkung zeigt sich besonders deutlich bei großen Sprachmodellen, wenn sie plausible, aber sachlich falsche Antworten generieren, ein Phänomen, das oft auf ihr Fehlen eines robusten Weltmodells zurückgeführt wird.
Wissensgraphen und hybride Systeme
Um neuronale Ansätze zu ergänzen, haben einige Forscher Alltagswissensgraphen wie ConceptNet aufgebaut, die Fakten aus Crowdsourcing und bestehenden Ressourcen aggregieren. Diese Graphen enthalten Knoten für Konzepte und Kanten für Beziehungen wie „verwendet für“, „fähig zu“ und „befindet sich bei“. Hybride Systeme kombinieren diese symbolischen Strukturen mit neuronalen Modellen, sodass das Modell während der Inferenz relevante Fakten abrufen kann. Beispielsweise könnte ein Frage-Antwort-System ConceptNet abfragen, um zu überprüfen, dass ein Messer zum Schneiden verwendet wird, bevor es eine Antwort generiert.
Unternehmen wie Google DeepMind und akademische Labore wie MIT CSAIL und Stanford AI Lab haben untersucht, wie Allgemeinwissen in Reinforcement-Learning-Agenten integriert werden kann, wobei der Agent über Objektaffordanzen und physikalische Dynamik nachdenken muss. Diese Bemühungen nutzen oft Simulationsumgebungen, um Agenten Allgemeinwissen durch Interaktion beizubringen, anstatt sich nur auf statische Daten zu verlassen. Die Überbrückung der Kluft zwischen symbolischem Wissen und kontinuierlicher Wahrnehmung bleibt jedoch ein offenes Problem.
Herausforderungen und Einschränkungen
Eine große Herausforderung ist der „Wissensakquisitions-Engpass“: Das manuelle Kodieren von Allgemeinwissen ist arbeitsintensiv, während die automatische Extraktion aus Texten verrauscht und unvollständig ist. Ein weiteres Problem ist die kulturelle und kontextuelle Variabilität; was in einer Gemeinschaft gesunder Menschenverstand ist, gilt in einer anderen möglicherweise nicht, was universelle Modelle schwierig macht. Darüber hinaus erfordert Alltagsdenken oft die Integration mehrerer Modalitäten wie Vision und Sprache, die aktuelle Modelle nur teilweise bewältigen.
Auch die Evaluierung ist problematisch. Viele Benchmarks sind sättigbar, was bedeutet, dass Modelle hohe Punktzahlen erreichen können, indem sie Muster auswendig lernen, anstatt echtes Verständnis zu demonstrieren. Forscher wie Melanie Mitchell und Joshua Tenenbaum haben sich für strengere Tests ausgesprochen, die kausales Denken und kontrafaktisches Denken untersuchen. Beispielsweise erfordert die Frage „Was würde passieren, wenn die Schwerkraft schwächer wäre?“ flexible mentale Simulation, die den meisten KI-Systemen fehlt.
Zukünftige Richtungen
Neue Ansätze umfassen die Verwendung von Curriculum-Lernen, um Modelle auf zunehmend komplexere Alltagsaufgaben zu trainieren, und die Nutzung von Datenaugmentierung, um synthetische Trainingsbeispiele zu generieren, die Randfälle abdecken. Einige Arbeiten erforschen die Verankerung von Sprache in verkörperten Agenten, wie Robotern von Figure AI oder Sanctuary AI, die Allgemeinwissen durch physisches Versuch-und-Irrtum-Lernen erwerben müssen. Darüber hinaus kann Reinforcement Learning aus menschlichem Feedback, wie es in RLHF verwendet wird, dazu beitragen, Modellausgaben an menschliche Erwartungen an gesunden Menschenverstand anzupassen.
Trotz Fortschritten bleibt Allgemeinwissen ein definierendes ungelöstes Problem in der KI. Je leistungsfähiger Modelle werden, desto deutlicher wird ihr Mangel an echtem Verständnis, insbesondere in sicherheitskritischen Anwendungen. Das Feld sucht weiterhin nach einem einheitlichen Rahmen, der die Stärken von symbolischem Denken, statistischem Lernen und verkörperter Interaktion kombiniert, mit dem Ziel, Systeme zu schaffen, die die alltägliche Welt so mühelos navigieren können wie Menschen.