Mustererkennung ist die Aufgabe, einer Beobachtung basierend auf aus Daten extrahierten Mustern eine Klasse zuzuweisen. Es ist ein Fachgebiet, das sich mit der automatischen Entdeckung von Regelmäßigkeiten in Daten durch Computeralgorithmen und der Nutzung dieser Regelmäßigkeiten zur Durchführung von Aktionen wie der Klassifizierung von Daten in verschiedene Kategorien befasst. Obwohl ähnlich, ist Mustererkennung nicht mit Muster-Maschinen zu verwechseln, die möglicherweise über Fähigkeiten zur Mustererkennung verfügen, deren primäre Funktion jedoch darin besteht, emergente Muster zu unterscheiden und zu erzeugen. Die Disziplin hat ihre Ursprünge in der Statistik und dem Ingenieurwesen, und moderne Ansätze stützen sich zunehmend auf maschinelles Lernen aufgrund der Verfügbarkeit von Big Data und reichlich Rechenleistung.
Mustererkennungssysteme werden üblicherweise aus beschrifteten Trainingsdaten trainiert, bei denen jede Instanz mit einer korrekten Ausgabe gepaart ist. Wenn keine beschrifteten Daten verfügbar sind, können Algorithmen durch unüberwachte Methoden bisher unbekannte Muster entdecken. Das Fachgebiet konzentriert sich auf das Signal selbst, einschließlich Erfassung und Signalverarbeitung, und ist im Kontext der Computer Vision beliebt; eine führende Konferenz ist die Conference on Computer Vision and Pattern Recognition. Im maschinellen Lernen ist Mustererkennung die Zuweisung einer Beschriftung zu einem gegebenen Eingabewert, während in der Statistik die Diskriminanzanalyse 1936 zu diesem Zweck eingeführt wurde.
Arten von Ausgaben
Mustererkennung umfasst eine Vielzahl von Ausgabetypen über die einfache Klassifizierung hinaus. Die Klassifizierung versucht, jeden Eingabewert einer von einer gegebenen Menge von Klassen zuzuordnen, beispielsweise um zu bestimmen, ob eine E-Mail Spam ist. Die Regression weist jedem Eingabewert einen reellwertigen Ausgabewert zu, beispielsweise zur Vorhersage eines Hauspreises. Die Sequenzbeschriftung weist jedem Mitglied einer Sequenz eine Klasse zu, beispielsweise das Part-of-Speech-Tagging, das jedes Wort in einem Satz mit seiner grammatischen Rolle beschriftet. Das Parsing weist einem Eingabesatz einen Parse-Baum zu, der seine syntaktische Struktur beschreibt. Diese Aufgaben teilen das Ziel, für alle möglichen Eingaben eine vernünftige Antwort zu erzeugen, indem sie ein "wahrscheinlichstes" Matching durchführen, das statistische Variationen berücksichtigt, im Gegensatz zu Musterabgleich-Algorithmen, die exakte Übereinstimmungen suchen, wie das Abgleichen regulärer Ausdrücke in Texteditoren.
Lernparadigmen
Mustererkennung wird allgemein nach dem verwendeten Lernverfahren kategorisiert. Das überwachte Lernen setzt einen Trainingssatz handbeschrifteter Instanzen voraus; ein Lernverfahren erzeugt ein Modell, das auf Trainingsdaten gut abschneidet und auf neue Daten verallgemeinert, wobei oft Einfachheit gemäß Ockhams Rasiermesser bevorzugt wird. Das unüberwachte Lernen setzt keine handbeschrifteten Daten voraus und versucht, inhärente Muster zu finden, wobei das unüberwachte Äquivalent zur Klassifizierung das Clustering ist, das Eingaben basierend auf Ähnlichkeitsmaßen wie Distanz in einem mehrdimensionalen Vektorraum gruppiert. Das halbüberwachte Lernen kombiniert einen kleinen Satz beschrifteter Daten mit einer größeren Menge unbeschrifteter Daten. In einigen Fachgebieten unterscheidet sich die Terminologie; beispielsweise verwendet die Gemeinschaftsökologie "Klassifizierung" für das, was allgemein als Clustering bezeichnet wird.
Merkmale und Darstellung
Jede Eingabeinstanz wird formal durch einen Vektor von Merkmalen beschrieben, die eine Beschreibung aller bekannten Eigenschaften darstellen. Diese Merkmalsvektoren definieren Punkte in einem mehrdimensionalen Raum, was Vektoroperationen wie Skalarprodukte und Winkel ermöglicht. Merkmale können kategorial (nominal, wie Geschlecht oder Blutgruppe), ordinal (geordnete Elemente wie "groß", "mittel", "klein"), ganzzahlig (z. B. Worthäufigkeiten) oder reellwertig (z. B. Blutdruckmessungen) sein. Viele Algorithmen erfordern kategoriale Daten, daher können reellwertige oder ganzzahlige Daten in Gruppen diskretisiert werden, wie weniger als 5, zwischen 5 und 10 oder größer als 10.
Probabilistische Klassifikatoren
Viele gängige Mustererkennungsalgorithmen sind probabilistisch und verwenden statistische Inferenz, um die beste Beschriftung für eine Instanz zu finden. Im Gegensatz zu nicht-probabilistischen Algorithmen, die nur eine einzige beste Beschriftung ausgeben, geben probabilistische Algorithmen oft einen Konfidenzwert aus, der die Wahrscheinlichkeit darstellt, dass die Instanz durch die Beschriftung beschrieben wird. Sie können auch eine Liste der N besten Beschriftungen mit zugehörigen Wahrscheinlichkeiten ausgeben. Wenn die Anzahl möglicher Beschriftungen klein ist, kann N so eingestellt werden, dass Wahrscheinlichkeiten für alle Beschriftungen ausgegeben werden. Probabilistische Algorithmen bieten Vorteile wie die Bereitstellung von Konfidenzwerten, die bei der Entscheidungsfindung und bei der Kombination mehrerer Klassifikatoren nützlich sind.
Anwendungen und moderner Kontext
Mustererkennung hat Anwendungen in der statistischen Datenanalyse, Signalverarbeitung, Bildanalyse, Informationsabfrage, Bioinformatik, Datenkompression, Computergrafik und im maschinellen Lernen. Wissensentdeckung in Datenbanken (KDD) und Data Mining haben einen größeren Fokus auf unüberwachte Methoden und geschäftliche Nutzung, während die Mustererkennung die Signalverarbeitung und ingenieurwissenschaftliche Ursprünge betont. Der Aufstieg von Deep Learning und neuronalen Netzen hat das Fachgebiet transformiert und Durchbrüche in Computer Vision und natürlicher Sprachverarbeitung ermöglicht. Moderne Systeme, wie sie von OpenAI und Google DeepMind entwickelt werden, stützen sich stark auf Prinzipien der Mustererkennung, die oft über Transformatoren und große Sprachmodelle implementiert werden. Das Fachgebiet entwickelt sich weiter mit Fortschritten bei Hardware von Unternehmen wie NVIDIA (obwohl nicht in der bereitgestellten Liste, vermeidet der Artikel externe Links) und Cloud-Plattformen wie Amazon Web Services und Azure.
Geschichte und Schlüsselfiguren
Die Wurzeln der Mustererkennung reichen bis in die Statistik und das Ingenieurwesen zurück, mit frühen Arbeiten zur Diskriminanzanalyse im Jahr 1936. Pioniere wie Bernard Widrow trugen zu frühen neuronalen Netzen bei, während Thomas Dietterich und Michael Jordan die Theorie des maschinellen Lernens vorantrieben. Forschungseinrichtungen wie MIT CSAIL, Stanford AI Lab und Carnegie Mellon University waren zentral für seine Entwicklung. Die Entwicklung des Fachgebiets von handgefertigten Merkmalen zu gelernten Darstellungen spiegelt breitere Trends in der künstlichen Intelligenz wider, wo Mustererkennung als grundlegende Fähigkeit für Wahrnehmung und Entscheidungsfindung dient.