Im Oktober 2024 führte Anthropic die Funktion „Computer Use" für seine Claude-Serie großer Sprachmodelle ein. Diese Fähigkeit ermöglicht es einer Anwendung, die Claude-API aufzurufen, um zu versuchen, die Navigationskontrolle über die Anwendung zu übernehmen, basierend auf Claudes Interpretation des Bildschirminhalts und der Simulation von Tastatur- und Mauseingaben. Sie markierte einen bedeutenden Schritt in Richtung generativer KI hin zu KI-Agenten, die auf menschenähnliche Weise mit grafischen Benutzeroberflächen interagieren können.
Die Funktion war Teil von Anthropics breiterem Bestreben, Claude über Chatbot-Interaktionen hinaus zu agentischen Werkzeugen zu erweitern. Sie folgte auf die Veröffentlichung von Claude als KI-basiertem Chatbot im März 2023 und die Einführung von Artefakten im Juni 2024. Computer Use wurde entwickelt, um Claude Aufgaben wie das Ausfüllen von Formularen, das Navigieren auf Websites und das Bedienen von Software zu ermöglichen, wobei ausschließlich visuelle Informationen vom Bildschirm und simulierte Eingabeereignisse verwendet werden.
Technische Grundlage
Computer Use basiert auf Claudes Fähigkeit, Screenshots zu verarbeiten und Aktionen zu generieren. Das Modell empfängt ein Bild des Bildschirms, identifiziert relevante Elemente und gibt Befehle wie Mausklicks, Tastatureingaben oder Scroll-Aktionen aus. Dieser Ansatz unterscheidet sich von traditioneller Automatisierung, die auf APIs oder Accessibility-Bäumen beruht. Anthropic trainierte das Modell auf einer Vielzahl von Desktop-Umgebungen, um die Generalisierung zu verbessern.
Die zugrunde liegende Architektur basiert auf dem Transformer-Modell, das auch in anderen Großsprachmodell-Systemen verwendet wird. Claudes Training nutzt eine Verfassung, eine von Anthropic entwickelte Technik zur Verbesserung der ethischen und rechtlichen Konformität. Die Computer-Use-Funktion war zunächst über die Claude-API verfügbar, sodass Entwickler sie in ihre eigenen Anwendungen integrieren konnten.
Fähigkeiten und Einschränkungen
In der ersten Version konnte Computer Use Aufgaben wie Websuchen, das Ausfüllen von Formularen und das Durchlaufen mehrstufiger Arbeitsabläufe ausführen. Anthropic berichtete, dass das Modell einfache Aufgaben mit moderater Genauigkeit abschließen konnte, aber für komplexe oder risikoreiche Operationen noch nicht zuverlässig war. Das Unternehmen betonte, dass die Funktion experimentell sei, und empfahl menschliche Aufsicht.
Eine bemerkenswerte Einschränkung war die Tendenz des Modells, Fehler in unbekannten Oberflächen oder bei geänderten Bildschirmlayouts zu machen. Anthropic wies auch darauf hin, dass Computer Use anfällig für Prompt-Injection-Angriffe sein könnte, bei denen bösartige Anweisungen, die in Webseiten eingebettet sind, die Aktionen des Modells beeinflussen könnten. Das Unternehmen riet Entwicklern, Schutzmaßnahmen zu implementieren.
Vergleich mit anderen KI-Systemen
Computer Use positionierte Anthropic neben anderen KI-Entwicklern, die agentische Fähigkeiten erforschten. OpenAI und Google DeepMind hatten ebenfalls Modelle demonstriert, die mit Software interagieren konnten, aber Anthropics Ansatz konzentrierte sich auf bildschirmbasierte Steuerung statt auf API-Integration. Dies machte ihn auf Altsysteme und Anwendungen ohne programmatische Schnittstellen anwendbar.
Die Funktion war Teil eines Trends hin zu künstlicher Intelligenz-Systemen, die Computer autonom bedienen können. Im Gegensatz zu maschinellen Lernmodellen, die nur Text generieren, erforderte Computer Use, dass das Modell räumliche Layouts versteht und sequenzielle Aktionen ausführt. Dies verlangte Fortschritte im visuellen Verständnis und in der Entscheidungsfindung.
Entwickler-Adoption und Ökosystem
Nach dem Start im Oktober 2024 begannen Entwickler, Computer Use in verschiedene Werkzeuge zu integrieren. Es wurde zur Automatisierung der Dateneingabe, zum Testen von Software und zur Verwaltung von Arbeitsabläufen verwendet. Die Funktion war besonders nützlich für Aufgaben, die die Interaktion mit mehreren Anwendungen erforderten, wie das Kopieren von Daten aus einer Tabellenkalkulation in ein Webformular.
Anthropic stellte Dokumentationen und Beispiele bereit, um Entwicklern den Einstieg zu erleichtern. Die API ermöglichte eine feingranulare Kontrolle über die Aktionen des Modells, einschließlich der Möglichkeit, Aufgaben zu pausieren und fortzusetzen. Einige Entwickler kombinierten Computer Use mit anderen Claude-Funktionen wie Artefakten, um anspruchsvollere Anwendungen zu erstellen.
Spätere Entwicklungen
Die Computer-Use-Funktion entwickelte sich im Laufe der Zeit weiter. Im Februar 2025 veröffentlichte Anthropic Claude Code, ein terminalbasiertes agentisches Werkzeug für Programmieraufgaben. Während Claude Code sich auf textbasierte Interaktionen konzentrierte, blieb Computer Use für grafische Umgebungen relevant. Im August 2025 veröffentlichte Anthropic Claude für Chrome, eine Browsererweiterung, die es Claude ermöglichte, Websites zu durchsuchen und im Namen des Benutzers zu klicken und Formulare auszufüllen. Diese Erweiterung nutzte ähnliche Bildschirminterpretationstechnologie.
Im Januar 2026 führte Anthropic Claude Cowork ein, ein grafisches Werkzeug, das sich an nicht-technische Benutzer richtet. Cowork gewährte Claude Zugriff auf eine Sandbox-Shell und vom Benutzer ausgewählte Ordner, sodass das Modell Dateien lesen, schreiben und bearbeiten, Code ausführen und mehrstufige Aufgaben verketten konnte. Obwohl Cowork nicht ausschließlich auf Computer Use basierte, teilte es das Ziel, Claude zu ermöglichen, Software auf dem Computer eines Benutzers zu bedienen.
Sicherheits- und ethische Überlegungen
Die Einführung von Computer Use warf Sicherheitsbedenken auf. Da das Modell eine Desktop-Oberfläche steuern konnte, könnte es potenziell für unbefugte Aktionen ausgenutzt werden. Anthropic implementierte Schutzmaßnahmen wie die Anforderung einer Benutzerbestätigung für sensible Operationen und die Begrenzung des Zugriffs des Modells auf bestimmte Systemfunktionen.
Prompt-Injection-Angriffe waren ein besonderes Anliegen. Im August 2025 berichtete Anthropic, dass solche Angriffe nach Abschwächungen in Claude für Chrome in 11,2 % der Fälle erfolgreich waren. Das Unternehmen forschte weiterhin an Möglichkeiten zur Verbesserung der Robustheit. Die breiteren Implikationen für die Sicherheit von Deep Learning und neuronalen Netzen wurden in akademischen und industriellen Kreisen diskutiert.
Auswirkungen und Rezeption
Der Start von Computer Use wurde in den Technologiemedien breit abgedeckt. Er wurde als Meilenstein in der Entwicklung von KI-Agenten angesehen, die mit der digitalen Welt interagieren können. Einige Beobachter verglichen ihn mit früheren Bemühungen im Bereich Computerschach und anderen Domänen, in denen KI Fähigkeiten in begrenzten Umgebungen demonstrierte, merkten jedoch an, dass Computer Use ein allgemeineres und unstrukturierteres Problem adressierte.
Anthropics Schritt verschärfte auch den Wettbewerb zwischen KI-Unternehmen. Microsoft und Google integrierten KI in ihre Betriebssysteme und Produktivitätstools, während Amazon Web Services und andere Cloud-Anbieter KI-Dienste anboten. Computer Use gab Anthropic ein eigenständiges Angebot im Bereich der agentischen KI.
Zukünftige Richtungen
Stand 2026 wurde Computer Use weiter verfeinert. Anthropic plante, die Genauigkeit, Geschwindigkeit und Fähigkeit des Modells zur Handhabung komplexer Oberflächen zu verbessern. Das Unternehmen erforschte auch Wege, Computer Use mit anderen agentischen Funktionen wie Claude Code und Cowork zu kombinieren, um nahtlosere Automatisierung zu schaffen.
Die Entwicklung von Computer Use war Teil einer breiteren Bewegung hin zu generativen KI-Systemen, die Aktionen in der Welt ausführen können, nicht nur Text generieren. Forscher an Institutionen wie MIT CSAIL und Stanford AI Lab untersuchten ähnliche Ansätze. Das langfristige Ziel war die Schaffung von KI-Assistenten, die eine breite Palette computerbasierter Aufgaben mit minimaler menschlicher Intervention bewältigen können.
Anthropics Computer-Use-Funktion stellte einen bemerkenswerten Fortschritt dar, um KI praktischer und interaktiver zu machen. Indem Claude in die Lage versetzt wurde, eine Desktop-Oberfläche zu bedienen, eröffnete sie neue Möglichkeiten für Automatisierung und Unterstützung, während sie gleichzeitig wichtige Fragen zu Sicherheit und Kontrolle aufwarf.