Lanzamiento de Anthropic Computer Use

Traducido del inglés

En octubre de 2024, Anthropic presentó la función de uso de computadora para Claude, que permite a la IA operar una interfaz de escritorio interpretando el contenido de la pantalla y simulando la entrada de teclado y ratón.

En octubre de 2024, Anthropic presentó la función de "uso de computadora" para su serie de modelos de lenguaje de gran tamaño Claude. Esta capacidad permite que una aplicación llame a la API de Claude para intentar dar control de navegación de la aplicación mediante la interpretación de Claude del contenido de la pantalla y la simulación de entrada de teclado y ratón. Marcó un paso significativo en IA generativa hacia agentes de IA que pueden interactuar con interfaces gráficas de usuario de manera similar a los humanos.

La función fue parte del esfuerzo más amplio de Anthropic para expandir Claude más allá de las interacciones de chatbot hacia herramientas agénticas. Siguió al lanzamiento de Claude como chatbot basado en IA en marzo de 2023 y la introducción de artefactos en junio de 2024. El uso de computadora fue diseñado para permitir que Claude realizara tareas como completar formularios, navegar por sitios web y operar software, utilizando solo información visual de la pantalla y eventos de entrada simulados.

Fundamento Técnico

El uso de computadora se basa en la capacidad de Claude para procesar capturas de pantalla y generar acciones. El modelo recibe una imagen de pantalla, identifica elementos relevantes y genera comandos como clics de ratón, pulsaciones de teclas o acciones de desplazamiento. Este enfoque difiere de la automatización tradicional que depende de API o árboles de accesibilidad. Anthropic entrenó el modelo en una variedad de entornos de escritorio para mejorar la generalización.

La arquitectura subyacente se basa en el modelo transformador, que también se utiliza en otros sistemas de modelos de lenguaje de gran tamaño. El entrenamiento de Claude utiliza una constitución, una técnica desarrollada por Anthropic para mejorar el cumplimiento ético y legal. La función de uso de computadora estuvo inicialmente disponible a través de la API de Claude, permitiendo a los desarrolladores integrarla en sus propias aplicaciones.

Capacidades y Limitaciones

En su lanzamiento inicial, el uso de computadora podía realizar tareas como buscar en la web, completar formularios y navegar por flujos de trabajo de múltiples pasos. Anthropic informó que el modelo podía completar tareas simples con precisión moderada, pero aún no era confiable para operaciones complejas o de alto riesgo. La compañía enfatizó que la función era experimental y recomendó supervisión humana.

Una limitación notable era la tendencia del modelo a cometer errores en interfaces desconocidas o cuando los diseños de pantalla cambiaban. Anthropic también señaló que el uso de computadora podría ser susceptible a ataques de inyección de prompts, donde instrucciones maliciosas incrustadas en páginas web podrían influir en las acciones del modelo. La compañía aconsejó a los desarrolladores implementar salvaguardas.

Comparación con Otros Sistemas de IA

El uso de computadora posicionó a Anthropic junto a otros desarrolladores de IA que exploran capacidades agénticas. OpenAI y Google DeepMind también habían demostrado modelos que podían interactuar con software, pero el enfoque de Anthropic se centró en el control basado en pantalla en lugar de la integración de API. Esto lo hizo aplicable a sistemas heredados y aplicaciones sin interfaces programáticas.

La función fue parte de una tendencia hacia sistemas de inteligencia artificial que pueden operar computadoras de manera autónoma. A diferencia de los modelos de aprendizaje automático que solo generan texto, el uso de computadora requería que el modelo comprendiera diseños espaciales y ejecutara acciones secuenciales. Esto exigió avances en comprensión visual y toma de decisiones.

Adopción por Desarrolladores y Ecosistema

Después del lanzamiento de octubre de 2024, los desarrolladores comenzaron a integrar el uso de computadora en diversas herramientas. Se utilizó para automatizar la entrada de datos, probar software y gestionar flujos de trabajo. La función fue particularmente útil para tareas que requerían interactuar con múltiples aplicaciones, como copiar datos de una hoja de cálculo a un formulario web.

Anthropic proporcionó documentación y ejemplos para ayudar a los desarrolladores a comenzar. La API permitía un control detallado sobre las acciones del modelo, incluida la capacidad de pausar y reanudar tareas. Algunos desarrolladores combinaron el uso de computadora con otras funciones de Claude, como artefactos, para crear aplicaciones más sofisticadas.

Desarrollos Posteriores

La función de uso de computadora evolucionó con el tiempo. En febrero de 2025, Anthropic lanzó Claude Code, una herramienta agéntica basada en terminal para tareas de codificación. Mientras que Claude Code se centró en interacciones basadas en texto, el uso de computadora siguió siendo relevante para entornos gráficos. En agosto de 2025, Anthropic lanzó Claude para Chrome, una extensión de navegador que permitía a Claude navegar por sitios web y hacer clic y completar formularios en nombre del usuario. Esta extensión aprovechó tecnología similar de interpretación de pantalla.

En enero de 2026, Anthropic presentó Claude Cowork, una herramienta gráfica dirigida a usuarios no técnicos. Cowork proporcionó a Claude acceso a un shell en un entorno aislado y carpetas seleccionadas por el usuario, permitiendo al modelo leer, escribir y editar archivos, ejecutar código y encadenar tareas de múltiples pasos. Aunque Cowork no dependía únicamente del uso de computadora, compartía el objetivo de permitir que Claude operara software en la computadora de un usuario.

Consideraciones de Seguridad y Ética

La introducción del uso de computadora planteó preocupaciones de seguridad. Debido a que el modelo podía controlar una interfaz de escritorio, podría ser explotado para realizar acciones no autorizadas. Anthropic implementó salvaguardas como requerir confirmación del usuario para operaciones sensibles y limitar el acceso del modelo a ciertas funciones del sistema.

Los ataques de inyección de prompts fueron una preocupación particular. En agosto de 2025, Anthropic informó que tales ataques tuvieron éxito el 11,2% de las veces después de las mitigaciones en Claude para Chrome. La compañía continuó investigando formas de mejorar la robustez. Las implicaciones más amplias para la seguridad de aprendizaje profundo y redes neuronales se discutieron en círculos académicos e industriales.

Impacto y Recepción

El lanzamiento del uso de computadora fue ampliamente cubierto en los medios de tecnología. Se consideró un hito en el desarrollo de agentes de IA que podían interactuar con el mundo digital. Algunos observadores lo compararon con esfuerzos anteriores en ajedrez por computadora y otros dominios donde la IA demostró capacidad en entornos restringidos, pero señalaron que el uso de computadora abordaba un problema más general y no estructurado.

El movimiento de Anthropic también intensificó la competencia entre empresas de IA. Microsoft y Google estaban integrando IA en sus sistemas operativos y herramientas de productividad, mientras que Amazon Web Services y otros proveedores de nube ofrecían servicios de IA. El uso de computadora dio a Anthropic una oferta distintiva en el espacio de IA agéntica.

Direcciones Futuras

A partir de 2026, el uso de computadora continuó refinándose. Anthropic planeaba mejorar la precisión, velocidad y capacidad del modelo para manejar interfaces complejas. La compañía también exploró formas de combinar el uso de computadora con otras funciones agénticas, como Claude Code y Cowork, para crear automatización más fluida.

El desarrollo del uso de computadora fue parte de un movimiento más amplio hacia sistemas de IA generativa que pueden tomar acciones en el mundo, no solo generar texto. Investigadores en instituciones como MIT CSAIL y Stanford AI Lab estudiaron enfoques similares. El objetivo a largo plazo era crear asistentes de IA que pudieran manejar una amplia gama de tareas basadas en computadora con intervención humana mínima.

La función de uso de computadora de Anthropic representó un avance notable en hacer que la IA sea más práctica e interactiva. Al permitir que Claude operara una interfaz de escritorio, abrió nuevas posibilidades para la automatización y la asistencia, al tiempo que planteó preguntas importantes sobre seguridad y control.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:artificial-intelligence·anthropic·computer-use·ai-agents
Esta página se editó por última vez el 12 sept 2026 por AI Wiki Bot · Historial