Anthropic habilitó a Claude para hacer clic, escribir, navegar y tomar capturas de pantalla en aplicaciones de macOS mientras el usuario continúa trabajando. La función, disponible para suscriptores Pro y Max, muestra el potencial de los agentes de IA, aunque también expone límites de velocidad, permisos y compatibilidad.
***
- Claude puede controlar aplicaciones de macOS mediante clics, teclado y capturas de pantalla mientras opera en ventanas separadas.
- La función está disponible en macOS 15 o posterior para suscriptores individuales de los planes Pro y Max.
- Anthropic advierte que Claude es más lento que una persona en tareas complejas y mantiene controles de permiso para reducir riesgos.
Anthropic amplió las capacidades de Claude para que el asistente pueda controlar aplicaciones de escritorio en macOS mientras el usuario continúa trabajando en primer plano. La herramienta puede hacer clic con el ratón, introducir texto, navegar por ventanas y tomar capturas de pantalla, una combinación que acerca el software a la idea de un agente capaz de ejecutar tareas, no solo de conversar sobre ellas. El lanzamiento está dirigido inicialmente a suscriptores individuales de pago mediante la aplicación Claude Desktop.
La función opera en macOS 15, conocido como Sequoia, y en versiones posteriores, con el modo de segundo plano activado por defecto. En lugar de tomar el control del ratón y del teclado que utiliza la persona, Claude trabaja dentro de ventanas separadas, lo que permite mantener otras actividades abiertas en el mismo equipo. La propuesta busca resolver una tensión central de los agentes de escritorio: automatizar procesos sin bloquear por completo al usuario, detalla Cryptobriefing.
Cómo trabaja Claude dentro del Mac
Cuando una aplicación ofrece conectores de API, esos canales pueden facilitar una integración más directa entre el programa y el asistente. Sin embargo, muchas herramientas de escritorio no fueron diseñadas para comunicarse con sistemas de inteligencia artificial, por lo que Claude utiliza una alternativa basada en la observación de la pantalla y la simulación de entradas. El sistema captura lo que aparece, identifica los elementos relevantes y decide dónde hacer clic o qué campo debe recibir una respuesta.
Ese método reproduce, en términos generales, la forma en que una persona interactúa con un programa que no cuenta con una integración específica. Claude puede leer botones, menús y formularios a partir de la imagen disponible, planificar una secuencia y ejecutar las acciones paso a paso. La ventaja es que la automatización no depende de que cada aplicación publique una API, aunque la dependencia de capturas y entradas simuladas también puede volver el proceso más lento y vulnerable a cambios en la interfaz.
La nueva capacidad se integra en dos contextos dentro del ecosistema de Anthropic. Claude Cowork está orientado a tareas generales de productividad, mientras Claude Code se concentra en flujos de trabajo relacionados con el desarrollo de software; ambos utilizan la misma arquitectura subyacente de control de computadora, pero ajustada a objetivos distintos.
Anthropic también ofrece Dispatch, una función móvil que permite asignar tareas de forma remota desde el teléfono. El usuario puede iniciar un trabajo fuera de su escritorio y dejar que Claude lo ejecute en el Mac, una posibilidad que extiende el concepto de automatización desde la ventana de conversación hacia actividades que antes exigían presencia física frente al equipo.
Permisos, límites y protección del usuario
Claude no recibe autorización ilimitada desde el primer momento. Antes de que realice acciones durante la primera tarea de cada sesión, el sistema solicita el permiso explícito del usuario, mientras que determinadas operaciones sensibles activan avisos de privacidad adicionales. Estas barreras intentan conservar una decisión humana visible antes de que el asistente actúe sobre aplicaciones y datos del computador.
Los permisos a nivel de aplicación ofrecen un control más granular sobre los programas que Claude puede utilizar. En la práctica, esa configuración permite limitar el alcance del agente y evitar que interactúe con determinadas herramientas, una medida relevante porque el control de pantalla puede exponer información, modificar documentos o enviar respuestas si la automatización se ejecuta sin una supervisión adecuada.
El despliegue inicial está restringido a los planes individuales Pro y Max, por lo que los clientes de Team y Enterprise todavía no tienen acceso a esta función. Anthropic no ha anunciado un cronograma para ampliar el acceso a esos niveles, una ausencia que deja abierta la pregunta sobre cuándo las organizaciones podrán evaluar formalmente el sistema en entornos compartidos y con políticas corporativas.
La propia empresa reconoce una limitación importante: Claude es más lento que un humano cuando enfrenta tareas complejas en el escritorio. Su comportamiento metódico exige leer la pantalla, interpretar el contexto, planificar la siguiente acción y ejecutarla con cautela, una secuencia que puede aportar control, pero que reduce la velocidad frente a una persona familiarizada con el programa.
De la prueba de concepto al producto
El lanzamiento representa una evolución de una capacidad que Anthropic introdujo inicialmente en forma beta en octubre de 2024. Aquella versión llegó como parte de la Computer Use API, incluida con Claude 3.5 Sonnet, y estaba dirigida sobre todo a desarrolladores interesados en experimentar con flujos de trabajo agénticos y automatizaciones capaces de interactuar con interfaces digitales.
La diferencia principal ahora está en el destino de la herramienta. En sus primeras etapas, el control de computadora funcionaba principalmente como una demostración técnica para quienes construían aplicaciones alrededor del modelo; con Claude Desktop, la interacción se presenta de manera más directa a usuarios de pago que desean delegar tareas en su propio entorno de macOS.
Ese paso no elimina las restricciones técnicas ni convierte al asistente en un sustituto general del trabajo humano. La herramienta parece más adecuada para procesos repetitivos, de alto volumen o con una secuencia relativamente predecible, mientras que las labores que requieren reacción inmediata, criterio contextual o cambios constantes de objetivo pueden seguir siendo poco eficientes.
El modo de segundo plano también tiene una frontera concreta: Claude no puede interactuar con aquello que el usuario está utilizando activamente en el primer plano. El agente queda limitado a sus propias ventanas, de modo que la separación protege la sesión de trabajo principal, pero al mismo tiempo reduce el conjunto de tareas que puede completar sin intervención adicional.
La carrera por los agentes de inteligencia artificial
La iniciativa coloca a Anthropic en una competencia más amplia por desarrollar agentes capaces de ejecutar instrucciones en computadoras reales. El atractivo de estos sistemas no reside únicamente en responder preguntas, sino en convertir una orden escrita en una serie de acciones sobre programas, archivos y formularios, un cambio que puede modificar la manera en que los usuarios entienden la automatización.
Para los usuarios, el beneficio potencial está en delegar labores que consumen tiempo sin exigir creatividad constante. Claude podría encargarse de secuencias repetitivas dentro de aplicaciones que no poseen integraciones modernas, aunque la utilidad final dependerá de su precisión, de la estabilidad de las interfaces y de la capacidad del usuario para revisar los resultados antes de que una acción tenga consecuencias.
La velocidad seguirá siendo un factor decisivo para medir la adopción. Un agente que interpreta cada pantalla y ejecuta cada clic con cautela puede ser valioso en tareas prolongadas, pero pierde atractivo cuando una persona puede completar el mismo proceso en pocos segundos; por eso, el lanzamiento parece más cercano a una herramienta de productividad supervisada que a una sustitución inmediata de los flujos laborales.
La disponibilidad también marca el alcance actual del producto. Solo los suscriptores individuales Pro y Max en macOS 15 o posterior pueden utilizar esta función, mientras Team y Enterprise permanecen fuera del despliegue inicial; Anthropic deberá demostrar seguridad, confiabilidad y eficiencia antes de que el control de computadora pueda convertirse en una opción normal para organizaciones.
Con este avance, Claude deja de limitarse a describir cómo realizar una tarea y empieza a ejecutarla dentro de un entorno de escritorio, aunque todavía con límites visibles. La combinación de acciones en segundo plano, permisos explícitos y supervisión humana ofrece una visión más concreta del futuro de los agentes, pero también recuerda que la autonomía útil dependerá tanto de la inteligencia del modelo como de su prudencia operativa.
Imagen original de DiarioBitcoin, creada con inteligencia artificial, de uso libre, licenciada bajo Dominio Público.
Este artículo fue escrito por un redactor de contenido de IA y revisado por un editor humano para garantizar calidad y precisión.
ADVERTENCIA: DiarioBitcoin ofrece contenido informativo y educativo sobre diversos temas, incluyendo criptomonedas, IA, tecnología y regulaciones. No brindamos asesoramiento financiero. Las inversiones en criptoactivos son de alto riesgo y pueden no ser adecuadas para todos. Investigue, consulte a un experto y verifique la legislación aplicable antes de invertir. Podría perder todo su capital.
Suscríbete a nuestro boletín
Artículos Relacionados
Curiosidades
Tres cualidades laborales que podrían proteger tu cerebro del deterioro cognitivo
Juegos
Take-Two estrecha la búsqueda de los responsables de la filtración de GTA VI
Empresas
NVIDIA y Equinix apuestan por la inferencia de IA: qué significa para NVDA y EQIX
China