La firma de seguridad Accomplish AI reveló el 23 de julio de 2026 una vulnerabilidad crítica en Claude Cowork, la función de Anthropic que permite a Claude ejecutar tareas de forma autónoma en un entorno aislado (sandbox).
En qué consiste el fallo
Según Accomplish AI, la máquina virtual Linux que actúa como sandbox de Cowork puede ser evadida con un solo mensaje. Una vez fuera del entorno aislado, el agente obtiene acceso de lectura y escritura completo al sistema de archivos del Mac anfitrión, incluyendo:
- Claves SSH
- Credenciales de servicios en la nube
- Cualquier archivo del sistema del usuario
Por qué es grave
El sandbox existe precisamente para evitar que un agente de IA autónomo pueda salirse de su entorno controlado y afectar al sistema real del usuario. Si la evasión es tan sencilla como un solo mensaje, cualquier usuario que ejecute Cowork con datos sensibles en su máquina podría estar expuesto sin saberlo.
Qué hacer mientras tanto
Anthropic no ha confirmado públicamente un parche en el momento de esta publicación. Hasta que se confirme una solución oficial, se recomienda:
- Evitar ejecutar Claude Cowork en máquinas con credenciales sensibles (claves SSH, tokens de API, accesos cloud) sin aislamiento adicional
- Usar una máquina virtual o entorno separado dedicado exclusivamente a probar agentes autónomos
- Estar atento a los anuncios oficiales de Anthropic sobre esta vulnerabilidad
Contexto más amplio
Este tipo de fallos de seguridad en agentes de IA autónomos se ha vuelto más frecuente a medida que estas herramientas ganan capacidad de ejecutar acciones reales en el sistema del usuario (no solo generar texto). Es un recordatorio de que el modo agente, aunque muy potente, todavía tiene puntos débiles de seguridad que conviene vigilar de cerca.