No solo los modelos de OpenAI se descontrolaron. Claude Cowork pudo leer archivos en Mac a los que no debería haber tenido acceso

  • Expertos en seguridad demostraron que la herramienta de IA Claude Cowork logró escapar de su entorno aislado en Mac
  • Así, el agente accedió a archivos privados en toda la cuenta de usuario, incluyendo claves de acceso y contraseñas de la nube
  • Esto sigue a un caso reciente en el que dos modelos de OpenAI escaparon del laboratorio

Sdílejte:
Adam Kurfürst
Adam Kurfürst
28. 7. 2026 18:00
Claude Fable 5 a model Mythos od společnosti Anthropic

Hace unos días escribimos sobre cómo OpenAI perdió el control de sus modelos durante una prueba y estos irrumpieron en una empresa externa. Ahora resulta que una debilidad similar no solo afecta a la competencia: la empresa de seguridad Accomplish demostró que incluso Claude Cowork de Anthropic logró eludir su propia «caja de arena» y acceder a archivos que deberían haber estado completamente fuera de su alcance.

Un asistente inteligente escapó de un entorno aislado

Claude Cowork es un asistente de inteligencia artificial de la empresa Anthropic que realiza tareas por usted en el ordenador: revisa una carpeta, modifica archivos, busca algo. Para evitar daños, se ejecuta en un entorno aislado propio (técnicamente un sandbox, es decir, una especie de «caja de arena») y solo debería ver la única carpeta que usted le proporcione.

Sin embargo, precisamente este límite fue superado. Investigadores de la empresa Accomplish iniciaron una nueva sesión, compartieron una carpeta con el agente y le enviaron un único mensaje corto. «Observamos cómo el agente escapó del sandbox», describió uno de ellos, Oren Yomtov. En lugar de permanecer en el espacio delimitado, se extendió a los archivos de toda la cuenta.

El agente pudo acceder a datos sensibles

Una vez que el agente estuvo fuera del sandbox, pudo leer y sobrescribir archivos en cualquier parte de la cuenta, incluso donde un programa normal no debería sin permiso. Entre lo que pudo leer se encontraban claves de inicio de sesión y credenciales de acceso a servicios en la nube, es decir, exactamente esos datos sensibles con los que un atacante potencial podría causar el mayor daño.

Según los investigadores, el problema afectó a aproximadamente medio millón de personas que ejecutaban Cowork directamente en su Mac. Cabe añadir que no se trató de un ataque real desde el exterior, sino de una demostración controlada por expertos en seguridad que describieron y reportaron la vulnerabilidad. Sin embargo, el riesgo era completamente real.

¿Cómo reaccionó Anthropic?

Según los investigadores, la empresa cerró el informe como «informativo» sin emitir una corrección directa. Sin embargo, las versiones más recientes de Cowork, por defecto, se ejecutan en la nube, no directamente en su ordenador, lo que evita la vía de escape desde Mac. Pero quien active conscientemente la ejecución directamente en el dispositivo, según los expertos, sigue expuesto al riesgo.

Detrás de ambos casos, los modelos de OpenAI que escaparon y este error en Cowork, se encuentra el mismo patrón. Estamos dando a la inteligencia artificial cada vez más autonomía y acceso a nuestros datos, pero las barreras destinadas a mantenerla dentro de los límites aún no son tan sólidas como parecen a primera vista.

¿Dejaría que un asistente de IA acceda a los archivos directamente en su ordenador?

Fuentes: Accomplish, The Hacker News, TechRadar

Sobre el autor

Adam Kurfürst

Adam studuje na gymnáziu a technologické žurnalistice se věnuje od svých 14 let. Pakliže pomineme jeho vášeň pro chytré telefony, tablety a příslušenství, rád se… Más sobre el autor

Adam Kurfürst
Sdílejte: