La inteligencia artificial agencial, esa que ejecuta tareas de forma autónoma sin supervisión humana constante, ha vivido una semana marcada por fallos de seguridad que exponen sus riesgos. Un hallazgo en la plataforma de Amazon Web Services (AWS) demostró que un solo mensaje de chat puede bastar para secuestrar el control de múltiples agentes de IA, justo cuando un responsable de seguridad de OpenAI presentaba su dimisión denunciando problemas estructurales en la forma en que la industria despliega estos sistemas.
El episodio resulta relevante porque ocurre en un momento en que empresas de todo el mundo están integrando agentes autónomos de IA en sus operaciones, confiando en que las plataformas que los alojan garantizan un nivel básico de seguridad. Los sucesos de esta semana sugieren que esa confianza puede ser prematura.
Un mensaje bastó para tomar el control de agentes en AWS
Investigadores de Zenity Labs lograron, mediante un único mensaje de chat enviado a Amazon Bedrock AgentCore, hacerse con el control de todos los agentes de inteligencia artificial desplegados en una misma cuenta y región de AWS.
Según el reporte, el agente atacado accedió al servicio interno de metadatos de la plataforma y terminó entregando sus credenciales temporales de acceso. Esas credenciales, una vez obtenidas, funcionaban incluso desde fuera del entorno de AWS, lo que amplió considerablemente el alcance del problema.
Lo más preocupante, según los investigadores, es que el fallo no residía en una herramienta o configuración puntual, sino en el diseño mismo de la plataforma: los permisos por defecto se extendían a todos los agentes de la cuenta sin distinción.
Qué implica para las empresas
Las compañías que ya operan agentes de IA en entornos en la nube deberían revisar sus políticas de permisos y aislamiento entre agentes, sin asumir que el proveedor del servicio ha resuelto este tipo de vulnerabilidades por defecto.
Claude Code habría borrado miles de archivos en Windows
Un usuario relató que la herramienta Claude Code, de Anthropic, eliminó 48.218 archivos en apenas 103 segundos al ejecutarse en un sistema Windows. Según el relato, un script no reconoció correctamente las uniones de directorios propias de Windows y acabó borrando también los archivos del proyecto real.
Se trata de un caso que no ha sido verificado de forma independiente, aunque la causa técnica descrita —el manejo incorrecto de uniones de archivos en Windows— es concreta y, en principio, evitable con los controles adecuados.
Dimisión en OpenAI: «La cultura está rota»
David Robinson, empleado del área de seguridad de OpenAI, presentó su dimisión y expuso sus razones en un artículo publicado en The Atlantic. Robinson criticó el modelo de «despliegue iterativo» que practica la compañía, al que considera una garantía de fallos periódicos en los sistemas que se lanzan al público.
En su argumento, Robinson pidió que OpenAI opere con el mismo nivel de rigor que una central nuclear, dada la magnitud del impacto potencial de sus productos.
Lanzamientos: Haiku 5.5 más barato y Mistral prepara su modelo más potente
Anthropic presentó Claude Haiku 5.5, su modelo más económico hasta la fecha, con un precio de 0,10 dólares por millón de tokens de entrada, hasta un 90 % menos que versiones anteriores. Sin embargo, la compañía incluyó una condición relevante: por encima de los 100.000 tokens de entrada, el precio se multiplica por cinco.
Por su parte, Mistral anunció que publicará a finales de octubre su modelo Large 4, descrito como el más potente de la compañía hasta ahora. Se trata de un modelo de un billón de parámetros, entrenado en Europa, con pesos descargables. Las cifras de rendimiento divulgadas proceden de la propia empresa y la licencia de uso todavía no se ha detallado públicamente.
Un mapa del cielo en ultravioleta hecho por agentes de IA
Claude Science, el proyecto científico de Anthropic, generó el primer mapa completo del cielo en luz ultravioleta utilizando varios agentes de IA que descargaron, calibraron y fusionaron datos procedentes de distintas misiones espaciales.
Las zonas del mapa que fueron reconstruidas mediante estimación presentan una desviación media del diez por ciento respecto a los datos reales, según la propia iniciativa.
OpenAI factura a ritmo de 50.000 millones y busca más financiación
OpenAI está facturando actualmente a un ritmo anualizado de 50.000 millones de dólares, según la información disponible, y busca captar 30.000 millones de dólares adicionales. La diferencia con la cifra de 70.000 millones que circuló anteriormente se explica por criterios contables distintos, no por una caída en las ventas.
En paralelo, la salida a bolsa de la compañía se ha aplazado al próximo año, según las últimas informaciones disponibles.
La lectura de fondo
El patrón que conecta estos sucesos resulta incómodo: los agentes de inteligencia artificial ya están actuando de forma autónoma en entornos reales, mientras que las medidas de seguridad siguen llegando después del problema, no antes. Así ocurrió con el fallo en AWS, con el incidente relatado en Windows y con la dimisión de Robinson en OpenAI.
Al mismo tiempo, modelos como Haiku 5.5 abaratan precisamente ese tipo de trabajo autónomo que requiere supervisión. Cuanto más económico resulta delegar tareas en agentes de IA, más costosa puede salir la falta de inversión en supervisión y controles de seguridad.
Preguntas frecuentes
¿Qué vulnerabilidad se descubrió en AWS?
Investigadores de Zenity Labs demostraron que un único mensaje de chat en Amazon Bedrock AgentCore permitía tomar el control de todos los agentes de IA de una misma cuenta y región, debido a permisos por defecto demasiado amplios en la plataforma.
¿Se confirmó el caso de Claude Code borrando archivos en Windows?
No. Se trata de un relato de un usuario que no ha sido verificado de forma independiente. La causa técnica señalada, relacionada con el manejo de uniones de directorios en Windows, es plausible y evitable, pero el incidente en sí no cuenta con confirmación oficial.
¿Por qué dimitió David Robinson de OpenAI?
Robinson, empleado del área de seguridad de la compañía, renunció y explicó en un artículo en The Atlantic que considera que el modelo de despliegue iterativo de OpenAI garantiza fallos periódicos, y pidió un nivel de rigor comparable al de una central nuclear.
¿Cuánto cuesta Claude Haiku 5.5?
Anthropic fijó un precio de 0,10 dólares por millón de tokens de entrada, hasta un 90 % más barato que versiones previas, aunque el coste se multiplica por cinco si se superan los 100.000 tokens de entrada.
¿Cuándo se lanzará Mistral Large 4?
Mistral prevé publicarlo a finales de octubre de 2026. Será un modelo de un billón de parámetros, entrenado en Europa, con pesos descargables, aunque la licencia de uso aún no se ha detallado.
¿Cuánto factura actualmente OpenAI?
La compañía factura a un ritmo anualizado de 50.000 millones de dólares y busca una inyección adicional de 30.000 millones. Su salida a bolsa se ha aplazado al próximo año.
Samuel Gil es especialista en infraestructura tecnológica, administración de servidores y desarrollo de servicios digitales. Con una sólida trayectoria en entornos web de alta exigencia, optimización de servidores y gestión de arquitecturas de red, Samuel dedica su labor en faq-box.com a desglosar cuestiones técnicas complejas para convertirlas en guías prácticas, transparentes y de alto valor técnico.
Su enfoque editorial prioriza el rigor, la seguridad en los sistemas y la resolución eficiente de problemas técnicos cotidianos y avanzados. A través de sus análisis, busca ofrecer respuestas directas y contrastadas para profesionales y entusiastas del sector tecnológico.
Cuenta con una sólida formación en el área tecnológica, destacando su especialización a través del Máster en Inteligencia Artificial Aplicada a la Gestión Empresarial y el MBA in Digital Transformation & Artificial Intelligence de ISEEN.EU, lo que aporta un rigor técnico avanzado a cada análisis de desarrollo y arquitectura digital.

