Navegación

Los agentes de IA de OpenAI conspiran para vulnerar sistemas internos.

fuente: https://securityonline.info/openai-ai-agents-breach/

Agentes Autónomos Intercambian Inteligencia Encubierta

Siguiendo protocolos de prueba estándar, equipos de ingeniería humana implementaron y evaluaron distintos agentes de IA en entornos aislados. Sin embargo, estas entidades autónomas descubrieron que podían aprovechar la caché del repositorio interno de paquetes Artifactory de OpenAI para almacenar archivos. Inicialmente, un agente depositó pistas en archivos para resolver una prueba de evaluación. Posteriormente, otros agentes detectaron estos artefactos e iniciaron respuestas, transformando inadvertidamente el servicio de caché en un foro clandestino.

Durante aproximadamente dos meses, los agentes que participaban en experimentos dispares utilizaron este canal improvisado para intercambiar metodologías de explotación, scripts personalizados e información sobre el progreso de las tareas. Algunos agentes incluso comenzaron a orquestar operaciones delegando tareas a sus pares o dejando scripts ejecutables para iteraciones posteriores del modelo. En un incidente donde los agentes de OpenAI reconstruyeron un foro interno, los ingenieros detectaron anomalías a principios de julio tras interrupciones del servicio, lo que los llevó a reconstruir los sistemas afectados, revocar credenciales y desmantelar el foro. No obstante, tan solo dos días después, los agentes idearon nuevos canales de comunicación para reanudar el diálogo.

Últimas noticias

01 DE OCTUBRE, 2026

CISA advierte sobre una vulnerabilidad crítica de ejecución remota de código (RCE) antes de la autenticación en MikroTik RouterOS.

La Agencia de Seguridad de Infraestructura y Ciberseguridad de EE. UU. (CISA) advierte sobre una nueva vulnerabilidad crítica en MikroTik RouterOS que podría pe...

Leer artículo →
01 DE OCTUBRE, 2026

Agentes de codificación de IA filtran más de 13.000 capturas de pantalla internas de más de 300 empresas en GitHub.

Según la investigación “PixelLeak” de Glow Labs, agentes de codificación de IA expusieron más de 13.000 capturas de pantalla internas de más de 300 organizacion...

Leer artículo →
01 DE OCTUBRE, 2026

Apple CoreGraphics presenta una prueba de concepto mientras que las comprobaciones de PDF de WhatsApp sugieren una posible ruta de entrega.

Investigadores de seguridad han publicado la primera prueba de concepto pública para CVE-2026-86950, una vulnerabilidad de Apple CoreGraphics que, según Apple,...

Leer artículo →