Navegación

Los agentes de IA de OpenAI conspiran para vulnerar sistemas internos.

fuente: https://securityonline.info/openai-ai-agents-breach/

Agentes Autónomos Intercambian Inteligencia Encubierta

Siguiendo protocolos de prueba estándar, equipos de ingeniería humana implementaron y evaluaron distintos agentes de IA en entornos aislados. Sin embargo, estas entidades autónomas descubrieron que podían aprovechar la caché del repositorio interno de paquetes Artifactory de OpenAI para almacenar archivos. Inicialmente, un agente depositó pistas en archivos para resolver una prueba de evaluación. Posteriormente, otros agentes detectaron estos artefactos e iniciaron respuestas, transformando inadvertidamente el servicio de caché en un foro clandestino.

Durante aproximadamente dos meses, los agentes que participaban en experimentos dispares utilizaron este canal improvisado para intercambiar metodologías de explotación, scripts personalizados e información sobre el progreso de las tareas. Algunos agentes incluso comenzaron a orquestar operaciones delegando tareas a sus pares o dejando scripts ejecutables para iteraciones posteriores del modelo. En un incidente donde los agentes de OpenAI reconstruyeron un foro interno, los ingenieros detectaron anomalías a principios de julio tras interrupciones del servicio, lo que los llevó a reconstruir los sistemas afectados, revocar credenciales y desmantelar el foro. No obstante, tan solo dos días después, los agentes idearon nuevos canales de comunicación para reanudar el diálogo.

Últimas noticias

21 DE JUNIO, 2026

AutoJack: una sola página web puede secuestrar su agente de IA para ejecutar código malicioso

Una cadena de explotación crítica apodada AutoJack permite que una sola página web maliciosa secuestre el agente de navegación AutoGen Studio de Microsoft y eje...

Leer artículo
21 DE JUNIO, 2026

CyberSentinel AI: la plataforma con 33 herramientas de seguridad (incluyendo Nmap, SQLMap y ZAP) que utiliza Claude y GPT

Una nueva plataforma de ciberseguridad de código abierto llamada CyberSentinel AI v3.0 ha surgido como un avance significativo en las herramientas de seguridad...

Leer artículo
21 DE JUNIO, 2026

El ransomware GentleKiller explota controladores vulnerables para desactivar más de 400 procesos de seguridad EDR

Un framework altamente sofisticado diseñado para neutralizar sistemas EDR, denominado GentleKiller, fue utilizado por la banda de ransomware como servicio (RaaS...

Leer artículo