Navegación

545 hackers lo probaron primero. Ahora XRanges para IA evalúa a tu agente de seguridad.

fuente: https://thehackernews.com/2026/09/545-hackers-tested-it-first-now-xranges.html

Los agentes de seguridad autónomos están mejorando en la detección de vulnerabilidades. Sin embargo, nadie tiene una forma precisa de medir su eficacia. Basta con apuntar a un objetivo realista y el resultado es un informe que el agente ha redactado sobre sí mismo: una prosa convincente, una lista de hallazgos y ninguna manera de determinar cuáles de ellos ocurrieron. Un experto en seguridad se sienta entonces a comprobar cada afirmación comparándola con el objetivo. ¿Qué hallazgos son reales, cuáles son duplicados, cuáles son invenciones y, la pregunta para la que nadie tiene tiempo, qué no intentó el agente? Eso supone un día entero de trabajo de un experto para una sola ejecución. Multiplíquelo por tres modelos, cuatro variantes de indicaciones y diez repeticiones, y la cola de revisión será más larga que el experimento.

XRanges for AI, desarrollado por CTF.ae, existe para solucionar este problema. Implementa aplicaciones objetivo realistas con instrumentación integrada en cada servicio, registra la actividad real del agente dentro de ellas y evalúa cada ejecución en tiempo real mediante cuatro señales independientes. Este tutorial explica su funcionamiento, cómo es una ejecución desde la implementación hasta la comparación, y dónde se ha sometido a pruebas de estrés.

Últimas noticias

29 DE SEPTIEMBRE, 2026

Roban dos remolques con logos de NVIDIA y PlusAI pensando que era un cargamento millonario: solo encontraron arena.

Unos ladrones robaron dos remolques de NVIDIA y PlusAI esperando encontrar un cargamento millonario, pero solo contenían arena. NVIDIA ha visto cómo dos remolqu...

Leer artículo →
29 DE SEPTIEMBRE, 2026

Los hackers utilizan NeedyMantis para mantener el acceso a largo plazo en redes comprometidas.

Según un análisis técnico de Microsoft, los hackers han utilizado una familia de malware llamada NeedyMantis para mantener el acceso a largo plazo a redes que y...

Leer artículo →
29 DE SEPTIEMBRE, 2026

Vulnerabilidades críticas de LXD permiten a los usuarios de contenedores escribir archivos como root en el host.

Canonical ha corregido tres vulnerabilidades críticas de LXD con una calificación CVSS de 9.6 a 9.9. Cada una permite que un usuario con privilegios limitados o...

Leer artículo →