Ciberseguridad e infraestructura
Agentes que descubren y encadenan vulnerabilidades a velocidad y volumen que ningún equipo humano sostiene.
Es el único vectorVectorLa vía por la que un riesgo pasa de la pantalla al mundo: biológica, cibernética, militar, económica, política, epistémica o de pérdida de control. En este observatorio, cada vector tiene su color.Por ejemploUn ladrón puede entrar por la puerta, la ventana o el techo. El ladrón es el riesgo; la puerta, la ventana y el techo son los vectores. donde la capacidad ofensiva ya salió del entorno donde se la estaba midiendo. En julio de 2026, agentesAgente de IAUn sistema de IA que no solo responde: recibe un objetivo y actúa por su cuenta para cumplirlo, paso a paso, usando herramientas como el navegador, el correo o la terminal, sin que alguien apruebe cada paso.Por ejemploPedirle a un asistente que te recomiende vuelos es usar un chatbot. Pedirle que busque, compare, compre el pasaje y lo anote en tu calendario, todo solo, es usar un agente. de una evaluación interna de OpenAI escaparon del perímetro de red a través de un gestor de paquetes, encadenaron dos días ceroVulnerabilidad de día cero (zero-day)Una falla de seguridad en un programa que su fabricante todavía no conoce, así que no existe parche. Quien la encuentra primero puede entrar donde quiera hasta que alguien la note.Por ejemploComo descubrir que una marca de cerraduras se abre con cualquier llave antes de que el fabricante lo sepa: todas las puertas con esa cerradura quedan expuestas. de Hugging Face y comprometieron infraestructura interna en cuatro regiones [821]The Hugging Face incident and the road aheadVer fuente ↗solo copia archivada. La víctima recuperó unas 17.600 acciones en cuatro días y medio, y documenta también el límite: el atacante nunca alcanzó la base de datos del Hub ni los artefactos que la gente descarga [532]Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 IncidentVer fuente ↗.
Lo que separa a este vector de los otros es que el ciclo de ataque es verificable por el propio atacante. Un exploitExploitEl programa o la técnica concreta que aprovecha una falla de seguridad para entrar a un sistema o tomar control de él.Por ejemploSi la vulnerabilidad es una ventana mal cerrada, el exploit es la maniobra exacta para abrirla desde afuera. funciona o no funciona, y esa señal permite iterar sin supervisión humana, a diferencia del diseño biológico, que exige laboratorio. De ahí que la automatización llegara antes acá.
La capacidad medida, en cambio, es más modesta que su fama. El resultado de Fang et al. —87% de CVEs de un día— cae a 7% sin la descripción pública de la vulnerabilidad [392]LLM Agents can Autonomously Exploit One-day VulnerabilitiesVer fuente ↗. En Cybench, el techo autónomo de 2024 equivalía a once minutos de un equipo humano [1138]Cybench: A Framework for Evaluating Cybersecurity Capabilities and Risks of Language ModelsVer fuente ↗. En la campaña GTG-1002 la IA ejecutó el 80-90% del trabajo táctico, pero el humano conservó los puntos de decisión irreversible, y Anthropic señala la alucinación de credenciales como «obstáculo» para el ataque plenamente autónomo [70]Disrupting the first reported AI-orchestrated cyber espionage campaign (informe completo)Ver fuente ↗. Google no ha observado aún esas cadenas completas en el mundo real [478]GTIG AI Threat Tracker: From Prompting to Autonomy – The Evolution of Adversarial AIVer fuente ↗.
Riesgos de este vector
- ProyectadoAcceso exclusivo a capacidadesIrreversible
Un grupo pequeño obtiene capacidades decisivas que nadie más tiene, y con eso deja de necesitar el permiso de nadie.
- ProyectadoAtaque a infraestructura críticaCatastrófico
Agentes que atacan simultáneamente a operadores pequeños de energía, agua o salud, donde la seguridad es más débil y el efecto es físico.
- ObservadoDescubrimiento automatizado de días ceroCatastrófico
Encontrar vulnerabilidades desconocidas pasa a escalar con cómputo, mientras repararlas sigue escalando con personas.
- ProyectadoMalware autopropagante con modelo embebidoCatastrófico
Código que se replica llevando dentro un modelo capaz de adaptarse al entorno que encuentra, sin necesitar un servidor que lo dirija.
- ProyectadoRobo de pesos de modelos de fronteraCatastrófico
Copiar los pesos de un modelo puntero entrega su capacidad completa sin ninguna de las salvaguardas, el registro ni el control de acceso que lo acompañan.
- ProyectadoFragilidad financiera correlacionadaGrave
Miles de instituciones que deciden con los mismos modelos y los mismos datos dejan de ser miles de decisiones independientes.
- ObservadoIntrusión orquestada por agentesGrave
Un conjunto de agentes ejecuta el trabajo táctico de una intrusión -reconocimiento, explotación, movimiento lateral, exfiltración- a un ritmo que ningún equipo humano sostiene.
Ver entre los vectores →Reportar un error en esta ficha →
Fuentes
- [821] The Hugging Face incident and the road ahead · OpenAI 2026 solo copia archivada
- [532] Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident · Hugging Face 2026
- [392] LLM Agents can Autonomously Exploit One-day Vulnerabilities · Fang, Richard 2024
- [1138] Cybench: A Framework for Evaluating Cybersecurity Capabilities and Risks of Language Models · Stanford 2024
- [70] Disrupting the first reported AI-orchestrated cyber espionage campaign (informe completo) · Anthropic 2025
- [478] GTIG AI Threat Tracker: From Prompting to Autonomy – The Evolution of Adversarial AI · Google 2026