Ciberseguridad e infraestructura
Descubrimiento automatizado de días cero
Encontrar vulnerabilidades desconocidas pasa a escalar con cómputo, mientras repararlas sigue escalando con personas.
- Severidad
- Catastrófico
- Horizonte
- 1–3 años
- Evidencia
- Observado
- Consenso
- Medio
Un día ceroVulnerabilidad de día cero (zero-day)Una falla de seguridad en un programa que su fabricante todavía no conoce, así que no existe parche. Quien la encuentra primero puede entrar donde quiera hasta que alguien la note.Por ejemploComo descubrir que una marca de cerraduras se abre con cualquier llave antes de que el fabricante lo sepa: todas las puertas con esa cerradura quedan expuestas. es una vulnerabilidad que nadie ha reportado todavía. Encontrarlas era caro y escaso; el riesgo es que deje de serlo mientras arreglarlas siga costando lo mismo.
El lado del hallazgo está documentado en software real. Project Glasswing reportó al 22 de mayo de 2026 23.019 vulnerabilidades identificadas en software abierto; de las 1.752 evaluadas hasta esa fecha, 1.587 resultaron verdaderos positivos (90,6%) [79]Project Glasswing: An initial updateVer fuente ↗. Google atribuye a Big Sleep las primeras veinte vulnerabilidades halladas en software abierto y, antes, CVE-2025-6965 en SQLite, un bug que según la empresa solo conocían actores maliciosos [460]Google's latest AI security announcementsVer fuente ↗. OpenAI reporta que con GPT-5.6-Cyber encontró en V8 dos vulnerabilidades encadenables que Google parcheó como CVE-2026-15903, y aclara que ese modelo no intervino en el incidente de Hugging Face [822]Expanding Daybreak as the Cyber Defense Window NarrowsVer fuente ↗solo copia archivada. Que la capacidad se use ofensivamente tampoco es hipótesis: el 11 de julio de 2026 unos agentesAgente de IAUn sistema de IA que no solo responde: recibe un objetivo y actúa por su cuenta para cumplirlo, paso a paso, usando herramientas como el navegador, el correo o la terminal, sin que alguien apruebe cada paso.Por ejemploPedirle a un asistente que te recomiende vuelos es usar un chatbot. Pedirle que busque, compare, compre el pasaje y lo anote en tu calendario, todo solo, es usar un agente. explotaron dos días cero de Hugging Face hasta obtener ejecución de comandos [821]The Hugging Face incident and the road aheadVer fuente ↗solo copia archivada.
El cuello de botella lo nombra la misma empresa que publica el inventario: reparar depende de la capacidad humana de triar, reportar y desplegar. De aquellas 23.019, había 75 parcheadas [79]Project Glasswing: An initial updateVer fuente ↗.
Lo que esto no demuestra. No hay evidencia de que el saldo neto favorezca al atacante. Andrew Lohn revisó 57 proposiciones sobre el balance ofensa-defensa y concluye que el dominio es demasiado multifacético para una respuesta única [647]The Impact of AI on the Cyber Offense-Defense Balance and the Character of Cyber ConflictVer fuente ↗; Schneier afina el criterio: la ventaja depende de si el sistema es parcheable y el hallazgo verificable [942]What Anthropic's Mythos Means for the Future of CybersecurityVer fuente ↗. Conviene además no apoyarse en la cita más repetida: el 87% de Fang et al. es sobre n = 15 vulnerabilidades y con la descripción del CVE entregada; sin ella cae a 7%, y lo que mide es implementación, no descubrimiento [392]LLM Agents can Autonomously Exploit One-day VulnerabilitiesVer fuente ↗.
Cadena de materialización
PrecondiciónObservado
El hallazgo ya ocurre a escala industrial en software real
Project Glasswing reportó 23.019 vulnerabilidades identificadas en software abierto, con 1.587 verdaderos positivos de las 1.752 evaluadas (90,6%). Google atribuye a Big Sleep el hallazgo de CVE-2025-6965 en SQLite, que según la empresa solo conocían actores maliciosos.
Precedentes: Big Sleep reporta sus primeras veinte vulnerabilidades en software abierto · OpenAI amplía Daybreak y publica una variante entrenada para investigación de vulnerabilidades
DetonanteObservado
El mismo sistema que encuentra, explota, contra un tercero real
El 11 de julio de 2026, agentes explotaron dos días cero distintos de Hugging Face -uno en el procesamiento de archivos HDF5 y otro de inyección de plantillas- hasta obtener ejecución de comandos. No fue un ejercicio ni una demostración.
Precedentes: Agentes de una evaluación de OpenAI comprometen la infraestructura de Hugging Face
Hasta aquí llega lo observado o demostrado. Lo que sigue es proyección.
CascadaProyectado
La remediación no acompaña, y la ventana se abre
De aquel inventario, a mayo de 2026 había 530 bugs de gravedad alta o crítica reportados a mantenedores y 75 parcheados. Anthropic nombra el cuello de botella: la capacidad humana de triar, reportar y desplegar parches. Que la asimetría se convierta en explotación masiva es extrapolación.
ImpactoEspeculativo
El supuesto de que hay tiempo para parchear deja de valer
Schneier sostiene que el supuesto que se cae es temporal, no técnico, y que la ventaja depende de si el sistema es parcheable. Nadie ha medido el saldo neto entre lo que la capacidad arregla y lo que rompe.
Escenarios donde aparece
Ver en el mapa →Reportar un error en esta ficha →
Fuentes
- [79] Project Glasswing: An initial update · Anthropic 2026
- [460] Google's latest AI security announcements · Google 2025
- [822] Expanding Daybreak as the Cyber Defense Window Narrows · OpenAI 2026 solo copia archivada
- [821] The Hugging Face incident and the road ahead · OpenAI 2026 solo copia archivada
- [532] Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident · Hugging Face 2026
- [392] LLM Agents can Autonomously Exploit One-day Vulnerabilities · Fang, Richard 2024
- [1138] Cybench: A Framework for Evaluating Cybersecurity Capabilities and Risks of Language Models · Stanford 2024
- [942] What Anthropic's Mythos Means for the Future of Cybersecurity · Schneier, Bruce 2026
- [941] Autonomous AI Hacking and the Future of Cybersecurity · Schneier, Bruce 2025
- [647] The Impact of AI on the Cyber Offense-Defense Balance and the Character of Cyber Conflict · Lohn, Andrew J. 2025
- [765] Uplifted Attackers, Human Defenders: The Cyber Offense-Defense Balance for Trailing-Edge Organizations · Murphy, Benjamin 2025