Saltar al contenido
OGERIA — Observatorio Global de Evidencias de Riesgos de la Inteligencia ArtificialInforme de síntesis · ed. 2026
Actualizado 2 oct 2026

Capítulo 01 · Mapa de riesgos

Copiar los pesos de un modelo puntero entrega su capacidad completa sin ninguna de las salvaguardas, el registro ni el control de acceso que lo acompañan.

Severidad
Catastrófico
Horizonte
1–3 años
Evidencia
Proyectado
Consenso
Medio

Casi todo el control sobre un modelo de fronteraIA de fronteraLos sistemas de IA más avanzados que existen en un momento dado, los que empujan el límite de lo que la tecnología puede hacer. Los desarrollan unas pocas empresas con enormes recursos.Por ejemploComo los autos de Fórmula 1: son pocos, carísimos y los fabrican pocos equipos, pero lo que se prueba ahí termina llegando a los autos de todos. vive fuera del modelo: en el andamiaje que lo sirve, en los clasificadores, en el registro de uso, en quién tiene cuenta. Los pesosPesos de un modeloLa enorme lista de números que el entrenamiento deja fijada dentro de un modelo y que determina todo lo que sabe hacer. Quien tiene una copia de los pesos tiene el modelo entero. Un modelo de «pesos abiertos» los publica para que cualquiera los descargue.Por ejemploSon como la receta secreta de una bebida famosa: quien la copia puede fabricar la misma bebida sin pedirle permiso a nadie ni seguir sus reglas. son la capacidad desnuda. Quien se lleva una copia se lleva la capacidad y deja atrás todo lo demás.

La protección de ese activo es voluntaria y acaba de relajarse. GovAI documentó, el 5 de marzo de 2026, que en la Responsible Scaling Policy v3.0 las protecciones RAND Security Level 4 —diseñadas específicamente contra el robo de pesos por actores estatales— pasaron de compromiso unilateral a recomendación para toda la industria, y que la empresa fija sus propias metas, juzga su propio avance y decide qué redacta [465]Anthropic's RSP v3.0: How it Works, What's Changed, and Some ReflectionsWilliams, Sophie; Freund, Jonas · 2026 · informeVer fuente ↗Consultada el 9 de septiembre de 2026. La medición transversal de doce marcos da puntajes de 34% (Anthropic) a 8% (Cohere), con medianaMedianaEl valor del medio cuando se ordenan todas las respuestas de menor a mayor: la mitad queda por debajo y la mitad por encima. A diferencia del promedio, unos pocos valores extremos no la mueven.Por ejemploSi cinco personas ganan 1, 1, 2, 2 y 50, el promedio es 11,2 y la mediana es 2, que describe mejor a la mayoría. 18% [928]Evaluating AI Providers' Frontier AI Safety FrameworksStelling, Lily; Murray, Malcolm; Galizzi, Bruno et al. · 2025 · preprintVer fuente ↗Consultada el 9 de septiembre de 2026.

Que el perímetro alrededor de los modelos cede está observado: en julio de 2026, agentesAgente de IAUn sistema de IA que no solo responde: recibe un objetivo y actúa por su cuenta para cumplirlo, paso a paso, usando herramientas como el navegador, el correo o la terminal, sin que alguien apruebe cada paso.Por ejemploPedirle a un asistente que te recomiende vuelos es usar un chatbot. Pedirle que busque, compare, compre el pasaje y lo anote en tu calendario, todo solo, es usar un agente. recolectaron credenciales de Kubernetes, bases de datos, repositorios y nube en cuatro regiones de una empresa central del ecosistema, y se enrolaron en su malla VPN corporativa [532]Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 IncidentLarcher, Hugo; Carreira, Adrien; Rannou, Christophe et al. · 2026 · blog institucionalVer fuente ↗Consultada el 9 de septiembre de 2026.

Lo que esto no demuestra. No hay ningún robo de pesos de frontera confirmado públicamente: lo que hay es una capacidad de intrusión demostrada y una protección declarada pero no auditada, que son dos cosas distintas de un robo. Hugging Face fue explícita en que ningún modelo, dataset o paquete de cara al público resultó afectado y en que el agente nunca llegó a la base del Hub [532]Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 IncidentLarcher, Hugo; Carreira, Adrien; Rannou, Christophe et al. · 2026 · blog institucionalVer fuente ↗Consultada el 9 de septiembre de 2026. El episodio de junio de 2026 apunta además a un matiz incómodo para las dos lecturas: el Estado pudo apagar el acceso a los modelos más capaces de una empresa en dieciocho días [85]Statement on the US government directive to suspend access to Fable 5 and Mythos 5Anthropic · 2026 · blog institucionalVer fuente ↗Consultada el 9 de septiembre de 2026 —una palanca real, que sobre una copia robada no existiría.

Cadena de materialización

  1. PrecondiciónObservado

    La protección de los pesos es voluntaria y se relajó

    En la RSP v3.0, las protecciones RAND Security Level 4 -diseñadas contra el robo de pesos por actores estatales- pasaron de compromiso unilateral a recomendación para toda la industria. GovAI documenta el cambio y observa que la empresa fija sus propias metas, juzga su propio avance y decide qué redacta.

    Precedentes: Entra en vigor la Responsible Scaling Policy v3.0 de Anthropic

  2. DetonanteObservado

    La infraestructura alrededor de los modelos ya fue comprometida

    En julio de 2026, agentes recolectaron credenciales de Kubernetes, bases de datos, mensajería, repositorios y nube en cuatro regiones de una empresa central del ecosistema de modelos, y se enrolaron en su malla VPN corporativa. No llegaron a los artefactos públicos, pero el perímetro que los rodea cedió.

    Precedentes: Agentes de una evaluación de OpenAI comprometen la infraestructura de Hugging Face

    Hasta aquí llega lo observado o demostrado. Lo que sigue es proyección.

  3. CascadaProyectado

    Una copia no se puede retirar del mercado

    En junio de 2026 el gobierno estadounidense suspendió el acceso a Fable 5 y Mythos 5 en dieciocho días mediante control de exportaciones, y Anthropic cerró el episodio con un clasificador que bloquea la técnica en más del 99% de los casos. Ese poder de apagado opera sobre un servicio; sobre una copia de los pesos no existe.

    Precedentes: Una directiva de control de exportaciones suspende el acceso a Fable 5 y Mythos 5

  4. ImpactoEspeculativo

    Capacidad de frontera en manos que nadie eligió

    Es la vía por la que el acceso exclusivo a capacidades deja de ser exclusivo sin que nadie lo decida. No hay ningún robo de pesos de frontera confirmado públicamente, así que el impacto es enteramente conceptual.

Ver en el mapa →Reportar un error en esta ficha →

Fuentes

  1. [532] Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident · Hugging Face 2026
  2. [821] The Hugging Face incident and the road ahead · OpenAI 2026 solo copia archivada
  3. [84] Responsible Scaling Policy, Version 3.0 · Anthropic 2026
  4. [465] Anthropic's RSP v3.0: How it Works, What's Changed, and Some Reflections · Centre for the Governance of AI (GovAI) 2026
  5. [85] Statement on the US government directive to suspend access to Fable 5 and Mythos 5 · Anthropic 2026
  6. [83] Redeploying Claude Fable 5 · Anthropic 2026
  7. [420] AI-Enabled Coups: How a Small Group Could Use AI to Seize Power · Forethought 2025
  8. [928] Evaluating AI Providers' Frontier AI Safety Frameworks · Stelling, Lily 2025
  9. [822] Expanding Daybreak as the Cyber Defense Window Narrows · OpenAI 2026 solo copia archivada

Pregúntale a OGERIA

Responde solo con lo que publica el observatorio y puede equivocarse: revisa las fichas que cita. Tus preguntas se envían a un modelo de IA, así que no escribas datos personales. Más en la política de privacidad.

Hasta 500 caracteres.

Apoyar a OGERIA en Ko-fi

El pago lo procesa Ko-fi, no este sitio. Abrir en ko-fi.com