Saltar al contenido
OGERIA — Observatorio Global de Evidencias de Riesgos de la Inteligencia ArtificialInforme de síntesis · ed. 2026
Actualizado 2 oct 2026

Capítulo 01 · Mapa de riesgos

Las reglas de seguridad de cada laboratorio son voluntarias y están escritas para no quedarse atrás del competidor que menos protege.

Severidad
Catastrófico
Horizonte
Ya ocurre
Evidencia
Observado
Consenso
Medio

Quien decide desplegar un sistema de fronteraIA de fronteraLos sistemas de IA más avanzados que existen en un momento dado, los que empujan el límite de lo que la tecnología puede hacer. Los desarrollan unas pocas empresas con enormes recursos.Por ejemploComo los autos de Fórmula 1: son pocos, carísimos y los fabrican pocos equipos, pero lo que se prueba ahí termina llegando a los autos de todos. es la empresa que lo entrenó, con reglas que ella misma escribe, evalúa y puede cambiar. La Responsible Scaling Policy v3.0 se define en su primer renglón como marco voluntario, sus roadmaps de seguridad no son compromisos duros sino metas públicas, y la revisión externa anual se enfoca en el cumplimiento procedimental, no en los resultados sustantivos [84]Responsible Scaling Policy, Version 3.0Anthropic · 2026 · documento oficialVer fuente ↗Consultada el 9 de septiembre de 2026.

Lo distintivo es que la condicionalidad está escrita. El Apéndice A ata los compromisos al comportamiento del competidor y admite que, en el escenario de nivelación general, la empresa no necesariamente retrasará el desarrollo ni el despliegue [84]Responsible Scaling Policy, Version 3.0Anthropic · 2026 · documento oficialVer fuente ↗Consultada el 9 de septiembre de 2026; el Preparedness Framework de OpenAI trae su propia cláusula de ajuste, con tres condiciones que evalúa la propia empresa [818]Preparedness Framework, Version 2OpenAI · 2025 · documento oficialVer fuente ↗Consultada el 9 de septiembre de 2026. El panel del índice del Future of Life registra el efecto agregado: Anthropic, OpenAI, Google DeepMind y Meta debilitaron o anularon compromisos de pausar unilateralmente si se acercan a líneas rojas, y los revisores lo llaman “moving goalpost” [411]AI Safety Index — Summer 2026Future of Life Institute · 2026 · informeVer fuente ↗Consultada el 9 de septiembre de 2026. La medición transversal de doce marcos da puntajes de 34% a 8%, con medianaMedianaEl valor del medio cuando se ordenan todas las respuestas de menor a mayor: la mitad queda por debajo y la mitad por encima. A diferencia del promedio, unos pocos valores extremos no la mueven.Por ejemploSi cinco personas ganan 1, 1, 2, 2 y 50, el promedio es 11,2 y la mediana es 2, que describe mejor a la mayoría. 18% [928]Evaluating AI Providers' Frontier AI Safety FrameworksStelling, Lily; Murray, Malcolm; Galizzi, Bruno et al. · 2025 · preprintVer fuente ↗Consultada el 9 de septiembre de 2026.

El costo se vio en julio de 2026: la evaluación que terminó comprometiendo a un tercero corría con salvaguardas reducidas a propósito [821]The Hugging Face incident and the road aheadOpenAI · 2026 · blog institucionalVer fuente ↗solo copia archivadaConsultada el 9 de septiembre de 2026.

Lo que esto no demuestra. Un marco voluntario no es un marco incumplido: no hay evidencia pública de un despliegue concreto acelerado por presión competitiva, y los autores del ranking declaran tres límites —los compromisos documentados pueden no reflejar la práctica, miden presencia y no calidad, y la puntuación implica juicio subjetivo— [928]Evaluating AI Providers' Frontier AI Safety FrameworksStelling, Lily; Murray, Malcolm; Galizzi, Bruno et al. · 2025 · preprintVer fuente ↗Consultada el 9 de septiembre de 2026. El índice del Future of Life mide transparencia pública, no seguridad efectiva, y penaliza mecánicamente a quien no respondió la encuesta [411]AI Safety Index — Summer 2026Future of Life Institute · 2026 · informeVer fuente ↗Consultada el 9 de septiembre de 2026. El argumento de la condicionalidad, además, no es cínico: si uno pausa y otros no, el ritmo lo marca el que menos protege.

Cadena de materialización

  1. PrecondiciónObservado

    La regla la escribe, la evalúa y la cambia el mismo actor

    La Responsible Scaling Policy v3.0 se define en su primer renglón como marco voluntario. Los Frontier Safety Roadmaps no son compromisos duros sino metas públicas, y la revisión externa anual se enfoca en el cumplimiento procedimental, no en los resultados sustantivos.

    Precedentes: Entra en vigor la Responsible Scaling Policy v3.0 de Anthropic · Google DeepMind actualiza su Frontier Safety Framework a la versión 3.1

  2. DetonanteObservado

    Los compromisos se condicionan explícitamente al competidor

    El Apéndice A de la RSP v3.0 condiciona los compromisos al comportamiento ajeno y admite que en el escenario de nivelación general la empresa no necesariamente retrasará el desarrollo ni el despliegue. El Preparedness Framework de OpenAI tiene su propia cláusula de ajuste, sujeta a tres condiciones que evalúa la propia empresa.

    Precedentes: Entra en vigor la Responsible Scaling Policy v3.0 de Anthropic

    Hasta aquí llega lo observado o demostrado. Lo que sigue es proyección.

  3. CascadaProyectado

    Se despliega con salvaguardas reducidas y se descubre después

    En el incidente de julio de 2026, la evaluación corría con salvaguardas reducidas a propósito, y OpenAI midió después que el harness de producción reduce la propensión más de cien veces y que sus monitores habrían alertado en menos de una hora. No faltaba tecnología: faltaba aplicarla dentro de casa.

    Precedentes: Agentes de una evaluación de OpenAI comprometen la infraestructura de Hugging Face

  4. ImpactoEspeculativo

    El umbral efectivo lo fija quien menos protege

    Es el argumento que la propia política usa para justificar la condicionalidad, y también su consecuencia. Nadie ha medido el efecto de esa dinámica sobre un despliegue concreto, y el sentido en que operaría -hacia abajo o hacia arriba- depende de supuestos que no están contrastados.

Ver en el mapa →Reportar un error en esta ficha →

Fuentes

  1. [84] Responsible Scaling Policy, Version 3.0 · Anthropic 2026
  2. [465] Anthropic's RSP v3.0: How it Works, What's Changed, and Some Reflections · Centre for the Governance of AI (GovAI) 2026
  3. [818] Preparedness Framework, Version 2 · OpenAI 2025
  4. [317] Frontier Safety Framework, Version 3.1 · Google DeepMind 2026
  5. [928] Evaluating AI Providers' Frontier AI Safety Frameworks · Stelling, Lily 2025
  6. [411] AI Safety Index — Summer 2026 · Future of Life Institute 2026
  7. [821] The Hugging Face incident and the road ahead · OpenAI 2026 solo copia archivada
  8. [75] When AI builds itself · Anthropic 2026
  9. [458] Frontier AI Safety Commitments, AI Seoul Summit 2024 · Gobierno del Reino Unido 2024
  10. [1021] Multistakeholder Promises and Power Gaps in Global AI Summits · Tech Policy Press 2026
  11. [867] Anthropic Alignment Lead Issues Warning About AI Killing Humans As Researcher Resigns · Forbes 2026 solo copia archivada

Pregúntale a OGERIA

Responde solo con lo que publica el observatorio y puede equivocarse: revisa las fichas que cita. Tus preguntas se envían a un modelo de IA, así que no escribas datos personales. Más en la política de privacidad.

Hasta 500 caracteres.

Apoyar a OGERIA en Ko-fi

El pago lo procesa Ko-fi, no este sitio. Abrir en ko-fi.com