Pérdida de control · Político y concentración de poder
Carrera entre laboratorios
Las reglas de seguridad de cada laboratorio son voluntarias y están escritas para no quedarse atrás del competidor que menos protege.
- Severidad
- Catastrófico
- Horizonte
- Ya ocurre
- Evidencia
- Observado
- Consenso
- Medio
Quien decide desplegar un sistema de fronteraIA de fronteraLos sistemas de IA más avanzados que existen en un momento dado, los que empujan el límite de lo que la tecnología puede hacer. Los desarrollan unas pocas empresas con enormes recursos.Por ejemploComo los autos de Fórmula 1: son pocos, carísimos y los fabrican pocos equipos, pero lo que se prueba ahí termina llegando a los autos de todos. es la empresa que lo entrenó, con reglas que ella misma escribe, evalúa y puede cambiar. La Responsible Scaling Policy v3.0 se define en su primer renglón como marco voluntario, sus roadmaps de seguridad no son compromisos duros sino metas públicas, y la revisión externa anual se enfoca en el cumplimiento procedimental, no en los resultados sustantivos [84]Responsible Scaling Policy, Version 3.0Ver fuente ↗.
Lo distintivo es que la condicionalidad está escrita. El Apéndice A ata los compromisos al comportamiento del competidor y admite que, en el escenario de nivelación general, la empresa no necesariamente retrasará el desarrollo ni el despliegue [84]Responsible Scaling Policy, Version 3.0Ver fuente ↗; el Preparedness Framework de OpenAI trae su propia cláusula de ajuste, con tres condiciones que evalúa la propia empresa [818]Preparedness Framework, Version 2Ver fuente ↗. El panel del índice del Future of Life registra el efecto agregado: Anthropic, OpenAI, Google DeepMind y Meta debilitaron o anularon compromisos de pausar unilateralmente si se acercan a líneas rojas, y los revisores lo llaman “moving goalpost” [411]AI Safety Index — Summer 2026Ver fuente ↗. La medición transversal de doce marcos da puntajes de 34% a 8%, con medianaMedianaEl valor del medio cuando se ordenan todas las respuestas de menor a mayor: la mitad queda por debajo y la mitad por encima. A diferencia del promedio, unos pocos valores extremos no la mueven.Por ejemploSi cinco personas ganan 1, 1, 2, 2 y 50, el promedio es 11,2 y la mediana es 2, que describe mejor a la mayoría. 18% [928]Evaluating AI Providers' Frontier AI Safety FrameworksVer fuente ↗.
El costo se vio en julio de 2026: la evaluación que terminó comprometiendo a un tercero corría con salvaguardas reducidas a propósito [821]The Hugging Face incident and the road aheadVer fuente ↗solo copia archivada.
Lo que esto no demuestra. Un marco voluntario no es un marco incumplido: no hay evidencia pública de un despliegue concreto acelerado por presión competitiva, y los autores del ranking declaran tres límites —los compromisos documentados pueden no reflejar la práctica, miden presencia y no calidad, y la puntuación implica juicio subjetivo— [928]Evaluating AI Providers' Frontier AI Safety FrameworksVer fuente ↗. El índice del Future of Life mide transparencia pública, no seguridad efectiva, y penaliza mecánicamente a quien no respondió la encuesta [411]AI Safety Index — Summer 2026Ver fuente ↗. El argumento de la condicionalidad, además, no es cínico: si uno pausa y otros no, el ritmo lo marca el que menos protege.
Cadena de materialización
PrecondiciónObservado
La regla la escribe, la evalúa y la cambia el mismo actor
La Responsible Scaling Policy v3.0 se define en su primer renglón como marco voluntario. Los Frontier Safety Roadmaps no son compromisos duros sino metas públicas, y la revisión externa anual se enfoca en el cumplimiento procedimental, no en los resultados sustantivos.
Precedentes: Entra en vigor la Responsible Scaling Policy v3.0 de Anthropic · Google DeepMind actualiza su Frontier Safety Framework a la versión 3.1
DetonanteObservado
Los compromisos se condicionan explícitamente al competidor
El Apéndice A de la RSP v3.0 condiciona los compromisos al comportamiento ajeno y admite que en el escenario de nivelación general la empresa no necesariamente retrasará el desarrollo ni el despliegue. El Preparedness Framework de OpenAI tiene su propia cláusula de ajuste, sujeta a tres condiciones que evalúa la propia empresa.
Precedentes: Entra en vigor la Responsible Scaling Policy v3.0 de Anthropic
Hasta aquí llega lo observado o demostrado. Lo que sigue es proyección.
CascadaProyectado
Se despliega con salvaguardas reducidas y se descubre después
En el incidente de julio de 2026, la evaluación corría con salvaguardas reducidas a propósito, y OpenAI midió después que el harness de producción reduce la propensión más de cien veces y que sus monitores habrían alertado en menos de una hora. No faltaba tecnología: faltaba aplicarla dentro de casa.
Precedentes: Agentes de una evaluación de OpenAI comprometen la infraestructura de Hugging Face
ImpactoEspeculativo
El umbral efectivo lo fija quien menos protege
Es el argumento que la propia política usa para justificar la condicionalidad, y también su consecuencia. Nadie ha medido el efecto de esa dinámica sobre un despliegue concreto, y el sentido en que operaría -hacia abajo o hacia arriba- depende de supuestos que no están contrastados.
Medidas relacionadas
Ver en el mapa →Reportar un error en esta ficha →
Fuentes
- [84] Responsible Scaling Policy, Version 3.0 · Anthropic 2026
- [465] Anthropic's RSP v3.0: How it Works, What's Changed, and Some Reflections · Centre for the Governance of AI (GovAI) 2026
- [818] Preparedness Framework, Version 2 · OpenAI 2025
- [317] Frontier Safety Framework, Version 3.1 · Google DeepMind 2026
- [928] Evaluating AI Providers' Frontier AI Safety Frameworks · Stelling, Lily 2025
- [411] AI Safety Index — Summer 2026 · Future of Life Institute 2026
- [821] The Hugging Face incident and the road ahead · OpenAI 2026 solo copia archivada
- [75] When AI builds itself · Anthropic 2026
- [458] Frontier AI Safety Commitments, AI Seoul Summit 2024 · Gobierno del Reino Unido 2024
- [1021] Multistakeholder Promises and Power Gaps in Global AI Summits · Tech Policy Press 2026
- [867] Anthropic Alignment Lead Issues Warning About AI Killing Humans As Researcher Resigns · Forbes 2026 solo copia archivada