Exigir que las evaluaciones se publiquen
Que los umbrales de capacidad peligrosa, las pruebas adversariales y sus resultados sean públicos y auditables. Veinte empresas se comprometieron a publicar un marco de seguridad de frontera y doce lo hicieron: la distancia entre ambas cifras es el indicador que importa.
- Nivel
- Cívico
- Costo
- Costo bajo
- Esfuerzo
- Horas
- Evidencia
- Observado
Lo que no resuelve
Un marco publicado mide la promesa, no el cumplimiento, y la evaluación independiente de esos marcos encuentra calidad muy despareja. Tampoco resuelve que quien escribe el umbral sea quien decide si lo cruzó, ni cubre a los desarrolladores que nunca se comprometieron a nada.
Sirve si lo que quieres es que alguien de afuera pueda contradecir a quien desarrolla. Hoy la mejor ventana pública al estado real de las capacidades peligrosas son los marcos voluntarios y sus activaciones de umbral, y esa ventana es más chica de lo que parece: en la cumbre de Seúl de mayo de 2024, dieciséis empresas se comprometieron a publicar un marco de seguridad de frontera y otras cuatro se sumaron después; publicaron doce [708]Common Elements of Frontier AI Safety PoliciesVer fuente ↗. La distancia entre comprometidas y publicadas es mejor indicador que el conteo, porque mide incumplimiento de un compromiso explícito y no admite lectura optimista.
No sirve si te quedas en el conteo. La evaluación independiente de esos marcos encuentra calidad muy despareja entre proveedores [928]Evaluating AI Providers' Frontier AI Safety FrameworksVer fuente ↗, y un marco publicado mide la promesa, no el cumplimiento.
Evidencia. Observada, en el sentido preciso de que existe y se puede contar. En la Unión Europea parte de esto ya es obligación legal para modelos con riesgo sistémico, incluidas las pruebas adversariales [22]EU AI Act — Article 55: Obligations for providers of general-purpose AI models with systemic riskVer fuente ↗.
Costo. Bajo para una persona: exigirlo, citarlo, preferir a quien publica.
Qué no resuelve. El problema de fondo, que es que quien escribe el umbral es quien decide si lo cruzó. Tampoco cubre a los desarrolladores que nunca se comprometieron a nada, ni impide que un marco se relaje justo cuando empieza a estorbar.
Sirve si…
- Catástrofe por mal uso · Sirve
Las activaciones de umbral y sus justificaciones son hoy la mejor ventana pública al estado real del uplift biológico.
- Pérdida de control rápida · Parcial
- Toma de poder por un grupo pequeño · Parcial
Ataca directamente el supuesto de opacidad sobre capacidades y usos internos del que depende ese escenario.
- IA como tecnología normal · Sirve
No sirve si…
- Maldición de la inteligencia · No sirve
Ver en la matriz de protección →Reportar un error en esta ficha →
Fuentes
- [708] Common Elements of Frontier AI Safety Policies · METR 2025
- [928] Evaluating AI Providers' Frontier AI Safety Frameworks · Stelling, Lily 2025
- [22] EU AI Act — Article 55: Obligations for providers of general-purpose AI models with systemic risk · Unión Europea 2026