Catástrofe por mal uso
No hace falta ninguna IA desalineada: basta con que una capacidad ofensiva se abarate. Una persona o un grupo con acceso a un modelo capaz salta pasos que antes exigían años de formación, en biología o en intrusión de redes.
- Horizonte
- 1–3 años
- Evidencia
- Proyectado
- Consenso
- Alto
Supuestos que tienen que cumplirse
Que el upliftUpliftCuánto mejora lo que una persona logra hacer cuando tiene una IA al lado, comparado con lo que lograría sola. En este observatorio se usa sobre todo para capacidades peligrosas.Por ejemploComo armar un mueble con un video tutorial al lado: no te da las herramientas, pero terminas antes y con menos errores que leyendo solo el manual. sea real fuera del banco de pruebas: que la ayuda medida en una evaluación se traduzca en capacidad efectiva en el mundo físico.
Que los controles de acceso a insumos físicos —cribado de síntesisCribado de síntesis de ADNLa revisión que hacen las empresas que fabrican ADN a pedido para detectar si un encargo corresponde a algo peligroso, como partes de un virus, antes de fabricarlo y enviarlo.Por ejemploComo la farmacia que revisa la receta antes de entregar un medicamento controlado. de ADN, verificación de cliente en laboratorios remotos— sigan siendo franqueables.
Que la ventaja ofensiva no sea compensada por una defensa que se acelere al mismo ritmo.
Que la alucinación en tareas ofensivas deje de ser el freno que hoy documentan quienes investigaron el caso.
Ficha completa →
Qué lo refutaría
Que los intentos documentados sigan estrellándose contra el mismo obstáculo reportado en la campaña de septiembre de 2025, resultados fabricados que obligan a validación humana constante.
Que el cribado de síntesis de ADN y la verificación de cliente cierren efectivamente el paso físico, dejando el conocimiento sin salida al mundo material.
Que la defensa se acelere al menos tanto como el ataque, con parcheo automatizado que reduzca de forma medible la ventana de explotación.
Que las evaluaciones de capacidad peligrosa dejen de subir de nivel durante varias generaciones de modelos, y que las que suben resulten atribuibles a mejor evaluación y no a mejor capacidad.
Riesgos implicados
Señales tempranas
«No observada» no es un visto bueno: significa que nadie la ha visto todavía, que es distinto de que no esté pasando.