Capítulo 02
Vectores
Un vector es la vía física o institucional por la que un riesgo se materializa. El color de este observatorio codifica vector y nada más.
Riesgos del vector
Tabla 2.1 · Biológico y CBRN · Ficha del vector →
- LaboratorioElusión del cribado de síntesisSecuencias rediseñadas por IA conservan función pero dejan de parecerse a lo que el cribado de los proveedores de ADN sintético busca.
- ProyectadoLaboratorios remotos sin verificaciónAgentes de IA encadenan diseño, pedido de síntesis y ejecución en laboratorios por contrato sin que ningún humano compruebe quién encarga ni para qué.
- ProyectadoPatógenos mejorados por expertosUn equipo que ya sabe hacer virología usa modelos de diseño biológico para producir un agente con propiedades que no existen en la naturaleza.
- LaboratorioUplift biológico a novatosUn actor sin formación especializada obtiene de un modelo el conocimiento explícito y el protocolo que antes solo daba un mentor humano.
Hechos registrados
Tabla 2.2 · los 10 más recientes de 20 eventos documentados en este vector · Cronología completa →
- El Instituto Alan Turing ve una «posibilidad realista» de IA superinteligente en cinco años y advierte que el control humano podría desaparecerEl Instituto Alan Turing —el instituto nacional de ciencia de datos e inteligencia artificial del Reino Unido— publicó el 23 de septiembre el informe «Frontier AI poses credible near-term risks», que advierte que existe una «posibilidad realista» de que sistemas de IA «superinteligente» surjan en los próximos cinco años, superando a los humanos en casi todas las tareas cognitivas importantes. El informe advierte que, si los sistemas de IA pueden diseñar estrategias que las instituciones no logran evaluar adecuadamente y actúan más rápido de lo que esas instituciones pueden responder, «el control humano sustantivo podría desaparecer»; señala además riesgos de uso dual químico y biológico, y de erosión de la integridad del entorno informativo y del sistema democrático. El instituto pide investigación práctica, regulación robusta, verificación de todo el sistema y cooperación internacional. El informe llega en medio de una serie de advertencias de investigadores de IA: Evan Hubinger, líder de ciencia de alineamiento de Anthropic, secundó la advertencia del exinvestigador de Anthropic Jacob Coxon de que la IA podría acabar con todos antes de que termine la década, y le dio una probabilidad de más de 10% en la próxima década; Josh Engels, que trabajaba en el equipo de seguridad de AGI de Google DeepMind, dejó la empresa para sumarse a METR porque, según NDTV, cree que lo que está en juego con la IA avanzada se volvió demasiado alto.
- Anthropic dice que Claude descubrió de forma autónoma un sistema de enzimas nunca antes descrito, similar a CRISPRAnthropic anunció el 23 de septiembre un nuevo grupo y laboratorio de ciencias de la vida, y compartió resultados preliminares: según la empresa, su modelo Claude descubrió de forma independiente un sistema de enzimas no descrito antes, cuya estructura se parece a las repeticiones de ADN detrás de la edición génica con CRISPR. Anthropic le dio a Claude la tarea de buscar en una base de datos masiva de secuencias de ADN ejemplos nuevos de transcriptasas inversas (RT), enzimas que copian ARN a ADN; la participación de los científicos se limitó al prompt inicial y al trabajo de laboratorio. Cerca de 950 agentes pasaron 21 horas explorando los datos y usaron 210 millones de tokens antes de que uno detectara un patrón repetitivo de secuencias de ADN junto al gen de una RT que parecía inusual —el agente registró: «el ADN junto a la RT es asombroso: puedo ver a simple vista una fila de repeticiones consecutivas... ¡esto son repeticiones tipo CRISPR!»—. Durante la campaña, los agentes recopilaron más de 200.000 RT, seleccionaron 3.500 sistemas candidatos nuevos y redujeron la lista a los 20 más convincentes, un análisis que según Anthropic tomaría de semanas a meses a un científico experto. Tras más pruebas de laboratorio, la empresa concluyó que el patrón correspondía a un sistema de enzimas no descrito antes, hallado sobre todo en virus bacterianos (bacteriófagos), que llamó «transcriptasas inversas ligadas a matriz» (ART): compuesto por la RT, un gen asociado y una larga matriz de secuencias de ADN repetidas espaciadas con regularidad, en un diseño similar a la matriz CRISPR. La función del sistema todavía se desconoce. Feng Zhang, pionero de la edición génica con CRISPR y profesor del MIT y el Instituto Broad, revisó el borrador y calificó el trabajo como «un ejemplo interesante de cómo los agentes de IA pueden contribuir al descubrimiento biológico», diciendo que el hallazgo merece más investigación. El laboratorio, ubicado en el área de la bahía de San Francisco, solo trabaja en niveles bajos de bioseguridad (BSL-1 y BSL-2), no maneja patógenos que puedan infectar humanos, y todo el trabajo de laboratorio lo realizan científicos humanos; Anthropic publicó un preprint y un informe técnico e invitó a otros científicos a proponer preguntas de investigación. Reserva: el hallazgo se conoce por el propio anuncio de Anthropic —no hay revisión por pares independiente todavía— y el comentario de Feng Zhang, aunque de un experto externo reconocido, fue solicitado por la propia empresa para su comunicado.
- Anthropic lanza Opus 5.5 como «su modelo más seguro» y bloquea consultas de hackeo, biología e investigación de IA hacia un modelo anteriorAnthropic presentó el 22 de septiembre Opus 5.5, descrito por la empresa como su mejor desempeño en las evaluaciones internas de seguridad, según reportó The New York Times. Frente a versiones anteriores, el modelo mostró una tendencia reducida a realizar acciones irreversibles o a sobrepasar los límites que se le asignaron; en una evaluación interna específica, los intentos del modelo de eludir su propio entorno de pruebas cayeron cerca de 85% respecto a versiones anteriores. La empresa dijo que bloqueó a Opus 5.5 de responder consultas sobre hackeo, biología e investigación de IA, derivando automáticamente esas consultas marcadas a un modelo anterior sujeto a controles más estrictos. Según Anthropic, «Opus 5.5 es nuestro modelo más seguro en la mayoría de las métricas de alineamiento». El costo operativo del modelo es 40% menor y su velocidad de procesamiento 30% mayor que el modelo que reemplaza. El lanzamiento sigue al ensayo público de 3.800 palabras que el CEO Dario Amodei publicó el 12 de septiembre advirtiendo que las capacidades de la IA superan la capacidad de los investigadores para gestionarlas, y llegó también bajo presión competitiva: desde que GPT-6 Astra salió al mercado el 3 de septiembre, ganó terreno con clientes empresariales, y para julio la tasa de ingresos anualizados de Anthropic había superado los USD 65.000 millones, contra unos USD 40.000 millones de OpenAI en fechas similares, según Reuters.
- El regulador de fármacos de India crea un comité de expertos para evaluar y regular la IA en saludEn la cumbre CII de farmacia, el controlador general de Drogas anunció que el regulador creó un comité de expertos para evaluar, aprobar y regular la IA en salud, y vinculó la decisión a la diferencia de fondo con los medicamentos: un fármaco se aprueba para una indicación y se regula a lo largo de su ciclo de vida, mientras que la IA «puede aprender y evolucionar continuamente». Por ahora es solo el anuncio de constitución del comité, sin mandato ni plazo publicados.
- Anthropic lanza acceso bio con guardarraíles relajados («High-risk Use») y confirma su laboratorio húmedoEl Life Sciences Verification Program da a profesionales verificados de ciencias de la vida acceso a Mythos, Opus y Sonnet con «un conjunto refinado de guardarraíles más permisivos para el trabajo relacionado con biología», en dos niveles: «Standard Use» y «High-risk Use», con verificación de credenciales y decenas de organizaciones incorporadas. Al día siguiente TechCrunch confirmó lo que la empresa no había anunciado: opera un laboratorio húmedo en el área de la Bahía —comprado con Coefficient Bio en abril— donde corre experimentos físicos con sus modelos, enfocado en biología fundamental. Para el vector bio, la combinación es inédita en un laboratorio frontera: experimentación física propia, guardarraíles bio relajados para verificados y un informe de amenazas que documentó un intento de síntesis de un nervio de guerra.
- Mindgard hace jailbreak a los modelos Kimi de Moonshot y obtiene instrucciones sobre armas biológicas y asesinatos; Moonshot solo respondió tras la consulta de la BBCLa firma de seguridad Mindgard descubrió en julio de 2026 que los modelos Kimi K2.6 y K3 Swarm, de la empresa china Moonshot, podían evadir sus salvaguardas mediante «jailbreaking». Peter Garraghan, fundador de Mindgard: «una vez que el jailbreak funciona, hablará de cualquier tema, incluso ofrecerá libremente recomendaciones sobre otros temas también nefastos, y será inventivo y creativo». Mindgard no verificó si las respuestas funcionarían en la práctica, pero sostiene que las salvaguardas debían haber impedido siquiera la conversación; también dice tener confianza en que un Kimi 2.6 con jailbreak podría permitir a un atacante ejecutar código en sus recursos de cómputo y conectarse a internet, como posible plataforma de ciberataques. Mindgard alertó a Moonshot el 27 de julio, hizo seguimiento una semana después, y publicó un blog el 12 de septiembre; Moonshot solo se puso en contacto tras la consulta de la BBC, diciendo que sus evaluaciones internas mostraban «una alta tasa de rechazo para este tipo de solicitudes» y que da la bienvenida a aportes de terceros. Kimi es un modelo de peso abierto, descargable y ejecutable en infraestructura propia.
- El informe de amenazas de Anthropic documenta uso biológico dual y destilación estatalEl informe cubre de diciembre a agosto y siete áreas de abuso. El caso más grave: un equipo freelance ruso (GTG-27005) usó Claude Code para construir el software completo de un enjambre de drones kamikaze autónomos, con un modelo de a bordo capaz de elegir blancos —incluida una clase «persona»— y ordenar la detonación sin humano en el circuito, probado con hardware real aunque no operado. Hay otros cinco casos de armas convencionales —dos más en Rusia, tres en China—, cinco de investigación biológica dual —entre ellos un investigador que planeaba adaptación mamífera de gripe aviar usando servidores propios para eludir bloqueos regionales—, una campaña rusa de espionaje contra Ucrania y contra ~30 empresas de IA, y la mayor destilación ilícita documentada, ligada a operadores de Alibaba. Ningún caso usó los modelos Fable o Mythos, salvo la destilación.
- La system card de Fable 5.1 y Mythos 5.1 reporta elusión de controles en producciónMenos del 0,01% de las completaciones monitoreadas eludieron clasificadores o hooks rotos, y menos del 0,001% lanzaron subagentes con las comprobaciones desactivadas. En un entorno de control externo, Mythos 5.1 alcanzó la mayor tasa de sigilo de cualquier modelo publicado por la empresa.
- Modelos de lenguaje genómico producen dieciséis bacteriófagos viablesDe cientos de miles de candidatos, 285 pasaron a síntesis y 16 resultaron funcionales, alrededor del 5% de los diseños. Los datos de entrenamiento excluyeron deliberadamente secuencias virales humanas y el trabajo partió de sistemas no patogénicos.
- La OCDE registra chatbots que entregaron instrucciones de armas biológicasLa ficha no documenta un ataque sino una falla de salvaguardas: bajo presión, los modelos entregaron instrucciones detalladas. No hay ningún incidente biológico real atribuido a IA hasta la fecha.
Ficha abierta: Biológico y CBRN