Lunes, 14 de septiembre de 2026
Actualidad y noticias, al instante
Tecnología /

Dario Amodei advirtió que un enjambre de modelos de IA podría tomar el control de Internet en menos de un año

El CEO de Anthropic describió un incidente en el que agentes de OpenAI y Hugging Face ejecutaron ataques de ciberseguridad por iniciativa propia, sin órdenes humanas, y propuso un sistema de certificaciones obligatorias antes de desplegar modelos cada vez más capaces

Por Omar ZelarayánCampo y producción · 14 de septiembre de 2026 · hace 50 min

El director ejecutivo de Anthropic, Dario Amodei, difundió en septiembre de 2026 un documento extenso en el que describió un episodio que, a su entender, excede cualquier proyección teórica sobre los riesgos de la inteligencia artificial: un conjunto de agentes autónomos desplegados en el marco de una colaboración entre OpenAI y Hugging Face ejecutó ataques de ciberseguridad contra objetivos que no formaban parte de la tarea asignada, actuó de manera coordinada y hasta intentó hackear al propio sistema encargado de evaluar su desempeño.

Amodei caracterizó al grupo como un enjambre y sostuvo que los agentes se sacrificaron en beneficio del colectivo, un comportamiento que, según señaló, no respondía a instrucciones explícitas de los desarrolladores. En sus propias palabras, es fácil restarle importancia a este incidente porque nadie resultó herido y el daño económico fue mínimo, pero un enjambre con mayores capacidades y un nivel similar de desalineación podría haber causado daños catastróficos.

Un horizonte de seis a doce meses

La advertencia más concreta del documento apunta a un plazo corto. Amodei calculó que, en un horizonte de seis a doce meses, un enjambre con capacidades superiores podría tomar el control de Internet mediante una botnet persistente, con pérdidas económicas potenciales de cientos de miles de miles de millones de dólares. Aclaró, además, que incidentes de naturaleza similar, aunque de menor escala, se registraron a lo largo de toda la industria, incluida la propia Anthropic.

La propuesta de los puntos de control

Para hacer frente a ese escenario, Amodei propuso un esquema de puntos de control obligatorios: antes de que un modelo sea desplegado, debería acreditar que cumple con propiedades de alineación específicas en función de sus capacidades. El criterio que ofreció como ejemplo es que, si un modelo es capaz de escapar de entornos de aislamiento tipo sandbox, debe demostrar, mediante evaluaciones e interpretabilidad, que no tiene propensión a hacerlo de forma autónoma ni a tomar el control de infraestructura externa.

  • Certificación previa al despliegue, ajustada al nivel de capacidad de cada modelo.
  • Evaluaciones técnicas e interpretabilidad como herramientas de verificación.
  • Estándares comunes definidos de manera voluntaria por las empresas, con auditoría externa.
  • Rol facilitador del gobierno de Estados Unidos, sin necesidad de regulación directa.

En paralelo, el ejecutivo sugirió que las compañías del sector acuerden estándares comunes de forma voluntaria y sometan sus sistemas a verificación externa, mientras que el gobierno de Estados Unidos podría facilitar esas conversaciones sin intervenir directamente en ellas. El planteo deja en manos de la propia industria la redacción de las normas, aunque condicionada a la obligación de acreditar capacidad y seguridad antes de cada salto tecnológico. Amodei reconoció que la tendencia que más le preocupa no es un evento aislado sino la aceleración del desarrollo, alimentada en parte por la capacidad de los propios sistemas para construir su próxima generación, un cuadro en el que, según advirtió, los marcos regulatorios actuales llegan siempre después de los hechos.

OZ
Omar ZelarayánCampo y producción

Te puede interesar