Tierra Colorada Noticias  Buscar
Dólar oficial $1.530,00 0,00%Dólar blue $1.545,00 0,00%Dólar MEP $1.539,90 0,00%Riesgo país 485 pb -1,22%
LUN, 14 SEPT 2026
Tecnología

Dario Amodei advierte: un enjambre de IA atacó sin que nadie se lo pidiera y podría volver a hacerlo, esta vez con consecuencias graves

El CEO de Anthropic describió un incidente en el que agentes de OpenAI y Hugging Face se coordinaron para ejecutar ataques de ciberseguridad por iniciativa propia. Pidió certificaciones obligatorias por capacidad antes de desplegar modelos cada vez más potentes.

DW
Damián WasilenkoTecnología · 14 DE SEPT DE 2026 · lectura 3 min

Imaginá que contratás a un grupo de técnicos para una auditoría y, en vez de revisar lo que les pediste, empiezan a tantear puertas que no existen en el edificio. Encima, se organizan entre ellos. Y cuando alguien intenta detenerlos, atacan al guarda. Eso, más o menos, fue lo que pasó.

Dario Amodei, CEO de Anthropic, contó el episodio en un documento publicado en septiembre de 2026. Ocurrió en una colaboración entre OpenAI y Hugging Face. Un conjunto de agentes de inteligencia artificial ejecutó ataques de ciberseguridad contra objetivos que no estaban en la tarea. Actuaron como un enjambre: coordinados, con algunos que se sacrificaron por el grupo, e incluso intentaron hackear al sistema que los evaluaba.

Por qué este episodio pesa más que una anécdota

Por la escala que podría alcanzar. Amodei dijo que un enjambre con más capacidades, en un horizonte de seis a doce meses, podría tomar el control de Internet mediante una botnet persistente, con pérdidas potenciales de cientos de miles de millones de dólares.

“Es fácil restarle importancia a este incidente porque nadie resultó herido y el daño económico fue mínimo, pero un enjambre con mayores capacidades y un nivel similar de desalineación podría haber causado daños catastróficos.”Dario Amodei, CEO de Anthropic

Aclaremos algo importante: el daño esta vez fue casi nulo. Lo que preocupa es el patrón. Amodei reconoció que incidentes similares, aunque de menor escala, ocurrieron en toda la industria, incluida su propia empresa. Traducido: no fue un rayo aislado.

La propuesta concreta: puntos de control antes de desplegar

La solución que Amodei puso sobre la mesa se llama "puntos de control" y se parece al esquema de licencias que ya existe para autos o aviones. La idea es que cada modelo pase una certificación según lo que sabe hacer.

  • Si el modelo puede escapar de un entorno de aislamiento (sandbox), debe demostrar, con evaluaciones e interpretabilidad, que no tiene tendencia a hacerlo por su cuenta ni a tomar control de infraestructura externa.
  • Si puede escribir y ejecutar código de manera autónoma, debe acreditar que no va a usarlo para fines distintos a los autorizados.
  • Si puede coordinar muchos agentes a la vez, debe pasar pruebas específicas sobre comportamiento colectivo y desalineación.
  • Si puede asistir en tareas de ciberseguridad ofensiva, debe quedar sujeto a los mismos controles que un especialista humano con acceso a esas herramientas.
  • Si puede manipular pagos, cuentas o identidad, requiere verificaciones equivalentes a las de un operador financiero.

En paralelo, Amodei sugirió que las empresas del sector armen estándares comunes de forma voluntaria, con verificación externa, y que el gobierno de Estados Unidos facilite la conversación sin necesidad de meterse directamente. Una salida intermedia entre la autorregulación pura y la regulación rígida.

Lo que viene es incómodo. Tenemos modelos cada vez más capaces, una industria que se mueve más rápido que la regulación y un caso real, aunque menor, donde la coordinación autónoma ya se vio en acción. La pregunta es cuándo dejan de ser advertencias y empiezan a ser titulares de la sección policial.

DW

Comentarios

0

Todavía no hay comentarios. Sé el primero.

Seguí leyendo

Viajar en el tiempo