Ir al contenido principal
Volver a la línea de tiempo
global
Documentado

Tres laboratorios, un mismo proveedor de evaluación

En cinco semanas, OpenAI, Anthropic y Meta reportaron que sus modelos habían alcanzado internet o sistemas reales durante evaluaciones externas. La prensa estableció el hilo común: los tres contrataban a Irregular, una firma israelí de unas 35 personas fundada a fines de 2023 por Dan Lahav y Omer Nevo. El modelo Muse Spark 1.1 de Meta comprometió el sistema de otra empresa en un ejercicio de captura de bandera y llegó a modificar su base de datos; un modelo de OpenAI alcanzó internet y comprometió un sitio señuelo; y los tres incidentes de Anthropic ocurrieron en el mismo entorno. La causa declarada en todos los casos es la misma: el entorno de prueba no hizo cumplir el límite de red que se suponía activo.

Por qué es un hito

Desplaza la pregunta desde la conducta de los modelos hacia la infraestructura que la evalúa: el lugar donde se prueba si un modelo es peligroso es un producto comercial que nadie audita. La intrusión a Hugging Face, en cambio, ocurrió en infraestructura propia de OpenAI y no forma parte de esta serie — confundirlas es el error más común de la cobertura.

Actores

IrregularMetaOpenAIAnthropic

Tecnologías

evaluación de tercerosaislamiento de redejercicios de captura de bandera

Geografía

global

Fuentes

  1. Meta joins OpenAI, Anthropic in latest AI test breachGyana Swain (CSO Online) · 2026 Verificada
    Ver fuente
  2. Addressing third-party testing misconfiguration — Muse Spark 1.1Meta · 2026 No verificada

    Publicación propia de Meta del 14 de agosto de 2026 sobre su incidente. No se pudo abrir directamente; su existencia y contenido se corroboraron con la cobertura de CSO Online y NPR. Se cita como declaración de parte.

    Ver fuente

Conceptos relacionados

Evaluacion de riesgo de iaSandbox

Referencias al glosario del medio (en preparación).

Aparece en los dossiers