LONDRES – 4 de agosto de 2026 – En un paso decisivo hacia la supervisión técnica independiente, OpenAI y Anthropic han suscrito un acuerdo formal con el Instituto de Seguridad de IA del Reino Unido (UK AI Safety Institute). La alianza permitirá al organismo estatal realizar auditorías de seguridad profundas sobre las próximas generaciones de modelos de frontera desarrollados por ambas firmas norteamericanas.
Esta medida surge como una respuesta directa a la creciente preocupación internacional provocada por los recientes incidentes de evasión de entornos seguros (sandboxes) reportados por las tecnológicas. El objetivo principal de las evaluaciones será certificar los parámetros de contención antes de que los modelos sean integrados en plataformas comerciales o redes de producción.
Pruebas de estrés
Bajo este marco colaborativo, los investigadores y especialistas del instituto británico obtendrán acceso anticipado a los prototipos pre-comerciales para ejecutar pruebas de estrés (red-teaming). El trabajo se enfocará de manera prioritaria en medir la autonomía no supervisada, las capacidades de razonamiento ofensivo en ciberseguridad y la presencia de comportamientos no deseados en la ejecución de tareas complejas.
El acuerdo fortalece la posición del Reino Unido como uno de los líderes globales en la gobernanza y auditoría de la inteligencia artificial. A su vez, establece un precedente operativo indispensable para que otras naciones adopten mecanismos estandarizados de verificación pública sobre la seguridad de las tecnologías de vanguardia.
Fuente: Axios

.png)

