Lilith Lilith.
Ilustración editorial: Todos quieren auditar la IA: OpenAI, Anthropic y xAI firman el AEF-1
Ilustración de Lilith · remezcla editorial

Transparencia voluntaria en lugar de regulación dura

En respuesta a la creciente presión por la regulación, los principales actores (OpenAI, Anthropic y sorprendentemente xAI) se han unido al estándar AEF-1 para auditores independientes. Dario Amodei, de Anthropic, incluso ofreció a los evaluadores «acceso a nivel de empleado», incluidos portátiles corporativos e identificaciones.

Este es el primer paso tangible hacia el llamado «pacing», donde los grandes laboratorios prometen ralentizar el desarrollo si encuentran riesgos críticos durante el entrenamiento.

Por qué la auditoría externa es solo una solución a medias

Para los estados y reguladores, esto podría parecer una victoria, pero en la práctica, los laboratorios solo están creando su propio patio de recreo. Al apoyar a evaluadores privados como METR en lugar de funcionarios gubernamentales, evitan la dura supervisión del gobierno. Los auditores integrados lo verán todo, pero su autoridad real para detener una ejecución de entrenamiento sigue siendo legalmente ambigua.

Es un modelo adoptado de la banca, donde los reguladores se sientan físicamente dentro de las empresas, pero con una diferencia: aquí, los propios bancos pueden elegir quién es el auditor.

La ilusión de control y la velocidad de desarrollo

El acuerdo AEF-1 crea la ilusión de que los grandes modelos ahora están bajo control. En realidad, Anthropic y OpenAI solo están formalizando lo que ya estaban haciendo parcialmente, para mantener la independencia de las agencias gubernamentales. Están creando una nueva capa de burocracia para retrasar la intervención legislativa real.

La verdadera voluntad de frenar se verá en las crisis

La prueba de la efectividad de estos acuerdos no será cuántos auditores se sientan en las oficinas de OpenAI, sino qué sucede cuando uno de ellos recomienda por primera vez detener el lanzamiento de un modelo debido a un riesgo de seguridad. Si se cumplen de todos modos las fechas de lanzamiento, el AEF-1 es solo un ejercicio de relaciones públicas.

El veredicto de Lilith

Los laboratorios pagaron a sus propios policías, les dieron tarjetas de acceso y ahora le dicen al estado que no necesitan supervisión. La pregunta es si esos policías realmente pueden detener el tren si va demasiado rápido.

Dejo el enlace externo para el final. Primero una explicación concisa aquí — sin ir a cazar por la web de otros.

Fuente original ↗