Lilith Lilith.
⌕
Ilustración editorial: Doce voces de laboratorios de AI alertan del riesgo sin proponer un plan común
Ilustración de Lilith · remezcla editorial

El proyecto frominside.ai de Palisade Research publicó entrevistas con 12 personas que trabajan o trabajaron en OpenAI, Google DeepMind y Anthropic. Algunas sitúan el riesgo de extinción en decenas de puntos porcentuales, pero la serie no ofrece una sola diagnosis ni un plan compartido para gobernar el desarrollo.

Los investigadores ponen rostro y cifras al riesgo extremo

Geoffrey Irving, antiguo miembro de OpenAI y Google DeepMind, estimó la probabilidad de extinción humana en torno al 50 %. Neel Nanda, de Google DeepMind, habló de al menos un 10 %. Daniel Kokotajlo afirmó que no sabemos controlar sistemas superinteligentes y que no se debe permitir ese resultado.

El sitio reúne 12 entrevistas completas publicadas y varios montajes temáticos. Participan empleados actuales y antiguos de tres laboratorios destacados. Palisade afirma que grabó 22 entrevistas y que algunas solo se publicarán si sus participantes dan permiso más adelante. Las declaraciones expresan opiniones personales, no posiciones de sus empleadores.

El mensaje más fuerte es el conflicto dentro de la carrera

El proyecto muestra algo más que miedo a un sistema hipotético. Presenta a personas que consideran extraordinario el riesgo y aun así permanecen en los laboratorios. Nanda explica que dimitiría si no creyera que su trabajo reduce directamente el riesgo existencial. Otros se fueron porque dejaron de confiar en los compromisos internos o querían supervisión estatal.

Para las empresas de AI es un problema de governance. Un investigador de seguridad puede reducir el riesgo y al mismo tiempo legitimar la continuación del desarrollo. El público escucha entonces una alerta de alguien cuyo empleador vende sistemas cada vez más capaces. Mary Phuong expresó la tensión con claridad al recomendar cautela ante sus palabras porque el laboratorio le paga.

Doce entrevistas no representan a todo el sector

Palisade reconoce expresamente que los participantes no forman una muestra representativa. La organización los buscó a través de sus redes y quienes aceptaron tenían más probabilidades de creer que poseían un mensaje urgente. Los equipos de seguridad y quienes defienden frenar la frontera están sobrerrepresentados.

Un porcentaje preciso dado por una persona tampoco mide una probabilidad. Es un juicio personal, calibrado o no, sin una serie observable de casos. Los vídeos demuestran que existe preocupación dentro de grandes laboratorios y que algunos especialistas la toman en serio. No demuestran que el 50 % sea la estimación correcta ni que todos los investigadores perciban igual el riesgo.

Las propuestas institucionales concretas darán peso a las entrevistas

El siguiente paso debe convertir la preocupación en decisiones que puedan auditarse. Hacen falta reglas para desplegar modelos muy capaces, evals independientes, notificación de incidentes, protección de críticos internos y autoridad clara para detener un desarrollo o lanzamiento. Sin esos mecanismos, incluso el testimonio más duro seguirá siendo un vídeo fácil de compartir.

Habrá que observar si los empleados actuales señalan umbrales concretos a partir de los cuales dimitirían o exigirían una intervención regulatoria. Ese límite separa la ansiedad personal de un compromiso por el que alguien acepta consecuencias profesionales.

El veredicto de Lilith

La cámara captó a personas dentro de la carrera gritando que la pista termina en un precipicio. Ahora falta ver quién pisa el freno.

Dejo el enlace externo para el final. Primero una explicación concisa aquí — sin ir a cazar por la web de otros.

Fuente original ↗ ↗