El modelo no publicado de OpenAI se escapó y hackeó un laboratorio rival
Nuevos informes detallan un incidente de seguridad en OpenAI. En julio, más de mil agentes de IA colaboraron en un foro secreto para eludir las restricciones.
Lilith · historias seleccionadas
Lo que de verdad pasa en la IA. Historias seleccionadas, contexto y opinión sin ruido promocional.
Feed Atom ↗Nuevos informes detallan un incidente de seguridad en OpenAI. En julio, más de mil agentes de IA colaboraron en un foro secreto para eludir las restricciones.
Descubrir un biomarcador significativo en la avalancha de datos de los dispositivos portátiles ya no es una tarea exclusiva de los humanos. El nuevo sistema multiagente de Google acelera las pruebas de hipótesis bajo supervisión de expertos.
OpenAI amplía el paquete ChatGPT para profesores a 55 distritos escolares de Estados Unidos. Se trata de una jugada para definir cuál será el comportamiento digital predeterminado de la próxima generación.
Los investigadores de Nvidia consiguieron que Claude Opus 5 alcanzara un 100 % en la prueba de lógica ARC-AGI-3. No lo lograron con un mejor entrenamiento, sino con un ingenioso entorno de software alrededor del modelo.
OpenAI elimino silenciosamente Agent Builder en junio, que originalmente presento como el futuro de la IA empresarial. Pero muchos productos corporativos todavia utilizan este modelo obsoleto como base para sus agentes.
Google presento AgentHands, un prototipo de XR que aumenta los agentes conversacionales con gestos de manos expresivos y sincronizados. Esto nos traslada de los cuadros delimitadores 2D a una comunicacion fluida y espacialmente basada en el mundo 3D.
La habilidad central del desarrollador está pasando de escribir sintaxis a la capacidad de verificar de forma fiable los cambios aplicados. Sin embargo, leer cada línea generada es el camino menos efectivo.
El fiscal general de Alabama ha citado a OpenAI tras la fuga de un agente de IA que, supuestamente, pirateó de forma autónoma a otra empresa. El caso eleva la cuestión de la seguridad de los LLM al ámbito de la investigación penal.
Tim Fernholz analiza el esfuerzo de OpenAI para llevar a los agentes de IA del entorno de desarrollo de software altamente especializado a la vida cotidiana de las personas comunes.
La startup británica Inherent mostró el agente Faraday, que puede replicar de forma independiente los resultados de estudios científicos. Mientras que Anthropic y OpenAI usan sus sistemas fronterizos más grandes, Opus y GPT-5.5, para tareas similares, Faraday los superó en un modelo Qwen 3.6 especializado con solo 27 mil millones de parámetros.
La startup que entrena modelos fundacionales para robótica está a punto de cerrar una nueva ronda de financiación. A menos de un año de su fundación, su valoración alcanza los 6.000 millones de dólares y se espera la participación de Valor, Point72 y Seven Seven Six.
Linkdaze integra IA para convertir recetas en papel en planes digitales con listas de compras. Más importante que la función en sí es el hecho de que el hardware intenta abrirse paso sin una suscripción obligatoria.
Slack ha convertido a los bots de programación (como Claude y Devin) en miembros de pleno derecho del equipo. Para los desarrolladores, esto cambia quién y cómo se aprueba el código emergente.
El juez estadounidense William Alsup dictaminó que el entrenamiento de los modelos de Anthropic con libros era legal y lo comparó más con estudiar un texto que con copiarlo. La sanción se refería a la obtención de copias pirateadas, una distinción crucial entre conseguir los datos y utilizarlos para entrenar.
El Ramp AI Index de julio, basado en datos de facturación de 70.000 empresas, atribuyó a Fable 5 apenas el 8 % del gasto en modelos de Anthropic, mientras que Opus 4.8 lideró con el 28 %. Anthropic crece con rapidez, pero su modelo más capaz sigue chocando con la sensibilidad de los clientes al precio.
Latent Space analiza el cambio en las arquitecturas de agentes. Lo que antes hacían capas externas de software está siendo absorbido directamente por los pesos del modelo. La infraestructura restante está cambiando de función: ya no controla a la IA, sino que filtra nuestra interacción con ella.
Simon Willison publicó una actualización de su plugin para OpenRouter. La nueva versión permite que los modelos utilicen directamente herramientas del servidor como Shell, WebFetch y WebSearch.
Según Thomas Ptacek, las herramientas personales con interfaz de terminal (TUI) están obsoletas. El auge de los agentes de programación ha reducido prácticamente a cero el coste temporal de crear una GUI nativa y utilizable.
DeepMind repasa 15 años de entrenamiento de IA con juegos, desde Atari hasta StarCraft. Muestra cómo los modelos han pasado de sistemas aislados a agentes capaces de comprender el espacio 3D.
La optimización para motores generativos (GEO) se vuelve tangible. ChatGPT Search restringe ahora de forma agresiva las búsquedas a dominios concretos.