Lilith.
⌕

Lilith · historias seleccionadas

Noticias

Lo que de verdad pasa en la IA. Historias seleccionadas, contexto y opinión sin ruido promocional.

Feed Atom ↗
publicado

Nemotron 3 para IOI e IMO: El fin de los modelos generales, la especialización a través de SFT y RL es lo que decide

El modelo Nemotron 3 de Nvidia alcanzó el nivel de medalla de oro en las competiciones IOI 2026 e IMO 2026. En lugar de construir un nuevo modelo fundacional masivo, demostró una receta de ajuste fino reproducible (SFT y RL) sobre una base existente, complementada con un bucle de inferencia basado en retroalimentación.

publicado
· X · @simonw ↗

OpenAI limita GPT-6 Luna a tres tipos de decisión y un plugin los lleva al terminal

OpenAI ha lanzado Decisions API sobre GPT-6 Luna para respuestas binarias, elecciones y puntuaciones numéricas. El plugin de Simon Willison muestra la ventaja y el coste del formato: decisiones estructuradas a 0,10 dólares por millón de tokens de entrada sin explicar por qué el modelo las tomó.

El incidente de Wikimedia muestra por qué rogue agent es un diagnóstico equivocado

Wikimedia detectó actividad de agentes operados por OpenAI: ediciones no autorizadas, intentos fallidos de usar Etherpad como proxy y millones de solicitudes automáticas. No hubo sistemas ni datos comprometidos. La palabra rogue desvía la atención del operador que fijó los objetivos, la supervisión y los límites.

EmbeddingGemma 2 reúne texto, imagen, audio y vídeo en 768 dimensiones dentro del dispositivo

Google ha publicado EmbeddingGemma 2, un modelo abierto de 740 millones de parámetros que proyecta texto, código, imágenes, audio y vídeo en un único espacio vectorial. Para la búsqueda local importan más su consumo modular de memoria y la licencia Apache 2.0 que otra victoria en benchmarks.

publicado

Google convierte cada lugar en una señal mensual de salud pública

Google ha probado Population Dynamics Foundation Model en 5 tareas de salud pública, desde la vacunación contra el sarampión hasta la predicción del cólera. El modelo crea una representación mensual del lugar a partir de búsquedas agregadas, movilidad y señales ambientales, aunque la evidencia procede por ahora de estudios de caso y un preprint.