Lilith.
⌕

Lilith · historias seleccionadas

Noticias

Lo que de verdad pasa en la IA. Historias seleccionadas, contexto y opinión sin ruido promocional.

Feed Atom ↗
publicado
· X · @OpenAI ↗

OpenAI marcará texto en la UE, pero mantendrá privado el detector

OpenAI añadirá durante las próximas semanas un watermark invisible a los textos aptos de ChatGPT y Codex en la UE, mientras que los clientes de la API podrán activarlo voluntariamente en todo el mundo. Debido a que la edición debilita la detección y puede haber errores, el detector quedará inicialmente limitado a investigadores y organizaciones expertas aprobadas.

Simon Willison bloquea análisis clave detrás de un muro de pago, definiendo un nuevo estándar para analistas

El boletín de septiembre de Simon Willison destaca una tendencia creciente entre los principales creadores de tecnología: la mejor curaduría y análisis están desapareciendo de las fuentes RSS públicas detrás de las suscripciones. Para los desarrolladores, esto significa una mayor fragmentación del contenido que alguna vez fue abierto.

Sakana AI y Jürgen Schmidhuber unen fuerzas para desarrollar IA para el mundo real

La startup de IA con sede en Tokio, Sakana AI, ha conseguido a Jürgen Schmidhuber, uno de los pioneros de la inteligencia artificial, como su Asesor Científico Jefe. Un simposio conjunto en Tokio insinúa que la firma está cambiando su enfoque de los LLM a la inteligencia adaptativa del mundo real.

publicado

16.200 preguntas dibujaron el mapa oculto en un modelo de lenguaje

Una evaluación sencilla preguntó 16.200 veces a un modelo si unas coordenadas correspondían a tierra o agua y compuso un mapa mundial con las respuestas. El resultado revela de forma visual el conocimiento geográfico de los pesos, pero sin puntuación, baseline ni método completo sirve más como radiografía que como clasificación.

ThinkingBox evalúa a los agentes por la base de datos, no por su seguridad al responder

Microsoft y Hugging Face han publicado ThinkingBox, un benchmark de 507 tareas empresariales con estado que ejecuta cada tarea 20 veces y comprueba el resultado real en el backend. Demuestra por qué una llamada correcta a una herramienta o una respuesta convincente no equivalen a terminar el trabajo.

El debate sobre la conciencia de Claude llegó al Vaticano, pero importa más quién escribe su moral

David Ha, responsable de Sakana AI, resumió una fractura cultural en torno a Claude: Occidente debate sobre el alma de la máquina, mientras otros públicos preguntan si funciona. Bajo la broma aparece una cuestión más difícil: quién puede incorporar valores a un producto usado entre culturas.

publicado

AstaBrief redacta informes con citas en 51 segundos con 8.000 millones de parámetros

Ai2 ha publicado los pesos de AstaBrief 8B, que genera informes científicos con citas en modo Fast en una media de 51,1 segundos, frente a 178,5 segundos del modo Thinking. La velocidad y la opción de ejecutarlo en infraestructura propia resultan atractivas, pero buena parte de la evaluación procede de 2025 y el pequeño estudio humano solo incluyó 14 preguntas.