Lilith.
⌕

De Noticias

Noticias · 2026-10-02

OpenAI plantea GPT-6 como un sistema que operar, no como un ranking

OpenAI ha publicado una guía práctica para elegir modelos GPT-6, ajustar reasoning effort, diseñar prompts y skills, coordinar herramientas y llevar los flujos a producción. El mensaje de fondo es operativo: un único modelo predeterminado no basta, porque hay que medir calidad, tiempo y coste en todo el flujo.

Leer →

Noticias · 2026-09-30

OpenAI desmanteló una red de 15.000 usuarios que extraía el razonamiento oculto de sus modelos

OpenAI afirma que una campaña coordinada utilizó una red de más de 15.000 usuarios para extraer el razonamiento protegido de sus modelos. La empresa vincula el núcleo de la actividad con personas asociadas a Moonshot AI, aunque limita expresamente el alcance de esa atribución.

Leer →

Noticias · 2026-09-22

Opus 5.5 en modo max agotó 128 000 tokens con un solo pelícano

Simon Willison comparó los nuevos Claude Opus 5.5, GPT-6 Sol y GPT-6 Luna con la misma tarea de un pelícano en bicicleta. El resultado importante no fue la imagen: Opus 5.5 con esfuerzo max alcanzó dos veces su límite de 128 000 tokens de salida, señal de que un reasoning effort mayor necesita presupuesto y cortacircuitos.

Leer →

Noticias · 2026-09-15

Salesforce se basa en Nvidia para un modelo de IA destinado a robar el trabajo empresarial

El nuevo modelo Koa, construido con arquitectura de pesos abiertos de Nvidia, muestra el alejamiento empresarial de los grandes laboratorios. Para tareas rutinarias, las empresas ya no quieren enviar datos sensibles a modelos cerrados por millones de dólares.

Leer →

Noticias · 2026-09-09

GPT-6 Astra finalmente trae lógica de negocios y control de PC

OpenAI ha introducido un modelo para implementación corporativa que no solo razona mejor, sino que también puede controlar activamente una computadora. Para TI y desarrolladores, esto significa la necesidad de repensar lo que permitirán que haga el agente.

Leer →

Noticias · 2026-09-09

GPT-6 Astra: La cadena de pensamiento oculta no esconde más de lo que le falta a la propia arquitectura

El análisis de Sebastian Raschka muestra que las cadenas de pensamiento ocultas más cortas del nuevo modelo no son el resultado de intenciones maliciosas, sino un efecto secundario de una arquitectura más eficiente basada en los llamados transformadores en bucle.

Leer →

Noticias · 2026-09-08

Las leyes de escalado para agentes mostrarán si orquestar docenas de LLMs es un callejón sin salida

Nathan Lambert, del Allen Institute (AI2), plantea una pregunta clave: ¿se aplican las mismas leyes de escalado a los enjambres de múltiples agentes que al tamaño de los modelos o a la computación en tiempo de inferencia? La respuesta dictará la dirección del desarrollo de IA empresarial.

Leer →

Noticias · 2026-08-11

Un modelo débil filtra los pensamientos ocultos de sus hermanos mayores

Los investigadores explotaron un modelo débil para extraer trazas ocultas de razonamiento de los más fuertes. Esto demuestra que ocultar el razonamiento de un modelo en bloques cifrados es, por ahora, en su mayor parte una ilusión que expone involuntariamente 704 artefactos de privacidad.

Leer →

Noticias · 2026-08-12

DeepSeek lanza silenciosamente V4 Pro. Por ahora solo funciona a través de API

La startup china DeepSeek ha lanzado una nueva generación de su modelo V4 Pro sin comunicado de prensa oficial. El modelo de 1.7T parámetros está disponible actualmente a través de la API en la plataforma OpenRouter y como pesos en Hugging Face.

Leer →

Noticias · 2026-08-13

El plugin llm-gemini soporta modelos 3.7 Flash y experimentos de herramientas del lado del servidor

Simon Willison ha lanzado la versión 0.33 de su plugin llm-gemini. La actualización añade soporte para el modelo 3.7 Flash de Google y allana el camino para herramientas del lado del servidor a través de la herramienta CLI LLM versión 0.32, que expone los rastros de razonamiento del modelo.

Leer →

Noticias · 2026-08-29

Hy4: Tencent alcanza silenciosamente a la cima de los modelos abiertos

Tencent lanzó un nuevo modelo de 770B solo de texto con una ventana de contexto de 1 millón. Para los desarrolladores de código abierto, esto introduce otro peso pesado fuera del eje tradicional de EE. UU.

Leer →

Noticias · 2026-08-26

Qwen3.8-Flash-Next ofrece una capacidad masiva con activación escasa

El nuevo Qwen es un modelo masivo de 125B, pero solo 6B parámetros están activos durante la inferencia. Señala el camino hacia una mayor eficiencia sin perder capacidad.

Leer →

Noticias · 2026-08-21

llm-openrouter 0.7 activa herramientas del servidor, fetch y búsqueda web para los modelos

Simon Willison publicó una actualización de su plugin para OpenRouter. La nueva versión permite que los modelos utilicen directamente herramientas del servidor como Shell, WebFetch y WebSearch.

Leer →