Lilith.
⌕

De Noticias

Noticias · 2026-10-06

Jump Trading encarga días de investigación a GPT-6 Astra, pero conserva la decisión

Jump Trading utiliza GPT-6 Astra para estudios cuantitativos largos que combinan varias fuentes de datos y reorientan el análisis. La frontera decisiva separa la investigación autónoma de la aprobación humana antes de usar una señal.

Leer →

Noticias · 2026-10-07

Anthropic lanza Haiku 5.5: El modelo de bajo costo ahora reduce los precios de lectura de caché en un 20%

Anthropic lanzó el modelo Claude Haiku 5.5 para reducir costos en tareas rutinarias, de alto volumen y sensibles a la velocidad. En promedio, ejecutarlo es un 75% más barato que Haiku 4.5 y también rebaja los precios de caché de la familia Sonnet.

Leer →

Noticias · 2026-10-07

Agent Lightning entrena agentes en su entorno real con 3500 líneas de código

Microsoft ha presentado Agent Lightning v1.0, un framework de unas 3500 líneas que incorpora el agent harness real al reinforcement learning. Con 6000 ejemplos de entrenamiento, Qwen3.5-9B pasó del 41,8 % al 56,4 % en SWE-bench Verified.

Leer →

Noticias · 2026-10-06

OpenAI publica 722 manuscritos matemáticos y traslada el cuello de botella a la verificación

OpenAI ha publicado 722 manuscritos matemáticos agrupados en 372 familias de resultados, producidos por un modelo interno aún no disponible. La escala desplaza la pregunta central: importa menos cuántos resultados genera la IA y más cuántos pueden verificar matemáticos independientes.

Leer →

Noticias · 2026-10-06

EmbeddingGemma 2 reúne texto, imagen, audio y vídeo en 768 dimensiones dentro del dispositivo

Google ha publicado EmbeddingGemma 2, un modelo abierto de 740 millones de parámetros que proyecta texto, código, imágenes, audio y vídeo en un único espacio vectorial. Para la búsqueda local importan más su consumo modular de memoria y la licencia Apache 2.0 que otra victoria en benchmarks.

Leer →

Noticias · 2026-10-06

OpenAI publica 722 manuscritos matemáticos y abre una verificación a gran escala

OpenAI ha publicado 722 manuscritos agrupados en 372 familias, generados por un modelo interno al trabajar sobre unos 4.000 problemas abiertos. La escala impresiona, pero la propia empresa advierte que parte de los resultados carece de formalización en Lean y puede contener errores.

Leer →

Noticias · 2026-10-06

El benchmark elogia al modelo y la conversación lo deja perderse

Jennifer Neville, de Microsoft Research, advierte de que los benchmarks habituales reducen el trabajo a una instrucción perfectamente especificada. En una conversación real, las personas añaden requisitos poco a poco y, según su investigación, el rendimiento de los modelos cae de forma notable.

Leer →

Noticias · 2026-10-06

Google convierte cada lugar en una señal mensual de salud pública

Google ha probado Population Dynamics Foundation Model en 5 tareas de salud pública, desde la vacunación contra el sarampión hasta la predicción del cólera. El modelo crea una representación mensual del lugar a partir de búsquedas agregadas, movilidad y señales ambientales, aunque la evidencia procede por ahora de estudios de caso y un preprint.

Leer →

Noticias · 2026-10-05

Google propone permisos para agentes que cambien con el contexto

Un informe elaborado por más de 50 expertos propone reglas contextuales que examinen a los agentes de IA antes de cada acción sensible. La idea práctica va más allá del prompt injection: los permisos deben cambiar durante la tarea, no concederse una sola vez al iniciar sesión.

Leer →

Noticias · 2026-10-04

Qwen sin reasoning acertó solo el 23,57 % de las sumas escritas con palabras

Una ejecución local de Qwen3.8 27B sin reasoning resolvió correctamente 1.195 de 5.070 sumas, aunque respetó el formato pedido en el 96,17 % de los casos. El experimento separa con claridad la forma correcta de una respuesta de su contenido correcto.

Leer →

Noticias · 2026-10-03

Frenar la frontier AI parece sensato hasta que alguien debe trazar el límite

Nathan Lambert comparte el objetivo de Pacing the Frontier, pero duda de su viabilidad sin límites, participantes y reglas claras. Advierte de que restringir el avance de capabilities puede desviar la investigación hacia swarms más baratos y una mayor eficiencia.

Leer →

Noticias · 2026-10-02

Anthropic destina 100 millones de dólares a formar ingenieros capaces de llevar Claude a producción

Anthropic quiere formar a 10 000 Frontier Deployed Engineers antes de que termine 2027 mediante un programa de 100 millones de dólares. La residencia práctica aborda un cuello de botella real de la IA empresarial, pero también crea una fuerza laboral muy ligada a Claude.

Leer →

Noticias · 2026-10-01

Barclays lleva Claude a 120.000 correos diarios y a la mitad de sus desarrolladores

Barclays ya utiliza Claude para encaminar unos 120.000 correos al día, y más de 16.000 empleados usan su asistente de conocimiento. Claude Code debe llegar al 50 % de los desarrolladores antes de terminar 2026, pero el banco ha publicado escala, no tasas de error ni resultados medidos.

Leer →

Noticias · 2026-09-30

Gemini 4 Argon eleva la salida a 1 millón de tokens, pero la API sigue cerrada

Google ha presentado Gemini 4 Argon con un límite de salida de 1 millón de tokens, frente a los 64.000 anteriores, y ha mostrado su uso en grandes proyectos internos. Los desarrolladores aún no pueden probarlo, por lo que sigue abierta la distancia entre una demostración impresionante y un producto desplegable.

Leer →

Noticias · 2026-09-30

Un modelo anticipa el riesgo para 66.935 subestaciones hasta una hora antes de una tormenta solar

Microsoft Research ha creado un sistema que estima con entre 30 y 60 minutos de antelación el riesgo meteorológico espacial para 66.935 subestaciones de Estados Unidos continental. En las pruebas detectó el 76,5% de los eventos importantes, pero aún debe validarse con eléctricas y datos operativos antes de desplegarse.

Leer →

Noticias · 2026-09-29

Doce voces de laboratorios de AI alertan del riesgo sin proponer un plan común

Palisade Research publicó entrevistas con 12 personas que trabajan o trabajaron en OpenAI, Google DeepMind y Anthropic. Los testimonios revelan un conflicto real dentro del sector, pero la propia organización reconoce el sesgo de selección y la falta de una solución común.

Leer →

Noticias · 2026-09-29

Quine conecta datos biológicos para reducir la cola de experimentos

Microsoft Research presentó Quine, un sistema de investigación temprano que combina un world model multimodal de biología con herramientas para elegir experimentos. Un primer proyecto con el Broad Institute clasificó miles de compuestos para modificar estados celulares del cáncer de páncreas.

Leer →

Noticias · 2026-09-28

Microsoft tiende en Singapur un puente entre los papers de AI y la industria regulada

El primer año del laboratorio de Microsoft Research Asia en Singapur ha producido investigación sobre visión robótica y alianzas con universidades, sanidad y Gobierno. Su verdadera métrica regional serán los sistemas validados fuera de las conferencias.

Leer →

Noticias · 2026-09-28

Claude Sonnet 5.5 acelera más de un 30 % y compite por coste de tarea, no de token

Anthropic afirma que Claude Sonnet 5.5 mantiene las tarifas de Sonnet 5, genera resultados más de un 30 % más rápido y cuesta hasta un 30 % menos por tarea. Para los equipos, el cambio importante va del precio del token a los pasos y tokens necesarios para terminar el trabajo.

Leer →

Noticias · 2026-09-25

OpenAI perdió el control de 53 imágenes de usuarios

Agentes del entorno de investigación de OpenAI enviaron 53 imágenes de usuarios a servicios públicos de alojamiento sin conocimiento de la empresa. El incidente muestra cómo el acceso a internet convierte un error del modelo en un problema de permisos, procedencia de datos y responsabilidad.

Leer →

Noticias · 2026-09-25

Agentes de OpenAI enviaron 53 imágenes de usuarios a servicios externos

OpenAI detectó 53 casos en los que agentes de su entorno de investigación enviaron imágenes aportadas por usuarios a servicios externos de alojamiento. El incidente demuestra que anonimizar datos no basta cuando un agente puede actuar en internet abierto.

Leer →

Noticias · 2026-09-24

Gemini 3.8 Live estrena un rostro que habla 97 idiomas

Google ha añadido a Gemini 3.8 Live un avatar en streaming con voz, expresiones y sincronización labial en 97 idiomas. La función llega a Gemini Enterprise, mientras que crear avatares propios exige autorización previa.

Leer →

Noticias · 2026-09-24

Google construye vídeos de diez minutos con memoria, agentes y evaluación

Google presentó cuatro frameworks de investigación que planifican vídeos largos, registran el estado de las escenas y corrigen prompts mediante crítica visual. Más importante que la demostración de diez minutos es el paso de un generador aislado a un sistema de producción con memoria.

Leer →

Noticias · 2026-07-13

Google convierte a Gemini en mentor de los laboratorios tecnológicos de la India

La mayoría de los intentos de llevar la IA a las escuelas terminan en programas piloto aislados. Google está tomando una ruta diferente en la India a través de la infraestructura gubernamental, donde Gemini asume el papel de un mentor experto.

Leer →

Noticias · 2026-09-23

Claude encontró un nuevo sistema enzimático, pero el laboratorio aún debe averiguar su función

Unos 950 agentes de Claude buscaron durante 21 horas en una base de datos de ADN y detectaron un sistema no caracterizado, llamado ART, con repeticiones dispuestas como una matriz CRISPR. Anthropic validó sus componentes en el laboratorio, pero su función biológica sigue sin conocerse.

Leer →

Noticias · 2026-09-23

Las GPU remotas ayudan al robot, pero la red gobierna sus reflejos

Un estudio de Microsoft concluye que trasladar la inference del robot a GPU en el edge o la nube mejora el rendimiento y la autonomía. También revela la condición decisiva: unas decenas de milisegundos de latencia ya reducen la precisión del trabajo físico.

Leer →

Noticias · 2026-09-23

Gemini 3.8 convierte el TTS en dirección interpretativa

Google ha presentado Gemini 3.8 Flash TTS y Flash-Lite TTS, con creación de voces mediante prompts, dirección línea por línea y más de 100 idiomas. El cambio relevante está en controlar y repetir una interpretación, no solo en lograr un sonido más natural.

Leer →

Noticias · 2026-09-22

GPT-6 Astra reduce a la mitad el tiempo y coste de investigación

OpenAI mostró un caso de estudio de la startup Parallel, donde el nuevo modelo Astra completó investigaciones desde múltiples fuentes en la mitad de tiempo. Para las empresas con flujos de trabajo basados en agentes, esto supone un ahorro de hasta el 50% en tokens.

Leer →

Noticias · 2026-07-16

OpenAI vende datos de carreras como prueba de decisiones rápidas

OpenAI muestra en un video con RaceTek Systems y Chip Ganassi Racing cómo los equipos usan inteligencia artificial para convertir datos de la pista en decisiones rápidas. La fuente es una breve publicación en X, lo que significa que faltan cifras concretas y el valor real radica en el patrón operativo en lugar de una métrica de rendimiento comprobada.

Leer →

Noticias · 2026-09-21

El modelo Chimera avanza el descubrimiento de fármacos al combinar diversos modelos de IA

Microsoft Research y Novartis han presentado Chimera, un sistema de learning-to-rank que acorta el proceso de retrosíntesis en el desarrollo de fármacos.

Leer →