Etiqueta
#open-source
De Noticias
Noticias · 2026-10-07
Nemotron 3 para IOI e IMO: El fin de los modelos generales, la especialización a través de SFT y RL es lo que decide
El modelo Nemotron 3 de Nvidia alcanzó el nivel de medalla de oro en las competiciones IOI 2026 e IMO 2026. En lugar de construir un nuevo modelo fundacional masivo, demostró una receta de ajuste fino reproducible (SFT y RL) sobre una base existente, complementada con un bucle de inferencia basado en retroalimentación.
Leer →Noticias · 2026-10-07
Open d1 decide en el edge en 16 ms, pero aún faltan pruebas multimodales
Liquid AI ha publicado con open weights d1-3B y el experimental d1-omni-600M para tomar decisiones estructuradas sin generar tokens. d1-3B responde en 16 ms en Jetson AGX Thor, pero el lanzamiento no incluye benchmarks de vision ni audio.
Leer →Noticias · 2026-10-03
ThinkingBox evalúa a los agentes por la base de datos, no por su seguridad al responder
Microsoft y Hugging Face han publicado ThinkingBox, un benchmark de 507 tareas empresariales con estado que ejecuta cada tarea 20 veces y comprueba el resultado real en el backend. Demuestra por qué una llamada correcta a una herramienta o una respuesta convincente no equivalen a terminar el trabajo.
Leer →Noticias · 2026-10-02
La AI escribe el 60 % del código de Airbnb, pero el cambio está en los relevos
El CTO de Airbnb, Ahmad Al-Dahle, afirma que la AI crea el 60 % del código y que el flujo medio de pull requests por ingeniero creció 1,6 veces. El cambio profundo está en sustituir documentos y relevos por prototipos, el grafo Everest y evals para cada caso de uso.
Leer →Noticias · 2026-10-02
AstaBrief redacta informes con citas en 51 segundos con 8.000 millones de parámetros
Ai2 ha publicado los pesos de AstaBrief 8B, que genera informes científicos con citas en modo Fast en una media de 51,1 segundos, frente a 178,5 segundos del modo Thinking. La velocidad y la opción de ejecutarlo en infraestructura propia resultan atractivas, pero buena parte de la evaluación procede de 2025 y el pequeño estudio humano solo incluyó 14 preguntas.
Leer →Noticias · 2026-09-28
Holo4 combina pantalla, código y API, pero sus benchmarks corren en pistas distintas
H Company ha lanzado los modelos Holo4 27B y 35B-A3B, que combinan control de GUI, ejecución de código y llamadas MCP o API en un solo agente. Los pesos abiertos y las trayectorias publicadas mejoran la verificabilidad, aunque los resultados obtenidos con distintos harnesses y conjuntos de tareas dificultan la comparación directa con modelos cerrados.
Leer →Noticias · 2026-07-12
La Casa Blanca sondea el terreno para prohibir los modelos de código abierto de frontera
El gobierno de los EE. UU. está considerando cómo frenar los modelos de IA abiertos antes de que alcancen a los cerrados. La narrativa oficial trata sobre los riesgos de seguridad de China, pero la realidad afectará a todos.
Leer →Noticias · 2026-09-24
DSpark acelera un modelo visual hasta 3,13 veces, pero no adelanta el primer token
Liquid AI ha añadido a LFM2.5-VL-3B un drafter experimental de 279,5 millones de parámetros para speculative decoding. La decodificación acelera hasta 3,13 veces y el proceso completo hasta 2,62 veces, porque la codificación de imagen y el prefill no cambian.
Leer →Noticias · 2026-07-16
DharmaOCR muestra que un modelo estrecho sigue ganando en sus propios documentos
Dharma-AI afirma que su OCR de portugués brasileño venció a los modelos más recientes Mistral OCR4 y Unlimited-OCR. En un dominio estrecho, los datos específicos aún superan a la capacidad bruta.
Leer →Noticias · 2026-09-21
Lectura larga sin conclusión: Modelos, Congreso y equilibrio de poder
El texto original es un testimonio extenso ante el Congreso de los Estados Unidos sobre el equilibrio entre modelos cerrados y abiertos.
Leer →Noticias · 2026-09-19
Por qué no ocurrirá una explosión de inteligencia inmediata ni siquiera con miles de agentes
Los laboratorios de frontera pronto desplegarán miles de agentes concurrentes, provocando temores de una rápida mejora personal recursiva (RSI). Según Nathan Lambert, si bien esto abaratará la inferencia, un verdadero salto en inteligencia no ocurrirá de inmediato.
Leer →Noticias · 2026-09-15
Los agentes sacan un diez en la demo. ¿Por qué fallan en producción?
Si le asignas a un agente de IA la misma tarea de producción diez veces, es posible que elija un camino diferente cada vez y se encuentre con problemas distintos. Una nueva investigación de IBM y Hugging Face señala que los puntos de referencia tradicionales ignoran esta inconsistencia.
Leer →Noticias · 2026-09-11
Los modelos abiertos acortan distancias, pero Occidente confia en la innovacion de Oriente
La brecha de rendimiento entre los modelos cerrados y abiertos se ha reducido a unos pocos meses, impulsada por laboratorios asiaticos que utilizan la destilacion de datos. Mientras los reguladores exploran restricciones, las corporaciones ya estan reemplazando costosos modelos domesticos por alternativas asiaticas de pesos abiertos por razones de costo.
Leer →Noticias · 2026-09-09
IBM lanzó un modelo de código abierto para series temporales que supera a los gigantes
IBM lanzó PatchTST-FM-r2, un nuevo modelo fundacional para series temporales con 385 millones de parámetros. El modelo ocupa el primer lugar en pronóstico zero-shot entre los competidores con licencia abierta en el benchmark GIFT-Eval.
Leer →Noticias · 2026-08-09
Lecciones de los hackeos: Cómo la seguridad de la IA pasó de la alineación del modelo a los contenedores
El debate sobre la seguridad de la IA ha dado un giro silencioso. Tras una serie de fugas de agentes desde entornos de prueba, los laboratorios ya no solo resuelven el ajuste interno del modelo, sino la arquitectura de seguridad de la infraestructura donde se ejecuta.
Leer →Noticias · 2026-09-08
La comunidad de código abierto se expande: Motif-3, GLM-5.3 y la desaparición de las barreras comerciales
El último resumen de modelos abiertos de Interconnects muestra una tendencia importante: modelos de primer nivel como Motif-3 y GLM-5.3-Flash se están publicando bajo la licencia permisiva MIT. Esto crea alternativas viables a la serie Llama sin restricciones comerciales complejas.
Leer →Noticias · 2026-09-08
El bloqueo total como coartada: Hugging Face analiza los fallos de seguridad de la IA
Un incidente de seguridad reciente en Hugging Face ha provocado un debate sobre cómo los creadores de modelos manejan los riesgos. En lugar de un filtrado quirúrgico, las plataformas aplican una prohibición generalizada sobre ciertos temas. Así, la seguridad suele servir para proteger al operador, no al usuario.
Leer →Noticias · 2026-08-10
Meta lanza Muse Glimmer local con licencia limpia para agentes
Meta vuelve al juego de los pesos abiertos. Su nuevo modelo visual de 30B, Muse Glimmer, viene con licencia Apache 2.0 y está diseñado desde cero para agentes locales.
Leer →Noticias · 2026-09-03
RL desplaza la percepción de la belleza del ser humano al modelo
Un experimento abierto muestra que RL (Aprendizaje por Refuerzo) se puede utilizar no solo para resolver matemáticas y código, sino también para entrenar la apreciación estética. El propio modelo escribe JavaScript que simula la pintura de acuarela.
Leer →Noticias · 2026-08-17
Nvidia no quiere que compres IA de otros. Quiere que la construyas
Nvidia sigue invirtiendo fuertemente en modelos de código abierto para impulsar su propio ecosistema. El objetivo es enseñar a las empresas a entrenar su propia IA, asegurando una demanda sostenida de su hardware de cómputo.
Leer →Noticias · 2026-08-20
Liquid AI acelera los agentes locales con los modelos DSpark para LFM2.5
Los modelos locales en computadoras portátiles recibieron un aumento sustancial de velocidad. Liquid AI lanza modelos preliminares DSpark que permiten que la familia LFM2.5 alcance hasta 2,87 veces la velocidad en el dispositivo de Apple mediante la decodificación especulativa, manteniendo la calidad de salida.
Leer →Noticias · 2026-08-21
Las puntuaciones de los modelos ya no reflejan las capacidades reales
Los modelos de reconocimiento de voz obtienen grandes resultados en las pruebas públicas, pero un nuevo estudio demuestra que están aprendiendo a hacer trampas. Investigadores de Hugging Face han descubierto que los modelos mejor valorados reproducen errores de los datos de prueba en lugar de transcribir lo que realmente escuchan.
Leer →Noticias · 2026-08-26
Hugging Face muestra cómo entrenar su propio modelo multivectorial en horas en una sola GPU
Una nueva actualización de la biblioteca Sentence Transformers agrega soporte para interacción tardía al estilo ColBERT. Los desarrolladores pueden ajustar los modelos a su propio dominio independientemente de los límites generales de los modelos existentes.
Leer →Noticias · 2026-08-25
El modelo de 4 bits que olvido su peor estado y juega en una liga superior
Hugging Face y Multiverse Computing muestran el metodo Quantization-Aware Healing (QAH), que permite que un modelo mas pequeno de 4 bits supere a su version bfloat16 no comprimida en las pruebas. Para los equipos que ahorran memoria GPU, esto cambia la perspectiva: la compresion ya no es una perdida, sino un camino real hacia respuestas mas precisas.
Leer →