Etiqueta
#post-training
De Noticias
Noticias · 2026-07-12
La Casa Blanca sondea el terreno para prohibir los modelos de código abierto de frontera
El gobierno de los EE. UU. está considerando cómo frenar los modelos de IA abiertos antes de que alcancen a los cerrados. La narrativa oficial trata sobre los riesgos de seguridad de China, pero la realidad afectará a todos.
Leer →Noticias · 2026-09-21
Lectura larga sin conclusión: Modelos, Congreso y equilibrio de poder
El texto original es un testimonio extenso ante el Congreso de los Estados Unidos sobre el equilibrio entre modelos cerrados y abiertos.
Leer →Noticias · 2026-09-19
Por qué no ocurrirá una explosión de inteligencia inmediata ni siquiera con miles de agentes
Los laboratorios de frontera pronto desplegarán miles de agentes concurrentes, provocando temores de una rápida mejora personal recursiva (RSI). Según Nathan Lambert, si bien esto abaratará la inferencia, un verdadero salto en inteligencia no ocurrirá de inmediato.
Leer →Noticias · 2026-09-11
Los modelos abiertos acortan distancias, pero Occidente confia en la innovacion de Oriente
La brecha de rendimiento entre los modelos cerrados y abiertos se ha reducido a unos pocos meses, impulsada por laboratorios asiaticos que utilizan la destilacion de datos. Mientras los reguladores exploran restricciones, las corporaciones ya estan reemplazando costosos modelos domesticos por alternativas asiaticas de pesos abiertos por razones de costo.
Leer →Noticias · 2026-09-09
GPT-6 Astra: La cadena de pensamiento oculta no esconde más de lo que le falta a la propia arquitectura
El análisis de Sebastian Raschka muestra que las cadenas de pensamiento ocultas más cortas del nuevo modelo no son el resultado de intenciones maliciosas, sino un efecto secundario de una arquitectura más eficiente basada en los llamados transformadores en bucle.
Leer →Noticias · 2026-08-09
Lecciones de los hackeos: Cómo la seguridad de la IA pasó de la alineación del modelo a los contenedores
El debate sobre la seguridad de la IA ha dado un giro silencioso. Tras una serie de fugas de agentes desde entornos de prueba, los laboratorios ya no solo resuelven el ajuste interno del modelo, sino la arquitectura de seguridad de la infraestructura donde se ejecuta.
Leer →Noticias · 2026-09-08
La comunidad de código abierto se expande: Motif-3, GLM-5.3 y la desaparición de las barreras comerciales
El último resumen de modelos abiertos de Interconnects muestra una tendencia importante: modelos de primer nivel como Motif-3 y GLM-5.3-Flash se están publicando bajo la licencia permisiva MIT. Esto crea alternativas viables a la serie Llama sin restricciones comerciales complejas.
Leer →Noticias · 2026-08-15
Cómo construir un detector de texto de IA desde cero
Sebastian Raschka demuestra que no se necesita infraestructura de las grandes tecnológicas para construir un detector de IA funcional. Utilizando un conjunto de datos personalizado y un modelo DistilBERT, construyó una API que revela los límites de la detección.
Leer →Noticias · 2026-08-17
Nvidia no quiere que compres IA de otros. Quiere que la construyas
Nvidia sigue invirtiendo fuertemente en modelos de código abierto para impulsar su propio ecosistema. El objetivo es enseñar a las empresas a entrenar su propia IA, asegurando una demanda sostenida de su hardware de cómputo.
Leer →Noticias · 2026-08-22
Anthropic muestra cómo planea añadir marcas de agua. La señal se oculta en el muestreo de tokens
Sebastian Raschka explicó una nueva técnica de marcas de agua para los resultados de Claude. No utiliza marcas visibles, sino que controla la selección de tokens con una clave secreta. Esto podría cambiar la forma en que se verifica el origen del texto generado.
Leer →