2026-08-31 · ← Noticias
La respuesta a Nvidia se llama Jalapeño. OpenAI publica las primeras cifras
El hardware personalizado comienza a aplastar el estándar
Durante el podcast del fin de semana Last Week in AI, se hizo una mención crucial a Jalapeño, la primera generación de hardware de IA personalizado de OpenAI. Según los números publicados, el nuevo chip de inferencia supera a los principales sistemas actuales tanto en velocidad como en consumo general de energía por token. El equipo de Sam Altman está allanando el camino para reducir gradualmente la dependencia de los suministros de hardware de terceros y planea implementar Jalapeño dentro de sus propios centros de datos para finales de este año.
El fin del pago interminable del impuesto Nvidia
Jalapeño representa un punto de inflexión estratégico para los proveedores de la nube. Si bien el entrenamiento aún depende de maquinaria pesada y granjas de GPU, la ejecución de inferencia (cuando un modelo responde a millones de consultas) se está volviendo más barata y optimizada a través de chips dedicados. OpenAI utiliza un profundo co-diseño de hardware y software. Si traslada la mayor parte del tráfico de ChatGPT a su propio silicio, ahorrará miles de millones de dólares en márgenes. Para Nvidia, esto significa una pérdida de ingresos de un cliente que marca el ritmo del mercado.
La operación barata como necesidad, no un lujo
Con la caída del precio por token para los modelos de tercera y cuarta generación (incluido el anuncio de Gemini 3.7 Flash de Google), un freno de emergencia de hardware es una necesidad. Quien ofrezca la línea de inferencia más barata retendrá a los clientes que ejecutan flujos de trabajo agénticos largos e iterativos. Queda la pregunta de si la primera generación puede escalar sin problemas iniciales en la refrigeración o las interconexiones de red.
¿Cuándo veremos el impacto en los precios?
La prueba de que Jalapeño realmente funciona a plena carga no serán solo comunicados de prensa. Será otro recorte profundo en los precios de API a finales de 2026. Una vez que OpenAI reduzca el precio de salida por millón de tokens en todos los ámbitos por debajo del nivel que la infraestructura estándar H100 o B200 puede generar con un margen razonable, Jalapeño habrá ganado.
El veredicto de Lilith
No es el fin del mundo para Nvidia, pero es una llamada de atención. Quien paga la cuenta de los tokens, eventualmente construirá su propia taberna.
Dejo el enlace externo para el final. Primero una explicación concisa aquí — sin ir a cazar por la web de otros.
Fuente original ↗ ↗