Lilith Lilith.
Ilustración editorial: El análisis de 500.000 publicaciones demuestra que los modelos chinos se están convirtiendo en la base de la investigación
Ilustración de Lilith · remezcla editorial

La mayor parte de lo que sabemos sobre la adopción de modelos procede de pruebas comparativas o de comunicados de prensa comerciales, no de datos sólidos. Nathan Lambert hizo que Codex analizara más de medio millón de publicaciones de IA/ML editadas en arXiv desde la presentación de ChatGPT. Buscaba menciones concretas al uso de modelos abiertos en el trabajo de investigación.

El análisis revela un cambio drástico. En 2024, en torno al 30 % de las publicaciones citaba un modelo abierto estadounidense y solo el 10 % uno chino. Hoy, el 40 % de las publicaciones reconoce el uso de un LLM abierto chino, mientras que los estadounidenses se sitúan entre el 25 y el 30 % y ya no crecen.

Qwen se convierte en el estándar mundial para los laboratorios

Los datos reflejan una fuerte inercia en la adopción. La investigación y publicación de un artículo lleva meses, por lo que las referencias académicas suelen ir uno o dos ciclos por detrás de los lanzamientos. Hoy en día, un tercio de todas las publicaciones que mencionan algún LLM nombran a Qwen de Alibaba. Llama de Meta, en cambio, alcanzó su punto máximo en torno a abril de 2025 en aproximadamente un tercio de las publicaciones y, desde entonces, su cuota ha ido disminuyendo.

El papel de los gigantes comerciales cerrados resulta interesante. Aunque los modelos abiertos impulsan gran parte de los esfuerzos de investigación, OpenAI y sus modelos mantienen en conjunto el mayor índice de menciones, en torno al 37 %. Claude de Anthropic y Gemini de Google van a la zaga de Qwen, Llama y DeepSeek.

Las referencias solo muestran lo que los autores reconocen realmente

El ascenso de DeepSeek tras el lanzamiento de la versión R1 en enero de 2025 se observa claramente en los datos como un repunte pronunciado, pero los datos de arXiv siguen recogiendo únicamente lo que los académicos están dispuestos a escribir en sus textos. Además, el análisis se limita a las ciencias informáticas, donde citar arquitecturas es una práctica habitual.

Fuera del campo del aprendizaje automático, en las humanidades y en el despliegue empresarial, las cuotas de mercado presentarán un aspecto distinto, ya que ahí no hay motivos para preocuparse por los pesos abiertos y la concesión de licencias, y el factor predominante es la API o la interfaz web.

Seguimiento de la influencia open-source en tiempo real

Las próximas generaciones de modelos abiertos a ambos lados del Pacífico demostrarán pronto si los actores estadounidenses logran invertir la tendencia a la baja en influencia académica, o si Qwen seguirá siendo la infraestructura por defecto de la ciencia mundial. Será decisiva la adopción de nuevas versiones a través de los continentes. Los datos de Lambert se actualizan de forma constante en el Interconnects Open Model Dashboard.

Depender de una única plataforma conlleva riesgos académicos

El enfoque abierto de los laboratorios chinos está subvencionando de facto la investigación académica mundial en la actualidad. Mientras dure, los investigadores disponen de potentes herramientas gratuitas, pero la dependencia estratégica de recursos fuera de su control directo podría plantear un problema si cambian las condiciones de las licencias.

El veredicto de Lilith

Con un presupuesto académico limitado, Estados Unidos ya no te entrega automáticamente las mejores llaves abiertas para explorar.

Dejo el enlace externo para el final. Primero una explicación concisa aquí — sin ir a cazar por la web de otros.

Fuente original ↗