Alibaba publica el modelo de IA de pesos abiertos Qwen3.8-Max con valores de referencia en pruebas de programación
Hangzhou, 3 de agosto de 2026
N509FZ / Wikimedia Commons / CC BY-SA 4.0
Summary
Alibaba ha publicado el modelo de IA Qwen3.8-Max como versión de pesos abiertos y reclama con ello una posición de liderazgo entre los sistemas de IA para tareas de programación. En varios benchmarks, el modelo alcanza valores que en parte superan a los de competidores consolidados como Claude Fable 5 de Anthropic y GPT-5.6 Sol de OpenAI.
Hangzhou, 3 de agosto de 2026
El conglomerado tecnológico chino Alibaba presentó el 3 de agosto de 2026 su nuevo modelo de IA Qwen3.8-Max como publicación de pesos abiertos y lo sitúa, en benchmarks de programación, al nivel de los sistemas líderes de Anthropic y OpenAI.
El conglomerado tecnológico chino Alibaba ha publicado su nuevo modelo de lenguaje de IA Qwen3.8-Max como versión de pesos abiertos. Los modelos de pesos abiertos difunden los parámetros aprendidos de la red neuronal, de modo que las desarrolladoras y los desarrolladores pueden operar el modelo de forma independiente, adaptarlo y seguir utilizándolo. Con este paso, Alibaba entra en una competencia por la cima entre los sistemas de IA para tareas de programación, que hasta ahora había estado dominada sobre todo por proveedores estadounidenses.
En comparaciones internas de benchmarks, Qwen3.8-Max obtiene resultados claramente mejores que su modelo predecesor Qwen3.7-Max en varias pruebas. En la plataforma Terminal Bench 2.1, el nuevo modelo alcanza un valor de 86,6, situándose por delante de su predecesor con 74,5. En SWE-bench Pro, Qwen3.8-Max obtiene 67,7 puntos, frente a 60,6 de Qwen3.7-Max. También en DeepSWE 1.1 (56,6 frente a 21,6), FrontierSWE (73,5 frente a 40,7) y PaperBench (93,0 frente a 64,8) se observa un salto notable respecto a la versión anterior.
Resumen de los resultados de los benchmarks
En la comparación directa con los modelos comerciales actualmente líderes, Qwen3.8-Max ofrece resultados dispares. En Terminal Bench 2.1, con 86,6 puntos, se sitúa por delante de Claude Fable 5 de Anthropic (84,6) y de GPT-5.6 Sol de OpenAI (88,8). En SWE-bench Pro, GPT-5.6 Sol (80,0) y Claude Fable 5 (69,2) encabezan la clasificación por delante del nuevo modelo de Alibaba (67,7). En la prueba FrontierSWE, Qwen3.8-Max ocupa con 73,5 puntos el segundo lugar, por detrás de GPT-5.6 Sol (88,8). En GPQA Diamond, una prueba de razonamiento lógico, Qwen3.8-Max alcanza 92,6 puntos, igualando a Claude Fable 5 (92,6) y situándose por detrás de GPT-5.6 Sol (94,1).
Los benchmarks son pruebas estandarizadas con las que se mide la capacidad de los modelos de IA en tareas claramente definidas, como la generación de código o el razonamiento lógico. Permiten comparaciones entre sistemas de distintos proveedores, aunque solo pueden reflejar de forma limitada la relevancia práctica, ya que las tareas reales difieren del entorno de prueba. Aun así, los observadores del sector interpretan la publicación como una señal de que la distancia entre los desarrollos de IA chinos y estadounidenses se ha reducido.
Los pesos abiertos como enfoque estratégico
Con la estrategia de pesos abiertos, Alibaba sigue un enfoque distinto al de sus competidores estadounidenses directos. Mientras que OpenAI apuesta con GPT-5.6 Sol por sistemas cerrados cuyos pesos internos no se publican, Alibaba permite a desarrolladores externos acceder a los parámetros del modelo. Esto facilita adaptaciones independientes, implementaciones locales y auditorías de seguridad independientes. Expertos del sector lo consideran una ventaja competitiva en mercados con requisitos de soberanía de datos, como Europa.
La publicación se enmarca en una serie de lanzamientos de modelos chinos. Junto a Qwen3.8-Max, también el modelo Kimi K3 se posiciona como competidor relevante en el segmento de pesos abiertos. Ambos sistemas son desarrollados por proveedores chinos que apuestan cada vez más por publicaciones abiertas para atraer a comunidades internacionales de desarrolladores e influir en los estándares tecnológicos.
Disponibilidad y validación independiente
Alibaba ha anunciado que pondrá el modelo a disposición a través de su plataforma en la nube, así como mediante la plataforma Hugging Face, en la que las desarrolladoras y los desarrolladores pueden descargar modelos de IA y seguir desarrollándolos de forma colaborativa. De este modo, Qwen3.8-Max estará disponible inmediatamente después de su publicación para pruebas y aplicaciones fuera de la infraestructura de Alibaba. Sobre las condiciones concretas de licencia y las formas de uso comercial permitidas, la empresa no ha facilitado información detallada en su comunicado hasta el momento.
Los valores de los benchmarks provienen de cuatro informes independientes que clasifican el modelo Qwen3.8-Max de forma coincidente con las puntuaciones indicadas. Una validación por parte de organismos independientes ajenos a las pruebas de Alibaba para los resultados mencionados en el comunicado aún está pendiente. Los observadores del sector subrayan que es necesario esperar a la replicación independiente de los resultados de los benchmarks antes de poder evaluar definitivamente la capacidad de Qwen3.8-Max.
Con Qwen3.8-Max, Alibaba intensifica la competencia en el segmento de modelos de IA para el desarrollo de software. Si los resultados de los benchmarks se confirman en pruebas independientes, el modelo representaría una competencia tecnológica frente a los sistemas consolidados de Estados Unidos y diversificaría en mayor medida el panorama global de la IA.
La publicación se recibe con interés en la comunidad europea de desarrolladores, ya que los modelos de pesos abiertos son especialmente relevantes bajo los requisitos del Reglamento General de Protección de Datos (RGPD) y ante las preocupaciones sobre la transferencia de datos a terceros países. Con Qwen3.8-Max, las desarrolladoras y los desarrolladores de Europa disponen ahora de otro potente modelo de pesos abiertos, apto para su implementación local en centros de datos europeos.
Questions & Answers
¿Qué es Qwen3.8-Max?
Qwen3.8-Max es un modelo de lenguaje de IA del conglomerado tecnológico chino Alibaba, publicado el 3 de agosto de 2026 como versión de pesos abiertos y especializado en tareas de programación.
¿Cómo se compara Qwen3.8-Max en los benchmarks con GPT-5.6 Sol y Claude Fable 5?
En benchmarks de programación como Terminal Bench 2.1 (86,6) y FrontierSWE (73,5), Qwen3.8-Max se sitúa por delante de Claude Fable 5, mientras que GPT-5.6 Sol mantiene el liderazgo en SWE-bench Pro (80,0) y GPQA Diamond (94,1).
¿Qué significa publicación de pesos abiertos en este contexto?
Pesos abiertos significa que los parámetros aprendidos del modelo de IA se ponen a disposición pública, de modo que las desarrolladoras y los desarrolladores pueden operar el modelo de forma independiente y adaptarlo, a diferencia de los sistemas cerrados de OpenAI.
Qwen3.8-Max: el nuevo modelo de IA de pesos abiertos de | noticias360