Qwen3.8-Max: la IA de Alibaba que iguala a OpenAI y Anthropic

Qwen3.8-Max es un modelo multimodal masivo basado en una arquitectura dispersa de Mezcla de Expertos

Ya la industria viene avisándolo desde hace algún tiempo, el avance de la inteligencia artificial acelera con fuerza en 2026. La división de IA de Alibaba Cloud presentó oficialmente Qwen3.8-Max, su modelo insignia de lenguaje de última generación.

Esta nueva arquitectura llega para cambiar las reglas del juego global. Con 2,4 billones de parámetros totales, Qwen3.8-Max logra equipararse en capacidades de razonamiento avanzado con gigantes cerrados como OpenAI y Anthropic.

¿Qué es Qwen3.8-Max y cuáles son sus especificaciones clave?

Qwen3.8-Max es un modelo multimodal masivo basado en una arquitectura dispersa de Mezcla de Expertos (MoE). Registra 95.000 millones de parámetros activos por pasada de computación, optimizando el consumo de recursos sin perder potencia.

CaracterísticaEspecificación técnica
Parámetros totales2,4 billones (2.4T)
Parámetros activos~95.000 millones por pasada
Ventana de contexto256.000 tokens en entrada
Capacidad de salidaHasta 131.072 tokens
ModalidadMultimodal (texto, visión y video)

La propuesta destaca por permitir el procesamiento de documentos extensores y la ejecución de tareas analíticas complejas en una sola consulta.

Rendimiento en benchmarks: ¿Realmente iguala a Claude y GPT?

Las pruebas independientes confirman que el salto generativo respecto a versiones previas es sobresaliente. En evaluaciones académicas de razonamiento científico, la herramienta china alcanza métricas del más alto nivel.

La versión de Alibaba incluye comparaciones con Claude Opus 4.8, Claude Fable 5, GPT-5.6 Sol de OpenAI funcionando a razonamiento máximo y su propio predecesor, Qwen3.7-Max, en tres grupos de pruebas: agentes de codificación, trabajo de agentes generales y capacidades generales.

En cuanto a la programación, la situación es mixta pero muestra que Qwen 3.8 Max es competitivo tanto con GPT 5.6 Sol como con Fable 5. Qwen3.8-Max obtiene 86,6 en Terminal Bench 2,1, por detrás del 88,8 de Sol, pero se sitúa por delante en PaperBench (93,0 frente a 90,5), AndroidBench (75,1 frente a 74,0) y en QwenSWEBench de Alibaba (80,7 frente a 73,5) y QwenQoderBench (58,4 frente a 53,8).

Frente a Claude Fable 5, los resultados se dividen en el sentido contrario en algunas pruebas de ingeniería de software — Fable 5 lidera en SWE-bench Pro (80,0 frente a 67,7), DeepSWE 1.1 (70,0 frente a 56,6) y FrontierSWE (88,8 frente a 73,5) — mientras que Qwen3.8-Max lidera en PaperBench y QwenSVGBench.

La categoría general de agentes, que abarca tareas de oficina y espacio de trabajo en varios pasos, es donde Qwen3.8-Max se ve más fuerte en comparación con GPT-5.6 Sol.

Fable 5 se mantiene por delante en la mayoría de estos casos, incluyendo JobBench (57,4) y SkillsBench (70,9 frente a 70,2 de Qwen), aunque las diferencias son más estrechas que en los benchmarks de programación en bruto.

  • Razonamiento avanzado (GPQA): Obtuvo una puntuación de 92,6 puntos, ubicándose a la altura directa de los modelos más avanzados del mercado.
  • Ingeniería de software (DeepSWE): Alcanzó 56,6 puntos, superando ampliamente los 21,6 de su predecesor, aunque aún por detrás de entornos hiperespecializados en código.
  • Comprensión de video (VideoMME): Marcó un 90,4 % en la interpretación y análisis contextual de secuencias visuales.

Estos datos demuestran que el sistema destaca como un razonador general de primer orden.

Disponibilidad y acceso a la tecnología

A pesar de ser un modelo de pesos abiertos en desarrollo, su inmenso tamaño impide ejecutarlo en hardware de nivel de consumidor. La infraestructura requerida exige despliegues a escala de nube empresarial.

“Qwen3.8-Max demuestra que la brecha entre los modelos de código abierto y los sistemas propietarios más avanzados prácticamente ha desaparecido en tareas de razonamiento puro.”

En este artículo que publicamos recientemente en la sección de Inteligencia Artificial, verás cómo los modelos chinos se siguen posicionando hasta lograr la IA de frontera. Uno de estos es Kimi K3: la IA china de 2.8 billones de parámetros que compite con los grandes del knowledge work.

Actualmente, los desarrolladores y empresas pueden acceder al modelo a través de las plataformas en la nube de Alibaba y plataformas de API abiertas. Esto facilita su integración en aplicaciones corporativas sin asumir la complejidad de hospedar billones de parámetros de forma local.

Deja un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *