Alibaba lanzó el 3 de agosto de 2026 Qwen3.8-Max, el modelo más capaz de su familia Qwen hasta la fecha, con acceso global vía API a través de Alibaba Cloud Model Studio.

Especificaciones técnicas

  • Arquitectura: Mixture-of-Experts (MoE) dispersa
  • Parámetros: 2,4 billones totales, con 95.000 millones activos por token
  • Ventana de contexto: 1 millón de tokens
  • Entrada multimodal nativa: texto, imágenes y vídeo

Precios: pensados para volumen, no para margen

Concepto Precio
Tokens de entrada $2,00 por millón
Tokens de salida $6,00 por millón
Lectura de entrada en caché $0,25 por millón

La estrategia de precios es clara: Alibaba apunta a la adopción empresarial por volumen en lugar de márgenes premium. Para comparar, GPT-5.6 Sol de OpenAI cuesta $5/$30 por millón de tokens de entrada/salida.

Benchmarks (con una advertencia importante)

Alibaba publicó resultados que sitúan a Qwen3.8-Max por delante de sus rivales en varias pruebas:

  • OSWorld-Verified (uso agéntico del ordenador): 86,1 - por encima de GPT-5.6 Sol Max (83,2) y Fable 5 (85,0)
  • Terminal-Bench 2.1: 86,6
  • GPQA Diamond: 92,6
  • FrontierSWE (programación): 73,5

Importante: todas estas cifras son medidas por Alibaba misma. Ni Artificial Analysis ni LMArena han evaluado el modelo de forma independiente todavía, así que conviene tomarlas con cautela hasta que haya verificación externa.

Por qué importa

Qwen3.8-Max refuerza la tendencia que domina el panorama de la IA en 2026: los laboratorios chinos lanzando modelos de frontera con pesos abiertos y precios agresivos, presionando a los proveedores occidentales por la vía del coste. Llega apenas un día antes de que se publicara el ranking semanal de OpenRouter en el que los modelos chinos ocuparon las cuatro primeras posiciones mundiales por volumen de uso - un contexto que explica por qué Alibaba prioriza precio y apertura sobre márgenes.