Qwen3.8-Flash-Next dice que le gana a Claude. Es cierto — pero al Claude de hace un año
Alibaba presentó su nuevo modelo abierto diciendo que supera a Opus en la mayoría de benchmarks. Cierto, si el punto de comparación es Opus 4.6 — el modelo insignia anterior de Anthropic, no Opus 5, el actual.
Modelo multimodal de código abierto con arquitectura mixture-of-experts: 125.000 millones de parámetros totales, pero solo 6.000 millones activos por token. Lanzado el 26 de agosto de 2026 como preestreno de la arquitectura Qwen4, con ventana de contexto nativa de 262.144 tokens, extensible a un millón.
Qué prometen vs. qué se puede verificar hoy
Alibaba lo presentó afirmando que supera a "Claude Opus" en la mayoría de benchmarks — una afirmación cierta solo si el punto de comparación es Opus 4.6, el modelo insignia anterior de Anthropic, no Opus 5, su modelo actual (el que revisamos la semana pasada). En SWE-bench Pro, Qwen3.8-Flash-Next saca 62.5%, muy por debajo del 79.2% que registra Opus 5 en la misma prueba. Frente a Opus 4.6 sí gana en varias métricas: 58.7 en DeepSWE, 73.9 en CoWorkBench (contra 68.2), y una ventaja amplia en JobBench (55.7 contra 36.6). En GPQA Diamond queda prácticamente empatado (91.7 contra 91.3) y supera a Opus 4.6 en LiveCodeBench v6 (91.9 contra 88.8). Lo que sí es real y verificable sin matices es el argumento de costo: Alibaba lo vende en su nube a $0.16 por millón de tokens de entrada y $0.47 de salida, una fracción de lo que cuesta operar un modelo cerrado de frontera, activando solo 6.000 millones de sus 125.000 millones de parámetros por cada token procesado.
Frente a qué compite
La comparación más honesta no es contra Opus 4.6 sino contra Opus 5, la frontera real y actual de Anthropic — ahí Qwen se queda claramente atrás en las pruebas de programación más exigentes. Contra otros modelos abiertos como DeepSeek-V4-Flash, Qwen3.8-Flash-Next sí gana. Su ventaja real no es "vencer a la frontera cerrada de hoy", es ofrecer un desempeño cercano al de la frontera de hace un año, en código abierto, a una fracción del costo.
Para quién importa
Para desarrolladores o empresas con presupuesto limitado que necesitan un modelo abierto, barato y competente, es una opción real y verificable. Para quien necesita el mejor desempeño posible en tareas de programación complejas, Opus 5 sigue mandando — y cuesta bastante más que $0.16 por millón de tokens.