Por qué importa
El Qwen3.8-Max llega días después de que Moonshot presentara su modelo Kimi K3, y se suma a los lanzamientos de DeepSeek, ByteDance y MiniMax. El ecosistema chino de IA está acelerando su producción de modelos frontera, aunque con recursos informáticos limitados por las sanciones estadounidenses.
- El modelo tiene 2,4 billones de parámetros y usa una arquitectura Mixture of Experts (MoE) que activa solo 95.000 millones por petición.
- Soporta una ventana de contexto de un millón de tokens, equivalente a procesar unas 750.000 palabras por consulta.
- Su precio es competitivo: 2 dólares por millón de tokens de entrada y 6 por millón de salida.
Entre líneas
Alibaba publicó los pesos del modelo para descarga pública, permitiendo verificación independiente de sus capacidades. La decisión contrasta con la opacidad de OpenAI y Anthropic, que no revelan los parámetros exactos de sus sistemas.
Las pruebas internas muestran que Qwen3.8-Max compite de igual a igual con Fable 5 y GPT-5.6 Sol en benchmarks de ingeniería de software, control de terminal, percepción visual y tareas prolongadas. En la plataforma Arena.AI, el modelo solo es superado por Fable 5 y tres versiones de Claude Opus.
Lo que dicen
Vey-Sern Ling, director general de Union Bancaire Privée, señaló que muchos inversores subestiman los modelos chinos de IA por las restricciones a chips o por escepticismo generalizado. "La brecha es probablemente mucho menor y se está reduciendo rápidamente", afirmó.
Las acciones de Alibaba subieron hasta un 7,3% en la bolsa de Hong Kong tras el anuncio.
Qué sigue
Alibaba ya puso el modelo a disposición del público a través de su plataforma QwenWork, una herramienta de productividad que compite con Claude Cowork, ChatGPT Work, Kimi Work y WorkBuddy de Tencent. La compañía planea liberar los pesos completos para que desarrolladores puedan personalizar la tecnología.
Los próximos días serán clave para que evaluadores externos confirmen si Qwen3.8-Max logra realmente lo que promete: trabajar de forma autónoma durante cinco días en tareas como diseñar chips, reescribir artículos de investigación o competir contra equipos humanos en concursos en línea.