Alibaba acaba de lanzar uno de los modelos de inteligencia artificial más ambiciosos de 2026. Qwen 3.8-Max supera a titanes como Claude Fable 5 y GPT-5.6 Sol en programación autónoma y promete trabajar sin descanso durante días.
El mercado de la Inteligencia Artificial acaba de recibir un terremoto desde Asia. Alibaba ha presentado oficialmente Qwen 3.8-Max, un modelo colosal de 2,4 billones de parámetros que no solo viene a rivalizar con los gigantes de OpenAI y Anthropic, sino que lo hace con un golpe bajo directo a su modelo de negocio: a partir de la próxima semana, su código será abierto y gratuito.
Basado en la arquitectura Qwen 3.5, este nuevo modelo utiliza la técnica Mixture-of-Experts (MoE). Esta genialidad técnica divide la red en varios «expertos», permitiendo que la IA solo active 95.000 millones de parámetros por cada solicitud. ¿El resultado? Tiempos de respuesta reducidos al mínimo sin sacrificar una gota de potencia bruta.
16 días programando sin intervención humana
Cualquier modelo top de 2026 admite contextos de un millón de tokens y mezcla texto, imagen y vídeo. Pero los creadores de Qwen afirman haber cruzado la frontera de la autonomía: esta IA puede desarrollar software en solitario durante más de diez días sin perder el hilo de lo que estaba haciendo.
Para demostrarlo, los ingenieros de Alibaba han puesto a Qwen 3.8-Max a prueba en entornos de programación real con resultados que asustan:
- Proyecto Oh My CLI: Se le asignó el desarrollo de este agente de código para terminal. Trabajó de forma autónoma durante 16 días, acumulando 265 commits, 127 pull requests y cerrando 151 issues. Todo sin que un humano tocara el teclado.
- Ciencia y Matemáticas: Se le pidió replicar y mejorar un estudio académico sobre selección de datos. En apenas 5 días en solitario, escribió 7.600 líneas de código, ejecutó 33 rondas de entrenamiento en GPU y mejoró los resultados originales en 2,7 puntos en el duro examen de matemáticas AIME24.

Para PROs: Qwen 3.8-Max frente a Claude, GPT y Gemini
Como es habitual en estos lanzamientos, los benchmarks marcan el terreno. Así queda la guerra de modelos según los últimos datos aportados:
| Modelo y Prueba | Rendimiento / Puntuación | ¿Quién domina? |
| Terminal Bench 2.1 (Comandos y depuración) | Qwen 3.8-Max logra 86,6 puntos, superando los 84,6 de Opus 4.8 y Fable 5. | Qwen 3.8-Max |
| Código real y FrontierSWE | Fable 5 aplasta con 80 puntos (vs 67,7) y 88,8 puntos (vs 73,5). | Claude Fable 5 |
| Comprensión de vídeo largo | Dominio de la IA de Google al entender grabaciones largas, salvo en eventos muy complejos. | Gemini 3.1 Pro |
| Medicina y Leyes | Resolución de cuestiones jurídicas y médicas de altísima complejidad. | Qwen 3.8-Max |
La opinión de Gurú Tecno: El código abierto como arma de destrucción masiva
Si eres desarrollador, la llegada de Qwen 3.8-Max a través de QwenCloud (y la inminente liberación de sus pesos en Hugging Face y ModelScope) es la mejor noticia del año. Alibaba ha entendido perfectamente que la forma de hundir la hegemonía estadounidense en el sector no es solo hacer una IA mejor, sino regalarla.
Mientras OpenAI y Anthropic siguen exprimiendo las suscripciones premium y cerrando cada vez más sus ecosistemas, China está inundando el mercado con modelos de código abierto absurdamente potentes. Que un modelo open source pueda trabajar 16 días seguidos haciendo commits en un repositorio sin perder el norte demuestra que la brecha técnica ya no existe. A GPT-5.6 Sol le acaba de salir un competidor que no pide vacaciones, no cobra suscripción y está a punto de colarse gratis en los servidores de medio mundo.
¡Te leemos en los comentarios! Y no te olvides de seguir a Gurú Tecno en YouTube, Instagram y Facebook.
