
El 3 de agosto de 2026, Alibaba presentó Qwen3.8-Max, su modelo de IA más capaz hasta la fecha. La cifra que llama la atención no es su tamaño (2,4 billones de parámetros), sino su duración de autonomía: en pruebas internas, el modelo llevó solo un proyecto de software real durante 16 días. Para un directivo de pyme, este anuncio marca un cambio más amplio: los agentes de IA ya no se limitan a responder una pregunta, mantienen el rumbo durante un periodo prolongado. Esto es lo que hay que retener, con cifras y fuentes.
En resumen
- Qwen3.8-Max fue anunciado por Alibaba el 3 de agosto de 2026: 2,4 billones de parámetros en total, de los cuales 95.000 millones se activan por solicitud (arquitectura MoE), con una ventana de contexto de 1 millón de tokens (fuente: Alizila, medio oficial de Alibaba).
- En una prueba interna, el modelo ejecutó solo un proyecto real de ingeniería de software durante 16 días sin intervención humana (fuente: Alizila).
- Precio de lanzamiento en la API: alrededor de 2 $ por millón de tokens de entrada, 6 $ de salida, muy por debajo de GPT-5.6 Sol (5 $ / 30 $) y Claude Opus 5 (5 $ / 25 $) (fuente: OpenRouter).
- Los pesos del modelo se publicarán en código abierto en la semana siguiente al anuncio, junto con una versión más ligera, Qwen3.8-27B (fuente: Alizila).
- La acción de Alibaba subió más de un 4,5 % en Nueva York y un 7 % en Hong Kong tras el anuncio (fuente: CNBC).
- Para una pyme, lo relevante no es adoptar este modelo en concreto, sino entender qué significa una IA que trabaja sin supervisión durante varios días.
Qwen3.8-Max en cifras
Qwen3.8-Max es un modelo MoE (mezcla de expertos): de sus 2,4 billones de parámetros totales, solo se activan 95.000 millones por solicitud, lo que limita el coste de cómputo pese al tamaño anunciado. Se sitúa en 5º lugar en Text Arena y 2º en Vision Arena, dos clasificaciones públicas que comparan modelos en tareas reales evaluadas por usuarios (fuente: Alizila).
En los benchmarks publicados por Alibaba, el modelo obtiene 93,0 en PaperBench (comprensión de documentos científicos), 81,9 en WideSearch (búsqueda de información) y 82,8 en IFBench (cumplimiento de instrucciones complejas). Estos resultados lo sitúan como competidor directo de GPT-5.6 y Claude Opus 5 en tareas de investigación y programación (fuente: Alizila).
La verdadera ruptura: programar solo durante 16 días
Hasta ahora, un agente de IA "autónomo" encadenaba tareas durante unas horas, rara vez más de un día, antes de necesitar una intervención humana para corregir una desviación o validar un paso. Qwen3.8-Max cambia de escala: Alibaba afirma que el modelo llevó a cabo un proyecto completo de ingeniería de software, desde el planteamiento hasta el código entregado, durante 16 días consecutivos sin relevo humano.
Definición
Ejecución prolongada
Entrega
No se trata solo de una ganancia de velocidad: es un cambio de naturaleza. Una IA capaz de mantener el rumbo durante varios días podría, en teoría, hacerse cargo de un proyecto entero en lugar de una tarea aislada. Para una pyme, esto abre nuevos usos (desarrollar una función, una migración técnica, una auditoría larga), pero también plantea una pregunta central: ¿quién revisa el trabajo durante esos 16 días, y en qué momento?
Pesos abiertos: accesible, pero no sin esfuerzo
Otro dato relevante: Alibaba publicará los pesos de Qwen3.8-Max en código abierto en la semana siguiente al lanzamiento, junto con una variante más ligera, Qwen3.8-27B, pensada para funcionar en hardware más modesto. Un modelo con pesos abiertos puede alojarse en la infraestructura propia de la empresa en lugar de depender de una API de terceros.
API propietaria (GPT-5.6, Claude Opus 5)
Pesos abiertos (Qwen3.8-Max)
| Modelo | Precio API (entrada / salida, por millón de tokens) | Contexto | Pesos abiertos | Proveedor |
|---|---|---|---|---|
| Qwen3.8-Max | 2 $ / 6 $ | 1 M tokens | Sí (en una semana) | Alibaba |
| GPT-5.6 Sol | 5 $ / 30 $ | - | No | OpenAI |
| Claude Opus 5 | 5 $ / 25 $ | 1 M tokens | No | Anthropic |
Fuentes: OpenRouter (precios de lanzamiento de Qwen3.8-Max), Clubic (precios de GPT-5.6), Anthropic (precios de Claude Opus 5, comunicado del 24 de julio de 2026).
Para una pyme sin equipo técnico dedicado, la API sigue siendo la vía más sencilla, incluso con el modelo de Alibaba. El interés de los pesos abiertos se revela sobre todo para las empresas que ya tienen una exigencia de soberanía de datos o un equipo capaz de alojar y supervisar el modelo.
Lo que una pyme debe tener presente
Ningún resultado independiente confirma todavía los 16 días de autonomía. La cifra procede del propio Alibaba; ningún laboratorio externo ha reproducido, hasta la fecha, esta prueba en condiciones comparables. Es un anuncio a seguir, todavía no un estándar verificado.
Una IA que trabaja varios días sin supervisión requiere una gobernanza distinta. Un agente que responde en segundos se detiene si la respuesta es mala; un agente que funciona durante 16 días puede acumular una desviación invisible sin puntos de control regulares. La pregunta ya no es solo "¿respondió bien la IA?", sino "¿quién revisa el trabajo, y cuándo?".
El coste de un agente de larga duración es difícil de prever. Un precio bajo por token no dice nada sobre el volumen consumido durante 16 días de ejecución continua. Sin un límite de gasto ni seguimiento, la factura puede sorprender.
Para recordar
Antes de confiar un proyecto entero a un agente de IA autónomo, fija puntos de control intermedios (día 1, día 3, día 7), no solo una validación final. Es la única forma de mantener el control de un trabajo que se extiende varios días.
Preguntas frecuentes
¿Está disponible Qwen3.8-Max hoy para una pyme?
Sí, a través de la API en Alibaba Cloud Model Studio desde el 3 de agosto de 2026. Los pesos del modelo, que permiten un alojamiento interno, se publicarán en código abierto en la semana siguiente al anuncio (fuente: Alizila).
¿Están garantizados los 16 días de autonomía en cualquier proyecto?
No. Este resultado proviene de una prueba interna que Alibaba realizó sobre un proyecto de software específico. Ilustra una capacidad, no una garantía de rendimiento en cualquier tipo de tarea o sector.
¿Sustituye Qwen3.8-Max a GPT-5.6 o Claude para una pyme?
No necesariamente. Su principal ventaja es el precio (aproximadamente tres veces más barato que GPT-5.6 Sol por uso) y la opción de pesos abiertos. La elección depende de la tarea, el presupuesto y la sensibilidad de los datos tratados.
¿Cuál es el principal riesgo de un agente de IA que funciona de forma autónoma durante varios días?
La falta de supervisión intermedia. Sin puntos de control regulares, un error cometido al principio del proceso puede propagarse durante toda la tarea antes de ser detectado.
Para saber más
La llegada de Qwen3.8-Max confirma una tendencia observada desde hace meses con Kimi K3 y DeepSeek V4: los modelos chinos de pesos abiertos reducen la distancia con los líderes estadounidenses, a precios notablemente inferiores. LUWAI ha analizado esta tendencia en anteriores artículos, disponibles en la página de Recursos. Para ver cómo las pymes ya están estructurando su adopción de agentes de IA, consulta nuestros casos de éxito de clientes.


