Qwen3.8-Max: Un nuevo referente para coding y cowork
El lanzamiento por parte de Alibaba de Qwen3.8-Max —un modelo de IA de alto nivel centrado en coding y “cowork”, con pesos abiertos prometidos y una próxima variante de 27B— se percibe como un gran avance para los modelos de pesos abiertos liderados por China que rivalizan con sistemas cerrados occidentales en capacidad y precio. Los comentaristas comparan Qwen con Kimi K3, DeepSeek, GLM y modelos frontier como Claude y GPT, debatiendo dónde queda ahora para coding, despliegue local y trabajo agéntico de largo horizonte, y cómo los modelos chinos baratos y potentes presionan a los laboratorios de EE. UU. tanto en precios como en regulación. Un tema recurrente es si los modelos locales en hardware de consumo o prosumer pueden justificarse económicamente frente a las APIs en la nube, y qué significa una automatización generalizada para los empleos de software, el bloqueo empresarial y el futuro “moat” de la IA (compute, datos o tooling).
Lanzamiento del modelo y apertura
- Qwen3.8-Max se describe como el nuevo modelo insignia, con pesos abiertos para el modelo de clase Max prometidos “la próxima semana”; también se anuncia una variante de 27B con pesos abiertos, ampliamente anticipada.
- Los usuarios aclaran que el “Max-Preview” de julio fue un checkpoint anterior; este es el lanzamiento completo.
- Muchos esperan que la licencia coincida con las anteriores versiones de Qwen estilo Apache; algunos lo contrastan con los términos comerciales más restrictivos de Kimi K3 y la licencia MIT de GLM 5.2.
Rendimiento, precios y comparación
- Qwen3.6‑27B y 35B-A3B ya son modelos locales populares, a menudo descritos como los mejores “daily drivers” para coding y agentes; el 27B denso se suele llamar más inteligente y coherente que el 35B MoE, que es más rápido y mejor para agentes.
- Se informa que Qwen3.8-Max rinde cerca de los mejores modelos cerrados en coding y tareas visuales en anécdotas tempranas, aunque se señalan problemas de harness/herramientas (timeouts, apps de escritorio inestables).
- El precio en Qwen Cloud se cita como $2/M de entrada, $6/M de salida, $0.25/M de tokens en caché, competitivo frente a Kimi K3 y DeepSeek; algunos dicen que DeepSeek Flash sigue siendo más barato para muchas cargas de trabajo.
Local vs cloud, hardware y economía
- Muchos ejecutan Qwen 3.6 (27B/35B) localmente en Macs, GPUs RTX, Strix Halo o configuraciones mixtas CPU+GPU; la cuantización (4–8 bits) y MoE son clave para meter modelos grandes en 16–64 GB de RAM.
- Algunos sostienen que los modelos locales son principalmente para privacidad, control y uso hobby; el coste puro por token suele favorecer a los modelos chinos alojados baratos, especialmente con caché.
- Otros afirman que, para empresas con uso intensivo, autoalojar pesos abiertos potentes (chinos o de otro tipo) puede rebajar los costes de las API frontier y dar palanca en las negociaciones.
Coding, agentes y flujos de trabajo
- Los modelos Qwen se usan mucho para coding agéntico con harnesses (por ejemplo, sistemas basados en Pi); ejecuciones autónomas de largo horizonte como “oh‑my-cli/oh‑my-pi” impresionan a algunos, pero también ponen de relieve problemas de fiabilidad.
- Varios informan que la IA aumentó la carga de trabajo: más tareas, hechas más rápido, con expectativas que suben en lugar de liberar tiempo para hobbies.
- Hay debate sobre si modelos especializados “solo de coding” serían significativamente más pequeños; la mayoría argumenta que el conocimiento general del mundo mejora de forma medible la capacidad de coding.
Geopolítica, regulación y ventajas defensivas
- Muchos ven los modelos chinos de pesos abiertos (Qwen, DeepSeek, Kimi, GLM) como impulsores de una carrera a la baja en precios de inferencia y como una erosión de la ventaja defensiva de los laboratorios cerrados de EE. UU.
- Otros argumentan que las ventajas defensivas ahora residen en el acceso a compute, datos propietarios de RLHF, integración empresarial, captura regulatoria y bloqueo a nivel de harness (estado de sesión no portable).
- La especulación sobre movimientos de EE. UU. o la UE para restringir modelos chinos o pesos abiertos es común; la viabilidad y la aplicabilidad se debaten intensamente.