Qwen 3.8 Omni Flash
Qwen 3.8 Omni Flash está atrayendo atención como una alternativa rápida y de bajo coste a modelos como Gemini Omni, y algunos usuarios informan de un rendimiento sólido —especialmente en variantes como Flash Next y Max— a pesar de los fuertes requisitos de hardware de las versiones más grandes. Los comentaristas destacan las compensaciones entre velocidad, calidad del razonamiento, ajuste agresivo por RL y errores de cuantización o serving que pueden causar un comportamiento “extraño”. El hilo también se amplía hacia preocupaciones sobre la fijación de precios de los modelos, la relativa debilidad de Europa para construir modelos fundacionales frente a China y EE. UU., y la creciente dificultad de elegir entre un ecosistema cada vez mayor de LLMs.
Modelos Qwen 3.8 y pesos abiertos
- Los usuarios aprecian la variedad de tamaños de modelo de Qwen, especialmente los muy pequeños para experimentar.
- Algunos perciben una desaceleración en los lanzamientos de pesos abiertos (por ejemplo, incertidumbre sobre Qwen4, tamaños limitados como 27B y 125B), aunque otros señalan que modelos recientes importantes como 3.8 Max y 3.8 Flash Next se han publicado como pesos.
Rendimiento, usabilidad y limitaciones de hardware
- 125B / Flash Next es elogiado como “muy fuerte” en calidad, incluso con cuantización de 3 bits, pero se considera “mayormente inutilizable” para muchos debido a los altos requisitos de RAM (~128GB) y al bajo rendimiento.
- 3.8 Max se ve como muy fundamentado, fiable y “aburrido en el buen sentido”, pero lento y solo de acceso sencillo a través de Alibaba, cuyos precios se describen como mezquinos.
- Algunos usuarios prefieren Flash Next frente a 27B y han dejado de usar este último por completo en su hardware.
Razonamiento extraño y problemas de serving/cuantización
- Varias personas informan que Flash Next produce pensamientos “meta” extraños (por ejemplo, afirmar que el usuario no preguntó nada, o divagaciones filosóficas aleatorias) entre llamadas a herramientas.
- Se sospecha que estos problemas se deben a bugs de serving o a malas cuantizaciones, aunque otros ven un comportamiento similar incluso con configuraciones aparentemente buenas.
- Algunos informan de parones largos y aleatorios o de cadenas de pensamiento excesivamente largas que se resuelven tras reintentar.
RL y preocupaciones por el “sobreajuste”
- Existe la preocupación de que un aprendizaje por refuerzo agresivo para codificación agentiva pueda volver los modelos demasiado impulsivos, haciendo cosas sin aclarar la intención del usuario.
- Algunos ven los modelos frontier más nuevos como ejemplos de que optimizar para benchmarks perjudica la utilidad cotidiana.
Coste frente a Gemini y otros modelos
- Se afirma que Qwen 3.8 Omni Flash se acerca a la calidad multimodal de Gemini a un coste por token unas 10 veces menor.
- Los comentaristas señalan que el coste real depende mucho de los tokens usados por tarea, del comportamiento de la caché y del tipo de tarea; en algunos benchmarks, modelos mucho más caros pueden ser más baratos por tarea completada.
Elección de modelo y soporte de herramientas
- Los usuarios se sienten abrumados por la elección de modelos; las sugerencias incluyen: empezar con un modelo barato y suficientemente bueno; evitar perseguir cada nuevo lanzamiento; y usar herramientas como el “auto model” de OpenRouter o sitios de comparación, con advertencias para canalizaciones de producción.
China vs Europa en IA
- Debate sobre por qué los laboratorios chinos lanzan modelos potentes mientras Europa se queda atrás: entre los factores citados están la dirección gubernamental, la intensidad de capital, la tolerancia al riesgo, la regulación y la educación.
- Otros responden que Europa tiene laboratorios, empresas e infraestructura relacionada con chips destacables, pero menos “hustle” y más regulación y aversión al riesgo.
Marca, documentación y UX
- Algunos critican nombres de producto confusos (Flash/Omni/Pro/Ultra) y prefieren una versionado más claro.
- El blog oficial se describe como técnicamente pesado, lento y lleno de medios vistosos pero poco informativos, con mala legibilidad.