Qwen 3.8

O anúncio da Alibaba do Qwen 3.8, um modelo de linguagem de grande porte com 2,4 trilhões de parâmetros e prometido como de pesos abertos, é visto como parte de uma corrida crescente entre laboratórios chineses (Kimi, DeepSeek, GLM etc.) para igualar ou superar modelos de fronteira dos EUA como a linha Fable da Anthropic e o GPT da OpenAI. Os comentaristas debatem os motivos estratégicos por trás da aposta da China em modelos poderosos de pesos abertos — de transformar “inteligência” em commodity e enfraquecer incumbentes dos EUA até ideais genuínos de open source — enquanto também ponderam trade-offs práticos como censura, guardrails, custo, desempenho e a necessidade de modelos menores que possam rodar localmente. Muitos veem a crescente disponibilidade de bons modelos de pesos abertos tanto como uma ameaça competitiva aos laboratórios fechados dos EUA quanto como um ganho significativo para desenvolvedores e organizações menores que buscam controle sobre sua infraestrutura de IA.

Anúncio & Acesso

  • Qwen 3.8-Max é anunciado como um modelo de ~2,4T de parâmetros, atualmente via o plano de nuvem/tokens e aplicativos da Alibaba; os pesos abertos são prometidos “em breve”.
  • O timing é ligado por comentaristas à World AI Conference em Xangai, onde vários laboratórios chineses (Qwen, Kimi, outros) lançaram modelos de fronteira.
  • Alguns especulam que isso também seja uma resposta competitiva a outros lançamentos recentes de pesos abertos chineses (por exemplo, Kimi K3, GLM 5.2+), embora outros observem que tais modelos levam meses para treinar.

Escala, Capacidade & Comparações

  • O tamanho (2,4T) é visto como enorme; usuários enquadram isso como parte de uma mudança de modelos de “valor” para modelos chineses “enormes, lentos, muito inteligentes”.
  • Alegações de marketing de que é “segundo apenas” aos principais modelos de fronteira dos EUA são recebidas com interesse, mas com ceticismo até testes práticos.
  • Modelos Qwen anteriores recebem avaliações mistas: alguns acham 3.6 27B/35B excelentes para codificação local e agentes; outros relatam 3.7 Pro/Max como verborrágico, fora do rumo ou fraco para trabalho de SWE.
  • DeepSeek V4, GLM 5.2, Kimi K3 e modelos de fronteira dos EUA são pontos de referência frequentes; as pessoas discordam sobre qual é o “melhor”, mas muitos dizem que os modelos chineses agora são “bons o suficiente”, especialmente pelo custo.

Pesos Abertos, Estratégia & Geopolítica

  • Muitos veem os lançamentos chineses de pesos abertos como uma estratégia deliberada de “transformar o modelo em commodity”:
    • Reduzir as margens e as avaliações dos laboratórios fechados dos EUA.
    • Impulsionar o uso de nuvens, hardware e ecossistemas chineses.
    • Construir poder brando global e reduzir a dependência de APIs dos EUA, especialmente dentro da China.
  • Outros enfatizam a competição doméstica intensa (“involution”): empresas subsidiam agressivamente e abrem modelos para ganhar usuários, mesmo com lucro baixo ou negativo.
  • A influência do governo é debatida: alguns citam comentários pró–open source AI de Xi e investimento estatal; outros ressaltam que as empresas ainda buscam lucro e veem os modelos como infraestrutura para vender computação e aplicativos.

Aberto vs Fechado, Segurança & “Desaceleração”

  • Forte apoio a pesos abertos:
    • Controle local, sem “rug pull”, sem bloqueios de guardrails.
    • Exemplo: um incidente no HuggingFace em que APIs fechadas bloquearam uma perícia de segurança, forçando o uso de um modelo aberto auto-hospedado.
  • Uma visão contrária: modelos abertos poderosos poderiam reduzir o CAPEX de fronteira e desacelerar o progresso (“deceleration”), o que alguns veem como bom para a segurança, outros como exagerado ou centrado nos EUA.
  • Há preocupações de que laboratórios dos EUA possam buscar regulação para prejudicar concorrentes de pesos abertos.

Modelos Locais & Hardware

  • Muitos querem variantes abertas de porte médio (por exemplo, 30–120B dense/MoE) otimizadas para ~24–128GB de VRAM, citando Qwen 3.6 27B, 35B MoE, Gemma 4 31B, Bonsai como os pontos ideais atuais.
  • Técnicas como quantização, MoE, descarregamento para SSD e predição multinível de tokens são discutidas como formas de executar modelos maiores localmente, ainda que com trade-offs de velocidade.
  • Alguns argumentam que modelos pequenos e capazes continuarão importantes para privacidade, uso offline e como agentes baratos, mesmo que modelos gigantes dominem os benchmarks.

Censura, Viés & Confiança

  • Vários comentários dizem que o Qwen hospedado está entre os modelos chineses mais censurados em tópicos politicamente sensíveis; pesos abertos mais prompts de “jailbreak” podem reduzir recusas, mas não removem omissões ou vieses subjacentes do treinamento.
  • Um grupo se preocupa com um viés ideológico sutil (por exemplo, omissões sobre Tiananmen, uigures, Taiwan) se propagando por modelos abertos amplamente adotados.
  • Outros contrapõem que:
    • A maioria dos usuários não usa LLMs para política.
    • Modelos ocidentais têm seus próprios pontos cegos políticos.
    • Pesos abertos podem ser ajustados para contrariar vieses detectados, enquanto modelos fechados não podem ser auditados ou corrigidos pelos usuários.

Experiência do Desenvolvedor & Casos de Uso

  • As experiências divergem fortemente:
    • Alguns acham Qwen excelente em harnesses de codificação e setups de agentes, especialmente quando ancorado com ferramentas, memória e prompts cuidadosos.
    • Outros dizem que Qwen 3.7 é inutilizável para SWE, preferindo DeepSeek V4 Pro/Flash, GLM 5.2 ou modelos de fronteira dos EUA.
  • Custo-desempenho:
    • DeepSeek V4 (especialmente Flash) é amplamente elogiado por extrema barateza e velocidade, embora benchmarks sugiram taxas mais altas de alucinação.
    • A verbosidade dos modelos chineses e os longos rastros de “pensamento” podem corroer sua vantagem bruta de preço por token em fluxos de trabalho agentivos.

Tensão Meta & Cultural

  • Vários observam que discussões sobre modelos chineses no HN rapidamente mudam de detalhes técnicos para geopolítica, questões de direitos humanos e desconfiança em relação a empresas chinesas.
  • Alguns participantes da China expressam frustração porque isso obscurece a avaliação técnica e o “espírito geek” por trás do trabalho.