Vomit: Limpe a saída de tokens do Claude 5 com um LLM separado
Uma nova ferramenta chamada “Vomit” usa um modelo de linguagem separado para reescrever a prosa densa e carregada de jargões produzida pelos mais recentes modelos de codificação Claude 5 da Anthropic em um texto mais claro e conversacional. Muitos desenvolvedores relatam que o estilo atual de saída do Claude é tão prolixo, cheio de metáforas e idiossincrático que os atrasa, causa fadiga e às vezes exige um segundo modelo apenas para interpretar planos, comentários e descrições de PR. Outros argumentam que o estilo reflete mudanças mais profundas em como os modelos são treinados para raciocínio e fluxos de trabalho agentic, levantando questões mais amplas sobre controlabilidade, UX e se empilhar vários modelos está se tornando uma necessidade para trabalho sério.
Problema: o estilo de prosa do Claude 5
- Muitos comentaristas consideram a saída de Opus 5/Fable 5 extremamente prolixa, densa e cheia de jargão e metáforas idiossincráticas, especialmente em trabalho técnico.
- Reclamações comuns: terminologia inventada, antropomorfização de objetos, meta-comentários, rodapés do tipo “uma ressalva...”, explicações longas do processo de decisão em vez de apenas o resultado, e mensagens de comentário/commit que narram fases e caminhos de pensamento.
- Vários dizem que ler esse “slop” por horas por dia é cognitivamente exaustivo e até afeta sua saúde mental; alguns comparam desfavoravelmente com os modelos Claude 4.x anteriores.
- Uma minoria diz que consegue ler sem problemas e vê as críticas como “reclamação” ou um problema de alfabetização, mas outros rejeitam fortemente isso, argumentando que o estilo é objetivamente mais difícil de escanear e interpretar.
Vomit e ferramentas relacionadas
- O Vomit passa a saída do Claude por um LLM separado, com um prompt de “editor”, para remover peculiaridades “claudish” e reescrever em inglês conversacional claro, preservando os detalhes.
- Outros projetos são mencionados com objetivos semelhantes (“Claudish to English”, “Caveman”, “deslop”, filtros regex personalizados, verificadores de estilo determinísticos como o vale).
- Alguns usam modelos locais ou mais baratos (por exemplo, open-weight, GPT-5.6, Muse Glimmer, Qwen) especificamente para reescrever ou higienizar comentários e documentação do Claude.
Prompting, harnesses e correções parciais
- Usuários relatam que AGENTS.md, estilos de saída e instruções de “seja conciso” ajudam apenas marginalmente; os modelos derivam à medida que as sessões crescem.
- Técnicas que ajudam um pouco: limites rígidos de palavras/parágrafos, estilos de Simplified Technical English ou linguagem simples ISO, hooks/lembretes no sistema a cada turno, habilidades separadas de “cleanup” e prompts do tipo “explique como se eu tivesse cinco anos / como um idiota”.
- O novo
outputStyle: conciseda Anthropic é apontado como uma melhoria, mas muitos dizem que ele não resolve totalmente o problema.
Causas especuladas (dentro do tópico)
- Vários hipotetizam que o treinamento recente e o RL focados em codificação agentic, uso de ferramentas e “recompensas verificáveis” otimizaram uma linguagem de raciocínio densa e internamente útil que vaza para a prosa voltada ao usuário.
- Outros sugerem loops de feedback provenientes do treinamento com saída de modelos anteriores, ou otimização para comunicação entre agentes, como possíveis fatores; tudo isso é apresentado como especulativo.
Impacto no uso e na escolha de fornecedor
- Alguns voltam para o Claude 4.6/4.8 ou migram para agentes de codificação de outros fornecedores, usando o Claude apenas como subagente ou nem isso.
- Outros aceitam empilhar vários modelos e ferramentas (LLMs de reescrita, revisão cruzada entre modelos) como a nova normalidade, enquanto alguns criticam essa crescente complexidade “agente sobre agente” como exagero insustentável.