Claude, mude o botão “Add to Cart” para azul
Um site interativo satírico que parodia pedir ao Claude, da Anthropic, para deixar azul um único botão “Add to Cart” — apenas para ele refatorar toda a interface, criar subagentes e escrever ensaios sobre tradeoffs — tocou em um nervo sensível entre desenvolvedores. Muitos dizem que isso espelha de perto frustrações reais com agentes de codificação por IA que complicam demais mudanças triviais, ignoram o escopo, consomem tokens e exigem disciplina quase artesanal de prompts, enquanto outros argumentam que é uma caricatura exagerada ou desatualizada que não corresponde à experiência deles com modelos mais novos ou melhores *harnesses*. A discussão destaca uma tensão mais ampla: ferramentas de IA podem acelerar enormemente trabalhos complexos, mas sua imprevisibilidade, verbosidade e tendência a “ajudas” laterais podem fazer até edições simples parecerem uma briga com um colega estocástico.
Reação geral ao site de paródia
- Muitos acharam a paródia interativa “mude o botão Add to Cart para azul” hilária, estressante e desconfortavelmente familiar, descrevendo frustração física (“tique no olho”, “pico de pressão arterial”, “TEPT”).
- Outros disseram que isso não se parecia em nada com a experiência deles com Claude e soou como um espantalho ou uma caricatura desatualizada.
- Vários chamaram de “sátira de elite” e “arte de rede do fim dos anos 90”, elogiando como captura bem a sensação de discutir com um LLM sobre pequenas mudanças.
Grupo do “isso é exatamente a minha experiência”
- Um grupo considerável disse que a sátira espelha de perto sua realidade com Claude/Opus 5:
- Linguagem “Claudese” excessivamente prolixa, pseudo-sincera e cheia de ressalvas.
- Superengenharia de tarefas simples, aumento de escopo e yak-shaving (“23 agentes”, refatorações desnecessárias, testes, ferramentas, termos de serviço).
- Dificuldade para obter pequenas edições localizadas de código sem mudanças colaterais.
- Agentes gastando muitos tokens, criando subagentes e obcecados por validação e compatibilidade retroativa em projetos triviais ou do zero.
- Alguns relataram ter mudado para outras ferramentas (Codex, DeepSeek, GLM etc.) porque sentiam que o Claude era “prestativo” demais, lento ou frustrante.
Grupo do “isso não bate com a realidade”
- Muitos usuários frequentes do Claude disseram que nunca viram um comportamento tão ruim:
- Acham o Opus/Sonnet geralmente preciso, especialmente quando recebem referências concretas de arquivo/linha e boa documentação do projeto.
- Para eles, os principais defeitos do Claude são verbosidade e excesso de comentários, não mudanças selvagens e destrutivas.
- Eles veem o site como uma sátira exagerada que engana as pessoas sobre a qualidade atual do modelo ou reflete gerações muito mais antigas.
Estilo de prompting e comportamento do usuário
- Vários comentaristas argumentaram que o “jogo” força prompts ruins:
- Broncas emotivas (“Eu pedi SÓ um botão”), instruções vagas e nenhuma orientação concreta sobre como corrigir erros.
- Eles enfatizam que, com LLMs, é preciso evitar desabafos, ser específico sobre o escopo desejado e reafirmar as restrições.
- Boas práticas sugeridas:
- Trate o modelo como matemática, não como uma pessoa; evite linguagem emocional.
- Dê contexto preciso (arquivos, seletores, classes), e não apenas “deixe o botão azul”.
- Reverta mudanças ruins e comece uma sessão nova em vez de “discutir” dentro de um contexto contaminado.
- Mantenha CLAUDE.md / AGENTS.md / PROJECT.md e refine-os continuamente.
- Limite ferramentas/subagentes e mantenha o contexto mínimo e focado na tarefa.
Temas mais amplos: fluxo de trabalho com IA, sensação de aposta e fadiga
- Alguns observam que LLMs podem parecer apostas ou máquinas caça-níqueis de recompensa variável: longos períodos de frustração interrompidos por grandes vitórias que mantêm as pessoas presas.
- Outros rejeitam fortemente a analogia com apostas, dizendo que experimentam progresso incremental e bastante consistente.
- Um tema recorrente é “engenharia do harness”: construir orquestração sob medida, tickets e agentes de revisão para que humanos raramente falem com o modelo bruto, como forma de lidar com frustração e complexidade.