É tudo só vaporware?
A alegação de que ferramentas de IA de programação “agentiva” são em grande parte vaporware colide com relatos de desenvolvedores que dizem que modelos de última geração aceleram de forma significativa o trabalho repetitivo, a depuração e o ajuste de desempenho. Muitos concordam que a tecnologia subjacente é real, mas argumentam que avaliações, hype e “fábricas de software” totalmente autônomas estão superestimados, com LLMs frequentemente gerando código frágil e difícil de manter e criando overhead extra de revisão e integração. A discussão destaca uma lacuna crescente entre demos de laboratório e software de produção de longo prazo, e levanta dúvidas sobre onde ganhos reais de produtividade estão aparecendo versus onde a IA está apenas amplificando ruído e dívida técnica.
Realidade da tecnologia vs. o hype das avaliações
- Há amplo consenso de que os LLMs são reais e muitas vezes impressionantes, especialmente para programação, ajuda em pesquisa e alguns usos militares/industriais.
- Muitos veem as avaliações atuais e as narrativas grandiosas de que “agentes farão tudo” como bolha ou algo próximo de um esquema em pirâmide (com fornecedores de GPU e laboratórios no topo).
- Crítica: os produtos estão sendo lançados “antes de haver valor”, e grande parte do mercado é movida por hype, jargão e pressão de investidores.
Programação agentiva na prática
- Alguns relatam ciclos totalmente “agentivos” que podem escolher tarefas, escrever código, rodar testes e entregar funcionalidades, especialmente em equipes pequenas e projetos greenfield.
- Outros acham que os agentes se atrapalham, desperdiçam créditos, geram PRs enormes e de baixa qualidade, e exigem tanta supervisão que acabam desacelerando o trabalho.
- Há preocupação de que os agentes incentivem refatorações intermináveis e projetos paralelos, em vez de concluir trabalho real e bem delimitado.
Afirmativas de produtividade e lacuna de evidências
- Um grupo afirma ter múltiplos momentos “de cair o queixo” e produtividade 5–10x em produtos reais, especialmente para boilerplate, ajuste de desempenho, refatorações e mudanças que atravessam várias partes do código.
- Outro grupo diz que nada de fato ficou mais rápido quando se contam revisão, depuração e integração; bugs e ruído posteriores aumentam.
- Vários observam que gargalos organizacionais (reuniões, prioridades desalinhadas) podem absorver facilmente qualquer ganho bruto de velocidade.
Experiência em código aberto
- Argumento de que, se ganhos de 10x fossem reais, grandes projetos de OSS mostrariam um aumento dramático em funcionalidades e velocidade; muitos observadores não veem isso.
- Mantenedores relatam altos volumes de PRs de baixa qualidade gerados por LLMs e estão cada vez mais banindo ou desencorajando contribuições geradas por IA.
- Contra-argumentos:
- Código bom assistido por IA pode ser indistinguível de código humano.
- O gargalo é o tempo do mantenedor, não a geração de código; proibições muitas vezes têm a ver com carga de revisão, não apenas com qualidade bruta.
- São citadas algumas otimizações concretas e de alto impacto assistidas por IA em grandes projetos.
Padrões de melhor uso vs. modos de falha
- Maior consenso sobre “pontos ideais”:
- Boilerplate e código repetitivo.
- Depuração e rastreamento de problemas.
- Perfilamento de desempenho e micro-otimizações.
- Escrita de testes, fuzzers e instrumentação.
- Prototipagem e ferramentas “descartáveis” ou apps internos.
- Modos de falha conhecidos:
- Arquiteturas complexas, de longa duração, e sistemas críticos para segurança.
- Agentes tentando planejar e implementar funcionalidades inteiras de forma autônoma.
- Pesquisa profunda em domínios específicos (por exemplo, física avançada), onde as respostas são erradas com confiança.
Papel da expertise e do desenho do fluxo de trabalho
- Muitos dizem que os LLMs amplificam fortemente a expertise existente: ótimos nas mãos de engenheiros fortes, perigosos nas mãos de iniciantes.
- Fazem-se comparações com ferramentas elétricas: alto efeito multiplicador, sem proteções de segurança.
- O uso eficaz muitas vezes significa ciclos curtos com humanos no loop, testes robustos (incluindo fuzzing e regressão visual), especificações claras e tarefas bem delimitadas.
Economia, organizações e incentivos
- Alguns argumentam que empregos de software já são performáticos em muitas empresas; a IA se destaca em “iludir progresso”, que talvez seja tudo o que é necessário para incentivos de ações e carreira.
- Outros enfatizam que negócios reais, não financiados por VC, já estão obtendo valor tangível de fluxos de trabalho agentivos e infraestrutura de monitoramento.
- Preocupação de que churn, software abandonado e a “cultura do MVP” estejam degradando a experiência do usuário, enquanto equipes lançam produtos com IA sem testes ou polimento suficientes.
Preocupações de longo prazo e ciclo de hype
- Foi notada uma “explosão cambriana” de ferramentas, muitas rapidamente abandonadas; o alto churn dificulta aprender fluxos de trabalho estáveis.
- Alguns veem reação negativa e insatisfação crescentes à medida que usuários confrontam limitações e dores de integração.
- Vários esperam uma depuração: produtos “mágicos” de agente único vão desaparecer, mas usos mais concretos, focados em engenharia, dos LLMs permanecerão e amadurecerão.