¿Es todo solo humo?
Las afirmaciones de que las herramientas de codificación de IA “agenticas” son básicamente humo chocan con informes de desarrolladores que dicen que los modelos más avanzados aceleran de forma significativa el trabajo repetitivo, la depuración y el ajuste de rendimiento. Muchos coinciden en que la tecnología subyacente es real, pero sostienen que las valoraciones, el bombo y las “fábricas de software” totalmente autónomas están exagerados, y que los LLMs a menudo generan código frágil y difícil de mantener, además de crear carga extra de revisión e integración. El intercambio pone de relieve una brecha cada vez mayor entre las demos de laboratorio y el software de producción a largo plazo, y plantea preguntas sobre dónde están apareciendo ganancias reales de productividad y dónde la IA solo está amplificando el ruido y la deuda técnica.
Realidad de la tecnología frente al bombo de la valoración
- Hay un amplio acuerdo en que los LLMs son reales y a menudo impresionantes, especialmente para programación, ayuda en investigación y algunos usos militares/industriales.
- Muchos ven las valoraciones actuales y las grandes narrativas de que “los agentes harán todo” como algo parecido a una burbuja o a un esquema piramidal (con los vendedores de GPU y los laboratorios en la cima).
- Crítica: los productos se están lanzando “antes de que exista el valor”, y gran parte del mercado está impulsado por el bombo, la jerga y la presión de los inversores.
Programación agentica en la práctica
- Algunos informan de bucles totalmente “agenticos” que pueden elegir tareas, escribir código, ejecutar pruebas y sacar funcionalidades, especialmente en talleres pequeños y proyectos greenfield.
- Otros encuentran que los agentes se enredan, desperdician créditos, generan PR enormes y de baja calidad, y requieren tanta supervisión que ralentizan el trabajo.
- Hay preocupación de que los agentes fomenten refactorizaciones interminables y proyectos secundarios en lugar de terminar trabajo real y acotado.
Afirmaciones de productividad y la brecha de evidencia
- Un sector afirma haber vivido múltiples momentos “impresionantes” y una productividad de 5–10x en productos reales, especialmente para código repetitivo, ajuste de rendimiento, refactors y cambios transversales.
- Otro sector dice que nada se aceleró realmente una vez que se contabilizan revisión, depuración e integración; los errores derivados y el ruido aumentan.
- Varios señalan que los cuellos de botella organizativos (reuniones, prioridades desalineadas) pueden absorber fácilmente cualquier ganancia bruta de velocidad.
Experiencia en código abierto
- Se argumenta que, si las ganancias de 10x fueran reales, los grandes proyectos de OSS mostrarían un aumento drástico en funciones y velocidad; muchos observadores no ven eso.
- Los mantenedores informan de altos volúmenes de PRs de LLM de baja calidad y cada vez más están prohibiendo o desalentando las contribuciones generadas por IA.
- Contraargumentos:
- El buen código asistido por IA puede ser indistinguible del código humano.
- El cuello de botella es el tiempo del mantenedor, no la generación de código; las prohibiciones suelen deberse a la carga de revisión, no a la calidad pura.
- Se citan algunas optimizaciones concretas de alto impacto asistidas por IA en proyectos importantes.
Patrones de mejor uso frente a modos de fallo
- Hay mayor consenso sobre los “puntos dulces”:
- Código repetitivo y rutinario.
- Depuración y trazado de problemas.
- Perfilado de rendimiento y microoptimizaciones.
- Escritura de pruebas, fuzzers e instrumentación.
- Prototipado y herramientas “desechables” o apps internas.
- Modos de fallo conocidos:
- Arquitecturas complejas, de larga vida y sistemas críticos para la seguridad.
- Agentes intentando planificar e implementar funcionalidades completas de forma autónoma.
- Investigación de dominio profundo (p. ej., física avanzada) donde las respuestas son erróneas con mucha confianza.
Papel de la experiencia y del diseño del flujo de trabajo
- Muchos dicen que los LLMs amplifican fuertemente la experiencia existente: geniales en manos de ingenieros sólidos, peligrosos en manos de novatos.
- Se hacen comparaciones con herramientas eléctricas: gran palanca, sin protecciones de seguridad.
- Un uso eficaz suele significar ciclos ajustados con intervención humana, pruebas sólidas (incluyendo fuzzing y regresión visual), especificaciones claras y tareas acotadas.
Economía, organizaciones e incentivos
- Algunos sostienen que los trabajos de software ya son performativos en muchas empresas; la IA sobresale en “la ilusión de progreso”, que quizá es todo lo que requieren los incentivos bursátiles y profesionales.
- Otros subrayan que negocios reales, no financiados por VC, ya están obteniendo valor tangible de flujos de trabajo agenticos e infraestructura de monitorización.
- Preocupa que la rotación, el abandonware y la “cultura MVP” estén degradando la experiencia de usuario mientras los equipos lanzan productos impulsados por IA sin suficiente prueba o pulido.
Preocupaciones a largo plazo y ciclo de hype
- Se señala una “explosión cámbrica” de herramientas, muchas abandonadas rápidamente; la alta rotación dificulta aprender flujos de trabajo estables.
- Algunos ven una reacción negativa y una insatisfacción crecientes a medida que los usuarios se enfrentan a limitaciones y a dolores de integración.
- Varios esperan una depuración: los productos de “agente mágico” de una sola vez desaparecerán, pero los usos más realistas y centrados en ingeniería de los LLMs permanecerán y madurarán.