Dentro de ZCode: subiendo en silencio tu historial de Git a la nube
Se ha descubierto que una herramienta asistente de código llamada ZCode empaquetaba y subía en silencio a los servidores del proveedor los espacios de trabajo completos y los historiales de Git de los usuarios, supuestamente para “indexación de base de código” y generación de wikis en la nube, sin una divulgación clara ni una opción obvia para desactivarlo. Los comentaristas sostienen que este comportamiento cruza la línea hacia una exfiltración similar al malware, reforzando las preocupaciones existentes sobre los “arneses” de IA de código cerrado, los tokens baratos y las prácticas opacas de manejo de datos, especialmente por parte de grandes proveedores chinos de IA. Muchos piden una compartimentación y un aislamiento más estrictos de los agentes, mayor dependencia de herramientas de código abierto y modelos autohospedados, y señalan que la empresa desde entonces se ha disculpado, ha afirmado que los datos no se conservaron y ha prometido abrir el código de ZCode para reconstruir la confianza.
Subidas silenciosas de Git y preocupaciones de privacidad
- Se observó que ZCode empaquetaba y subía en silencio espacios de trabajo completos e historiales de Git a la nube, con datos cifrados mediante claves que no estaban en manos de los usuarios.
- Muchos ven esto como pasar de la “telemetría” a un comportamiento similar al de malware: sin aviso claro, sin consentimiento explícito y apuntando a datos obviamente sensibles (repos, historiales, dotfiles, .env, etc.).
- Algunos lo conectan con incidentes anteriores (p. ej., el CLI de Grok subiendo repos) y sostienen que el patrón es sistémico en las herramientas de IA, no un caso aislado.
Confianza en arneses de código cerrado
- Hay un fuerte sentimiento de que los agentes/arneses de código cerrado son intrínsecamente poco confiables, independientemente de su país de origen.
- Incluso a las herramientas de código abierto se les “apenas” confía; se dan ejemplos de arneses abiertos populares que escaneaban directorios de usuario o enviaban en silencio los prompts a servicios de resumen en la nube pese a estar en modo autohospedado.
- Se mencionan varias alternativas (diversos arneses abiertos y frameworks de agentes), pero ninguna se presenta como impecable.
Aislamiento y disciplina operativa
- Muchos abogan por un aislamiento estricto: cuentas de usuario separadas, contenedores Docker con montajes limitados, tráfico de salida filtrado por firewall y ámbitos de lectura explícitos para archivos del proyecto frente a dotfiles frente a archivos ignorados.
- Se compara a los agentes con usuarios no confiables en tu máquina; naturalmente “buscarán contexto”, incluidos dotfiles y archivos ignorados, por lo que se consideran obligatorios los controles técnicos.
Respuesta del proveedor y promesa de código abierto
- Declaración de Z.ai (resumida en el hilo):
- Culpa al comportamiento de una función de “indexación de base de código” / Repo Wiki que sube datos del repositorio para generar documentación y luego afirma destruir inmediatamente esos datos.
- Dice que la función estaba habilitada por defecto al principio; se disculpa y afirma que ahora está corregida.
- Promete abrir el código de ZCode, invitar a una revisión de terceros y ofrece cuota adicional como compensación.
- Algunos ven abrir el código tras un escándalo como una táctica para reparar la confianza; otros reservan el juicio hasta que el código se publique de verdad.
Legalidad, ética y geopolítica
- Varios comentaristas sostienen que esto parece piratería informática criminal y cuestionan si las leyes se aplican realmente a las corporaciones.
- Se hacen comparaciones con las prácticas en la nube de Apple/Google y con la tarificación barata por tokens como señal de incentivos ocultos para extraer datos.
- Hay un debate prolongado sobre las empresas de la RPC, la regulación estatal y el capitalismo de vigilancia en sentido amplio, incluido un comentarista chino que describe abusos de datos internos generalizados y una débil protección del consumidor.