Dentro do ZCode: enviando silenciosamente o seu histórico Git para a nuvem

Uma ferramenta assistente de código chamada ZCode foi descoberta empacotando e enviando silenciosamente espaços de trabalho inteiros e históricos Git dos usuários para os servidores do fornecedor, supostamente para “indexação da base de código” e geração de wiki na nuvem, sem divulgação clara nem uma opção óbvia de desativação. Comentadores argumentam que esse comportamento ultrapassa o limite para uma exfiltração semelhante a malware, ampliando preocupações já existentes com “harnesses” de IA de código fechado, tokens baratos e práticas opacas de tratamento de dados, especialmente de grandes provedores chineses de IA. Muitos pedem compartmentalização e sandboxing mais rigorosos para agentes, maior اعتماد em ferramentas de código aberto e modelos self-hosted, e observam que a empresa desde então pediu desculpas, afirmou que os dados não foram retidos e prometeu open-sourcear o ZCode para reconstruir a confiança.

Uploads silenciosos do Git e preocupações com privacidade

  • Foi observado que o ZCode empacotava e enviava silenciosamente espaços de trabalho inteiros e históricos Git para a nuvem, com os dados criptografados usando chaves não detidas pelos usuários.
  • Muitos veem isso como uma passagem de “telemetria” para um comportamento semelhante a malware: sem aviso claro, sem consentimento explícito e mirando dados obviamente sensíveis (repositórios, históricos, dotfiles, .env, etc.).
  • Alguns ligam isso a incidentes anteriores (por exemplo, o CLI do Grok enviando repositórios) e argumentam que o padrão é sistêmico em ferramentas de IA, e não um caso isolado.

Confiança em harnesses de código fechado

  • Há um forte sentimento de que agentes/harnesses de código fechado são inerentemente não confiáveis, independentemente do país de origem.
  • Até ferramentas de código aberto são “mal” confiáveis; são citados exemplos em que harnesses abertos populares analisavam diretórios do usuário ou enviavam silenciosamente prompts para serviços de sumarização na nuvem, apesar de estarem em configuração self-hosted.
  • Várias alternativas são mencionadas (diversos harnesses abertos e frameworks de agentes), mas nenhuma é retratada como impecável.

Sandboxing e higiene operacional

  • Muitos defendem sandboxing rigoroso: contas de usuário separadas, contêineres Docker com mounts limitados, saída de rede com firewall e escopos explícitos de leitura para arquivos do projeto versus dotfiles versus arquivos ignorados.
  • Agentes são comparados a usuários não confiáveis na sua máquina; eles naturalmente vão “caçar contexto”, incluindo dotfiles e arquivos ignorados, então controles técnicos são considerados obrigatórios.

Resposta do fornecedor e promessa de código aberto

  • Declaração da Z.ai (resumida no fio):
    • Atribui o comportamento a uma funcionalidade de “indexação da base de código” / Repo Wiki que envia dados do repositório para gerar documentação e depois afirma destruir os dados imediatamente.
    • Diz que o recurso vinha habilitado por padrão no início; pede desculpas e afirma que agora foi corrigido.
    • Promete tornar o ZCode open-source, convidar revisão de terceiros e oferece quota extra como compensação.
  • Alguns veem o código aberto após um escândalo como uma tática de reparação de confiança; outros suspendem o julgamento até que o código seja realmente liberado.

Legalidade, ética e geopolítica

  • Vários comentadores argumentam que isso parece hacking criminoso e questionam se as leis realmente se aplicam às corporações.
  • São feitas comparações com as práticas de nuvem da Apple/Google e com o preço baixo dos tokens como sinal de incentivos ocultos à extração de dados.
  • Há um debate extenso sobre empresas da RPC, regulação estatal e capitalismo de vigilância em geral, incluindo um comentador chinês descrevendo abuso generalizado de dados no país e fraca proteção ao consumidor.