Google pausa a geração de imagens de pessoas pelo Gemini após problemas

O gerador de imagens do Gemini do Google recebeu críticas após produzir imagens ahistóricas — como nazistas racialmente diversos e “Pais Fundadores” negros — e frequentemente se recusar a retratar pessoas brancas mesmo quando isso era explicitamente pedido. Comentaristas veem isso como uma correção excessiva a um viés real nos dados de treinamento, impulsionada por injeção de prompts e guardrails inspirados em DEI, que distorcem a realidade histórica e demográfica. O episódio levanta preocupações mais amplas sobre intervenções ocultas em sistemas de IA, o impacto da ideologia corporativa na qualidade e na confiança no produto, e a necessidade de modelos mais transparentes ou controláveis pelo usuário.

Comportamento e exemplos de imagens do Gemini

  • Muitos comentaristas testaram o gerador de imagens do Gemini e viram:
    • Recusas em gerar pessoas explicitamente “brancas” (“nice white man”, “white nurse”), enquanto gerava sem problemas prompts equivalentes para outras raças.
    • Resultados ahistóricos ou implausíveis: “vikings” negros ou asiáticos, “soldados alemães de 1943” racialmente diversos, “pais fundadores” dos EUA, alemães/escoceses do século XIX, etc.
    • Trocas de gênero (por exemplo, “happy man” -> imagem de uma mulher; “king” -> mulher).
  • A resposta pública do Google (pausando imagens de pessoas) é vista como uma admissão de que foram adicionadas restrições fortes, pós-treinamento, e elas deram errado.

Viés, diversidade e “racismo reverso”

  • Um grupo vê isso como uma correção excessiva a um viés real dos dados: sem intervenção, os modelos superproduzem homens brancos para muitos papéis (enfermeiro/médico/engenheiro, etc.).
  • Outro grupo chama isso de racismo anti-branco ou “DEI longe demais”, argumentando que:
    • Apaga a realidade histórica e trata a branquitude como algo singularmente suspeito.
    • Não é simétrico: prompts “só brancos” são bloqueados enquanto prompts “só negros” ou de outra raça funcionam.
  • Há debate sobre se “racismo” exige desequilíbrio de poder; alguns insistem que qualquer discriminação baseada em raça se qualifica.

Causas técnicas e manipulação de prompts

  • Vários especulam que o Gemini (como o DALL·E) reescreve silenciosamente prompts com termos como “diverse”, etnias específicas e gêneros.
  • Uma captura de tela mostra o modelo explicando esse expandir interno de prompt para “diversidade”; outros contra-argumentam que modelos podem alucinar sobre o próprio design.
  • Outros apontam para:
    • Conjuntos de dados altamente filtrados.
    • Camadas de RLHF / guardrails treinadas em exemplos “seguros” curados.
    • Simples bloqueio por palavra-chave que impede certas combinações.

Realidade vs. aspiração e precisão histórica

  • Há forte discordância sobre o que os modelos de imagem “deveriam” fazer:
    • Refletir distribuições empíricas de dados (“história material”), mesmo que enviesadas.
    • Contrabalançar intencionalmente estereótipos e mostrar diversidade aspiracional.
  • Muitos argumentam que, para história e consultas concretas (fundadores, nazistas, alemães de 1820), a precisão deve prevalecer sobre a diversidade; “colorir” a história esconde injustiças passadas.
  • Outros aceitam algum empurrãozinho suave (por exemplo, mais diversidade em “board members”), mas veem o comportamento do Gemini como comicamente pesado.

Confiança, censura e impacto no produto

  • Há preocupação generalizada com:
    • Injeção silenciosa de prompts e vieses não divulgados vazando para a busca e outros produtos do Google.
    • “Ideologia” corporativa sobrepondo-se à qualidade do produto e à intenção do usuário.
  • Alguns dizem que isso é um argumento a favor de modelos abertos e “configurações de diversidade” controláveis pelo usuário; as sugestões incluem:
    • Alternâncias como “historicamente preciso” vs. “diversidade aprimorada”.
    • Divulgação explícita de prompts de sistema e regras de correção de viés.
  • Outros são mais cínicos: os usuários podem esquecer em meses, mas esse episódio prejudica a confiança no julgamento de IA do Google.