Misticizar a IA torna mais provável que falhemos em operá-la bem (2023)

Argumentos sobre o que deve contar como “inteligência artificial” dominam esta troca, com muitos contrastando os atuais grandes modelos de linguagem — sistemas estatísticos poderosos, porém sujeitos a erros — com o objetivo há muito imaginado de uma inteligência humana ou de nível “AGI”. Os comentaristas debatem se os modelos atuais realmente raciocinam ou apenas simulam raciocínio, como definições mutáveis de “inteligência” e “IA” distorcem as expectativas do público e por que exagerar ou misticizar a tecnologia poderia levar a má gestão, medo equivocado e políticas ruins. Junto disso, há apelos por terminologia mais clara, proveniência digital para saídas de IA e uma cultura de cautela tanto sobre impactos econômicos quanto sobre riscos existenciais futuros.

Escopo e Atualidade do Artigo

  • Vários observam que o artigo tem ~3 anos; alguns acham que ele ainda é válido, já que os LLMs modernos são versões ampliadas da mesma abordagem básica.
  • Outros veem a publicação agora como provocação, dado o quão rápido os modelos avançaram e o quão defensivos alguns usuários ficam quando LLMs são criticados.

O que Conta como “IA” e “Inteligência”

  • Há forte discordância sobre chamar LLMs de “IA”:
    • Um lado diz que são geradores avançados de texto, não inteligências autônomas; “IA” deveria ser reservada para sistemas em nível humano ou de “AGI”.
    • Outros argumentam que a área usa “IA” há décadas para tudo, de IAs de jogos a NPCs, e que LLMs claramente atendem, na prática, a “artificial” + “comportamento inteligente”.
  • Muitos apontam que “inteligência” carece de uma definição clara e mensurável; as pessoas falam sem se entender e frequentemente movem os critérios quando os computadores dominam uma tarefa.
  • Alguns sugerem abandonar “inteligência” como termo científico e, em vez disso, falar de capacidades ou habilidades específicas.

Capacidades e Falhas dos LLMs

  • Defensores enfatizam que eles podem resolver problemas matemáticos originais, programar e passar em exames; isso não pode ser comparado de forma significativa a calculadoras.
  • Céticos destacam modos de falha: alucinações, planos sem sentido (por exemplo, caminhar vs. dirigir), prompt injection, confusões de estado de ferramentas, deriva de linguagem e raciocínio frágil.
  • Há debate sobre se essas falhas são fundamentalmente diferentes de erros humanos ou apenas outra variante de raciocínio falível.
  • Alguns comparam os atuais sistemas multi-chamada/agentes a algoritmos probabilísticos: executar muitas vezes até que apareça uma resposta boa o suficiente.

Teste de Turing, AGI e Antropomorfização

  • Discorda-se sobre se os modelos modernos “passam” em testes de Turing robustos, especialmente contra avaliadores humanos motivados.
  • Alguns veem os LLMs como uma inteligência “alienígena”; outros dizem que chamar isso de “raciocínio” é apenas renomear correspondência de padrões.
  • Há preocupação de que misticizar e antropomorfizar sistemas (termos de marketing como “raciocínio”, “agentes”) induza o público e os formuladores de políticas ao erro.

Risco, Autonomia e Utilidade

  • Um campo: os sistemas atuais são ferramentas poderosas, mas estão longe de uma tomada autônoma; falar em “risco existencial” parece prematuro ou quase religioso.
  • Outro: não é cedo demais para ter cautela; mais autonomia, combinada com acesso à infraestrutura, pode ser perigoso, especialmente à medida que modelos locais e rápidos melhoram.

Proveniência, Privacidade e Governança

  • Há forte interesse em “proveniência digital” para saídas de IA — um equivalente de “View Source” que explique quais padrões dos dados de treinamento moldaram o comportamento, para apoiar responsabilização e depuração.
  • Alguns preferem definir privacidade como controle sobre quais dados são extraídos, em vez de um vago “direito de ser deixado em paz” ou de “não ser manipulado”.
  • Vários argumentam que nomeação e enquadramento conceitual importam muito: nomear tecnologias de forma errada pode levar a expectativas ruins, hype e erros de política.