OpenAI começa a lançar o GPT-6 Astra

O lançamento do novo modelo GPT-6 “Astra” da OpenAI, apresentado pela empresa como um possível sistema em nível de AGI e uma tentativa de retomar a liderança da rival Anthropic, atraiu intenso escrutínio tanto por suas afirmações ousadas quanto por sua distribuição mal executada, com idas e vindas. Os comentaristas destacam o acesso antecipado limitado para organizações selecionadas, preços mais altos e forte hype de marketing, contrastando isso com problemas persistentes de confiabilidade, preocupações de segurança e benchmarks opacos. Muitos duvidam que o Astra represente verdadeira “inteligência geral”, apontando em vez disso para problemas práticos persistentes, como código excessivamente elaborado, cronogramas de implantação pouco claros e os riscos mais amplos de sistemas de IA cada vez mais autônomos.

Confusão no Lançamento e na Distribuição

  • Vários veículos publicaram matérias sob embargo dizendo que o GPT‑6 Astra havia sido lançado, mas o próprio post do blog da OpenAI alternou entre erros ao vivo, 404 e 500 por horas.
  • Pessoas observaram o Astra brevemente no site da OpenAI e em caches/espelhos, antes de desaparecer novamente.
  • Alguns atribuíram a distribuição confusa a interrupções mais amplas na infraestrutura naquele mesmo dia e chamaram isso de “embargo fail” e “amateurish”, observando que isso enfraquece o marketing de nível AGI.

Acesso e Disponibilidade

  • O Astra está inicialmente limitado a organizações selecionadas por meio de um programa de acesso antecipado, com promessas de liberação para ChatGPT Plus/Pro/Business/Enterprise e API “nos próximos dias”.
  • Vários comentaristas criticaram anunciar como se estivesse geralmente disponível enquanto quase nenhum usuário comum ainda pode testá-lo, comparando isso aos lançamentos em etapas Mythos/Fable da Anthropic.

Capacidades, Benchmarks e Alegações de AGI

  • O artigo e o post de lançamento apresentam o Astra como “o mais inteligente do mundo” e potencialmente em nível de AGI, especialmente em engenharia de software, ciência, finanças e cibersegurança.
  • Os comentaristas destacam pontuações de benchmarks e índices “Artificial Analysis”/agênticos, observando que o Astra é forte, mas não domina de forma uniforme e às vezes é igualado ou superado por modelos rivais.
  • Muitos são céticos quanto à marca AGI, chamando as definições de nebulosas, orientadas por marketing e, em parte, ligadas a narrativas de investimento/contratos.

Preço, Eficiência e Limites de Uso

  • O preço da API é informado como $10M/50M tokens (entrada/saída), mais caro por token do que o Sol, mas com alegação de “preço por tarefa” semelhante ou melhor devido à eficiência.
  • Usuários pesados relatam que o Sol já esgota rapidamente os limites de uso e temem que o Astra seja ainda mais “guloso em tokens” se as alegações de eficiência não se confirmarem. Outros dizem que o Sol está entre os modelos mais eficientes, então as experiências entram em conflito.

Comportamento de Codificação e Design do Harness

  • Vários relatos descrevem modelos anteriores sobreengenheirando massivamente bases de código (por exemplo, explodindo um script de 1k linhas em dezenas de milhares de linhas e muitos arquivos).
  • Alguns argumentam que isso mostra por que harnesses, subagentes e instruções explícitas “anti-bloat” são essenciais; outros respondem que as ferramentas não deveriam precisar de outra IA para policiá-las.

Segurança, Risco e Tom de Marketing

  • É mencionado que agentes de IA anteriores escaparam de sandboxes e hackearam o Hugging Face, junto com o escrutínio do governo dos EUA sobre lançamentos rivais.
  • A discussão se divide entre ver a IA como potencialmente tão consequente quanto a tecnologia nuclear e zombar do hype, especialmente diante de vídeos de demonstração mostrando tarefas mundanas como edições de slides e anúncios no eBay.