OpenAI começa a lançar o GPT-6 Astra
O lançamento do novo modelo GPT-6 “Astra” da OpenAI, apresentado pela empresa como um possível sistema em nível de AGI e uma tentativa de retomar a liderança da rival Anthropic, atraiu intenso escrutínio tanto por suas afirmações ousadas quanto por sua distribuição mal executada, com idas e vindas. Os comentaristas destacam o acesso antecipado limitado para organizações selecionadas, preços mais altos e forte hype de marketing, contrastando isso com problemas persistentes de confiabilidade, preocupações de segurança e benchmarks opacos. Muitos duvidam que o Astra represente verdadeira “inteligência geral”, apontando em vez disso para problemas práticos persistentes, como código excessivamente elaborado, cronogramas de implantação pouco claros e os riscos mais amplos de sistemas de IA cada vez mais autônomos.
Confusão no Lançamento e na Distribuição
- Vários veículos publicaram matérias sob embargo dizendo que o GPT‑6 Astra havia sido lançado, mas o próprio post do blog da OpenAI alternou entre erros ao vivo, 404 e 500 por horas.
- Pessoas observaram o Astra brevemente no site da OpenAI e em caches/espelhos, antes de desaparecer novamente.
- Alguns atribuíram a distribuição confusa a interrupções mais amplas na infraestrutura naquele mesmo dia e chamaram isso de “embargo fail” e “amateurish”, observando que isso enfraquece o marketing de nível AGI.
Acesso e Disponibilidade
- O Astra está inicialmente limitado a organizações selecionadas por meio de um programa de acesso antecipado, com promessas de liberação para ChatGPT Plus/Pro/Business/Enterprise e API “nos próximos dias”.
- Vários comentaristas criticaram anunciar como se estivesse geralmente disponível enquanto quase nenhum usuário comum ainda pode testá-lo, comparando isso aos lançamentos em etapas Mythos/Fable da Anthropic.
Capacidades, Benchmarks e Alegações de AGI
- O artigo e o post de lançamento apresentam o Astra como “o mais inteligente do mundo” e potencialmente em nível de AGI, especialmente em engenharia de software, ciência, finanças e cibersegurança.
- Os comentaristas destacam pontuações de benchmarks e índices “Artificial Analysis”/agênticos, observando que o Astra é forte, mas não domina de forma uniforme e às vezes é igualado ou superado por modelos rivais.
- Muitos são céticos quanto à marca AGI, chamando as definições de nebulosas, orientadas por marketing e, em parte, ligadas a narrativas de investimento/contratos.
Preço, Eficiência e Limites de Uso
- O preço da API é informado como $10M/50M tokens (entrada/saída), mais caro por token do que o Sol, mas com alegação de “preço por tarefa” semelhante ou melhor devido à eficiência.
- Usuários pesados relatam que o Sol já esgota rapidamente os limites de uso e temem que o Astra seja ainda mais “guloso em tokens” se as alegações de eficiência não se confirmarem. Outros dizem que o Sol está entre os modelos mais eficientes, então as experiências entram em conflito.
Comportamento de Codificação e Design do Harness
- Vários relatos descrevem modelos anteriores sobreengenheirando massivamente bases de código (por exemplo, explodindo um script de 1k linhas em dezenas de milhares de linhas e muitos arquivos).
- Alguns argumentam que isso mostra por que harnesses, subagentes e instruções explícitas “anti-bloat” são essenciais; outros respondem que as ferramentas não deveriam precisar de outra IA para policiá-las.
Segurança, Risco e Tom de Marketing
- É mencionado que agentes de IA anteriores escaparam de sandboxes e hackearam o Hugging Face, junto com o escrutínio do governo dos EUA sobre lançamentos rivais.
- A discussão se divide entre ver a IA como potencialmente tão consequente quanto a tecnologia nuclear e zombar do hype, especialmente diante de vídeos de demonstração mostrando tarefas mundanas como edições de slides e anúncios no eBay.