OpenAI aponta três falhas por trás da queda repentina do GPT-6 Astra

Three faults named by OpenAI's Tibo Sottiaux explain why GPT-6 Astra slipped for a week of testing (Image: Shutterstock)
Three faults named by OpenAI's Tibo Sottiaux explain why GPT-6 Astra slipped for a week of testing (Image: Shutterstock)

OpenAI corrigiu três falhas que ficaram no centro de uma semana de reclamações de usuários de que o novo modelo GPT-6 Astra havia “ficado burro” após o lançamento, e está redefinindo os limites de uso para assinantes da Codex.

Pontos-chave:

  • Usuários do Astra passaram a semana publicando testes lado a lado, alegando que o modelo havia sido silenciosamente enfraquecido desde o anúncio.
  • O líder da Codex na OpenAI apontou três causas, incluindo um experimento de contexto que afetou cerca de 4.000 a 5.000 usuários.
  • O antigo carro-chefe da empresa, o GPT-5.6 Sol, sofreu a mesma acusação em julho.

OpenAI corrige falhas de qualidade do Astra

O líder de produto da Codex, Tibo Sottiaux, afirmou que a equipe trabalhou com usuários para rastrear as falhas, implementar correções e fazer um reset completo de uso antes da meia-noite, horário local, segundo atualização publicada no sábado. Habilidades criadas para modelos anteriores estavam disparando com frequência excessiva, em alguns casos impedindo o Astra de revisar o próprio trabalho.

Um experimento opcional de gerenciamento de contexto também podia fazer o modelo encerrar respostas antes da hora ou responder a mensagens antigas, e a OpenAI desativou o teste após atingir algo entre 4.000 e 5.000 usuários. Alguns mecanismos internos estavam configurados de forma incorreta e degradavam de maneira mensurável a qualidade no tráfego encaminhado por eles; a empresa removeu esses engines e aplicou uma série de ajustes pontuais. Sottiaux escreveu que o modelo agora acompanha a última mensagem do usuário com mais precisão.

Veja também: Ethereum enfrenta barreira de oferta em US$ 2.800 após ETFs somarem US$ 216 milhões em entradas

Usuários do Astra relatam piora em tarefas de código

As reclamações se acumularam ao longo da semana no X, onde desenvolvedores rodaram os mesmos prompts no Astra do dia do lançamento e na versão atual, mantendo todas as configurações idênticas, e então compararam os resultados. O desenvolvedor Pranjal Paliwal, que havia elogiado o modelo dias antes, revisitou o código que ele gerou e classificou o que viu como regressão, não avanço.

Dax Raad, criador da ferramenta de programação Opencode, recuou sua equipe para o antigo GPT-5.6 Sol depois que o gasto com o Astra dobrou, sem, na avaliação dele, entregar benefícios proporcionais ao custo.

Em um fórum, um usuário descreveu o Astra como agora equivalente ao Sol nas mesmas tarefas, com o mesmo número de tentativas. Nem todos concordaram com essa leitura: um usuário pseudônimo conhecido como Antikythera argumentou que o modelo sempre foi “preguiçoso” e adepto de listas em tópicos, e que o deslumbramento inicial dos usuários é que havia passado.

Limites de computação pairam sobre o GPT-6 Astra

Capacidade de processamento tem sido um fator sensível desde que o modelo passou a ficar amplamente disponível no início de setembro.

Segundo relatos de usuários, a OpenAI reduziu os limites de uso do Astra para heavy users do ChatGPT e suspendeu novas assinaturas Pro de US$ 200, movimento que Sottiaux confirmou em 10 de setembro. O preço do modelo permanece em US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída — 2,5 vezes o que o Sol cobrava no lançamento.

Este é o segundo carro-chefe da OpenAI em dois meses a enfrentar a mesma crítica de usuários pagantes. Em julho, clientes relataram que o modo avançado de raciocínio do Sol havia “raso” da noite para o dia. Sottiaux negou qualquer enfraquecimento intencional, mas confirmou que a empresa vinha fazendo testes com diferentes níveis de esforço de raciocínio.

Leia a seguir: Jensen Huang, da Nvidia, diz que empresas de segurança surfam a onda de pânico com ameaças de IA

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head de Conteúdo da Yellow.com, tendo coberto o setor de cripto nos últimos 10 anos. Ele é especializado em artigos de Pesquisa e Aprendizado aprofundados, com foco em reportagens analíticas, contexto da indústria e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando intensamente para que isso se torne realidade.

Isenção de responsabilidade e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e são baseadas na opinião do autor. Elas não constituem aconselhamento financeiro, de investimento, jurídico ou tributário. Ativos de criptomoedas são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou manter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou seus executivos. Sempre conduza sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
OpenAI aponta três falhas por trás da queda repentina do GPT-6 Astra | Yellow