OpenAI aponta três falhas por trás da súbita piora do GPT-6 Astra

DevDay comments leave OpenAI’s IPO without a firm timeline over AI safety concerns (Image: Shutterstock)
DevDay comments leave OpenAI’s IPO without a firm timeline over AI safety concerns (Image: Shutterstock)

OpenAI corrigiu três falhas que estavam por trás de uma semana de reclamações de usuários de que seu novo modelo GPT-6 Astra havia “ficado mais burro” após o lançamento, e está redefinindo os limites de uso para assinantes do Codex.

Pontos-chave:

  • Usuários do Astra passaram a semana publicando testes lado a lado, alegando que o modelo havia sido silenciosamente enfraquecido desde o lançamento.
  • O líder do Codex na OpenAI apontou três causas, incluindo um experimento de contexto que afetou cerca de 4.000 a 5.000 usuários.
  • A antiga estrela da empresa, o GPT-5.6 Sol, enfrentou a mesma acusação em julho.

OpenAI corrige falhas de qualidade do Astra

O líder de produto do Codex, Tibo Sottiaux, afirmou que a equipe trabalhou junto com usuários para rastrear as falhas, lançou correções e fez uma redefinição completa de uso antes da meia-noite, horário local, segundo uma atualização publicada no sábado. Habilidades escritas para modelos anteriores estavam sendo acionadas com frequência excessiva, em alguns casos impedindo o Astra de conferir o próprio trabalho.

Um experimento opcional de gerenciamento de contexto também podia fazer o modelo encerrar a resposta antes da hora ou responder a mensagens antigas, e a OpenAI desativou o recurso depois que aproximadamente 4.000 a 5.000 usuários foram afetados pelo teste. Alguns mecanismos haviam sido configurados de forma inadequada e degradaram de maneira mensurável a qualidade do tráfego residual roteado por eles; a empresa removeu esses mecanismos e fez vários ajustes menores. Sottiaux escreveu que o modelo agora acompanha com mais precisão a última mensagem do usuário.

Veja também: Ethereum enfrenta barreira de oferta em US$ 2.800 após ETFs somarem US$ 216 milhões em entradas

Usuários do Astra relatam retrocesso em código

As queixas se acumularam ao longo da semana no X, onde desenvolvedores rodaram os mesmos prompts no Astra do dia do lançamento e na versão atual, mantendo todas as configurações idênticas, e então compararam os resultados. O desenvolvedor Pranjal Paliwal, que havia elogiado o modelo dias antes, revisitou o código gerado por ele e classificou o desempenho como um retrocesso, não um avanço.

Dax Raad, que desenvolve a ferramenta de programação Opencode, decidiu migrar sua equipe de volta ao antigo GPT-5.6 Sol depois de ver o gasto com o Astra praticamente dobrar, sem benefícios que, na avaliação dele, justificassem o custo extra.

Um usuário em fórum descreveu o Astra como hoje praticamente empatado com o Sol nas mesmas tarefas, exigindo o mesmo número de novas tentativas. Nem todos concordaram com essa leitura, e um usuário pseudônimo que escreve como Antikythera argumentou que o modelo sempre foi preguiçoso e fã de listas em tópicos, e que os usuários apenas deixaram de se impressionar.

Limites computacionais cercam o GPT-6 Astra

Capacidade vem sendo um fator crítico desde que o modelo passou a ficar amplamente disponível no início de setembro.

Segundo relatos de usuários, a OpenAI reduziu os limites de uso do Astra para heavy users do ChatGPT e suspendeu novas assinaturas Pro de US$ 200, medida que Sottiaux confirmou em 10 de setembro. O modelo continua custando US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída — 2,5 vezes o preço cobrado pelo Sol quando foi lançado.

Este é o segundo modelo principal da OpenAI em dois meses a enfrentar a mesma acusação por parte de clientes pagantes. Em julho, usuários afirmaram que o modo avançado de raciocínio do Sol havia se tornado superficial da noite para o dia. Sottiaux negou qualquer enfraquecimento deliberado, mas confirmou que a empresa vinha fazendo experimentos com o “esforço de raciocínio” do sistema.

Leia a seguir: Jensen Huang, da Nvidia, diz que empresas de segurança se beneficiam do pânico com ameaças de IA

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é Chefe de Conteúdo na Yellow.com. Ele se especializa em matérias de Pesquisa e Aprendizado detalhadas, com foco em reportagens analíticas, contexto de mercado e nas grandes forças que moldam o cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando intensamente para que isso se torne realidade.

Isenção de responsabilidade e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e são baseadas na opinião do autor. Elas não constituem aconselhamento financeiro, de investimento, jurídico ou tributário. Ativos de criptomoedas são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou manter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou seus executivos. Sempre conduza sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
OpenAI aponta três falhas por trás da súbita piora do GPT-6 Astra | Yellow