OpenAI aponta três falhas por trás da súbita queda de desempenho do GPT-6 Astra

DevDay comments leave OpenAI’s IPO without a firm timeline over AI safety concerns (Image: Shutterstock)
DevDay comments leave OpenAI’s IPO without a firm timeline over AI safety concerns (Image: Shutterstock)

OpenAI corrigiu três falhas que estiveram na origem de uma semana de queixas de utilizadores sobre a alegada “desinteligência” do novo modelo GPT-6 Astra após o lançamento, e está a repor os limites de utilização para os assinantes do Codex.

Pontos-chave:

  • Utilizadores do Astra passaram a semana a publicar testes lado a lado, alegando que o modelo tinha sido discretamente enfraquecido desde o lançamento.
  • O responsável pelo Codex na OpenAI identificou três causas, incluindo uma experiência de gestão de contexto que afetou cerca de 4.000 a 5.000 utilizadores.
  • O anterior modelo de topo da empresa, GPT-5.6 Sol, enfrentou a mesma acusação em julho.

OpenAI corrige falhas de qualidade no Astra

O responsável de produto do Codex, Tibo Sottiaux, afirmou que a equipa trabalhou em conjunto com utilizadores para rastrear as falhas, implementar correções e fazer uma reposição total de consumo antes da meia-noite, segundo uma atualização publicada no sábado. “Skills” criadas para modelos anteriores estavam a ser acionadas com demasiada frequência, por vezes impedindo o Astra de validar o próprio trabalho.

Uma experiência opcional de gestão de contexto podia ainda levar o modelo a terminar respostas antes de tempo ou a responder com base em mensagens antigas, o que levou a OpenAI a desativar o teste depois de atingir cerca de 4.000 a 5.000 utilizadores. Alguns “engines” tinham sido configurados de forma incorreta e degradavam de forma mensurável a qualidade do tráfego encaminhado para esses backends; a empresa removeu essas instâncias e fez vários ajustes adicionais. Sottiaux escreveu que o modelo agora acompanha de forma mais fiel a última mensagem do utilizador.

Veja também: Ethereum enfrenta barreira de oferta nos $2.800 após entradas em ETF atingirem $216M

Utilizadores do Astra relatam regressão em tarefas de código

As críticas acumularam-se ao longo da semana no X, onde programadores correram “prompts” idênticos no Astra do dia de lançamento e na versão atual, mantendo todas as definições constantes e depois comparando os resultados. O developer Pranjal Paliwal, que dias antes tinha elogiado o modelo, reviu o código que este escrevera para si e classificou o desfecho como uma regressão, não um avanço.

Dax Raad, criador da ferramenta de programação Opencode, decidiu recuar a sua equipa para o antigo GPT-5.6 Sol depois de verificar que a fatura com o Astra tinha duplicado para desvantagens que, na sua avaliação, não justificavam o custo adicional.

Num fórum, um utilizador descreveu o Astra como estando agora ao nível do Sol nas mesmas tarefas, com o mesmo número de tentativas. Nem todos concordaram com esta leitura: um utilizador pseudónimo sob o nome Antikythera argumentou que o modelo sempre fora “preguiçoso” e inclinado para listas em tópicos, e que os utilizadores apenas tinham deixado de se deslumbrar.

Limites de computação ensombram o GPT-6 Astra

A capacidade tem sido um problema desde que o modelo passou a estar amplamente disponível no início de setembro.

Segundo relatos de utilizadores, a OpenAI reduziu os limites de utilização do Astra para os “power users” do ChatGPT e suspendeu novas subscrições Pro de $200, uma decisão que Sottiaux confirmou a 10 de setembro. O modelo mantém o preço de $10 por milhão de “tokens” de entrada e $50 por milhão de “tokens” de saída — 2,5 vezes o valor cobrado pelo Sol no lançamento.

Este é o segundo modelo de topo da OpenAI em dois meses a enfrentar a mesma acusação por parte de clientes pagantes. Em julho, utilizadores afirmaram que o modo de raciocínio mais avançado do Sol tinha ficado “raso” de um dia para o outro. Sottiaux negou qualquer enfraquecimento deliberado, mas confirmou que a empresa vinha a experimentar diferentes níveis de esforço de raciocínio.

Leia a seguir: Jensen Huang, da Nvidia, diz que empresas de segurança lucram com o pânico em torno de ameaças de IA

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é Chefe de Conteúdo na Yellow.com. Ele é especializado em artigos de Pesquisa e Aprendizado aprofundados, com foco em reportagens analíticas, contexto de mercado e nas grandes forças que moldam o cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando arduamente para que isso se torne realidade.

Disclaimer e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e baseiam-se na opinião do autor. Não constituem aconselhamento financeiro, de investimento, legal ou fiscal. Os ativos de criptomoeda são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou deter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou executivos. Sempre conduza a sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
OpenAI aponta três falhas por trás da súbita queda de desempenho do GPT-6 Astra | Yellow