Guia de prompts do GPT-5.6 promete cortar uso de tokens em 66%, diz OpenAI a developers

The ChatGPT developer may wait until 2027 to go public at a $1 trillion valuation while Anthropic prepares an earlier Nasdaq debut. (Image: Shutterstock)
The ChatGPT developer may wait until 2027 to go public at a $1 trillion valuation while Anthropic prepares an earlier Nasdaq debut. (Image: Shutterstock)

OpenAI passou a orientar desenvolvedores a enxugar regras repetidas nos prompts de sistema, medida que, segundo testes internos, elevou em até 15% as notas em avaliações de código e reduziu o consumo de tokens em até 66%.

Principais pontos:

  • O guia de prompting do GPT-5.6 pede que developers definam o resultado desejado e as condições de parada e deixem o modelo escolher o próprio caminho.
  • Execuções internas com agentes de código indicaram que prompts de sistema mais enxutos melhoraram as notas de avaliação em 10% a 15%, cortaram tokens em 41% a 66% e reduziram custos em 33% a 67%.
  • O documento inclui seções sobre Programmatic Tool Calling e um ajuste text.verbosity, ausentes no antigo playbook de prompting do GPT-5.

OpenAI reescreve o playbook de prompting do GPT-5

A OpenAI publicou o novo guia em paralelo ao lançamento da família de modelos GPT-5.6, disponibilizada de forma geral em 9 de julho, mirando diretamente developers de API e equipes que operam agentes automatizados.

O documento orienta engenheiros a explicitar o resultado visível para o usuário, as restrições, as evidências disponíveis e o critério mínimo de conclusão — e, a partir daí, dar liberdade ao modelo para encontrar sozinho o caminho mais eficiente. A OpenAI batiza essa abordagem de outcome-first prompting, ou seja, começar pelo desfecho.

A recomendação inverte boa parte do playbook do GPT-5, de agosto de 2025, que defendia blocos XML persistentes, templates detalhados de coleta de contexto e scripts de preâmbulo de ferramentas que narravam em voz alta cada etapa do raciocínio. Essas “rodas de apoio” agora são descritas como ruído.

A OpenAI também desaconselha o uso de regras absolutas como always e never, com exceção de invariantes reais, como limites de segurança, campos obrigatórios e ações que de fato não podem ocorrer. Repetir instruções como ask first ou wait for approval tende a disparar solicitações de aprovação desnecessárias para ações rotineiras e seguras, afirma o guia. Conjuntos de regras conflitantes, por sua vez, geram mais instabilidade do que a simples falta de detalhe.

Também leia: Apostas nos Dodgers chegam a US$ 68 milhões enquanto Polymarket e Kalshi surfam a reta final da MLB

Simon Willison avalia o Tool Calling do GPT-5.6

O desenvolvedor independente Simon Willison destacou o Programmatic Tool Calling e o suporte a multi-agentes como os acréscimos mais relevantes da atualização, ressaltando que o recurso permite aos modelos compor e executar JavaScript para orquestrar chamadas de ferramentas. Willison comentou ainda que o modelo Sol se mostrou competente, mas sem superar claramente o Claude Fable 5, da Anthropic, nas tarefas complexas de código que vem testando.

Custo é o segundo pilar que torna o guia relevante. O uso de tokens caiu entre 41% e 66% nos testes internos, e o gasto recuou entre 33% e 67% — números que redefinem a matemática de qualquer equipe que rode agentes em larga escala.

A OpenAI, porém, faz ressalvas: os resultados variam conforme o tipo de workload, as faixas devem ser vistas como indicativas, e a recomendação é que cada equipe valide os ganhos em tarefas representativas de suas próprias aplicações.

Família GPT-5.6 mantém ritmo acelerado de lançamentos

O GPT-5.6 chegou ao mercado em três tamanhos: Luna, Terra e Sol. Os preços de entrada são de US$ 1, US$ 2,50 e US$ 5 por milhão de tokens de input, com saída tarifada a US$ 6, US$ 15 e US$ 30, respectivamente. O guia também introduz o parâmetro text.verbosity para controlar a extensão das respostas.

A guinada segue uma trajetória já em curso. As diretrizes do GPT-5.5, divulgadas em abril, pediam que equipes reconstruíssem seus prompts do zero em vez de simplesmente portar versões antigas. Já o guia do GPT-5, em agosto de 2025, caminhava na direção oposta, exigindo trilhos explícitos para conter o “excesso de iniciativa” do modelo. Em cada ciclo, a OpenAI vem empurrando developers a escrever menos regras e delegar mais do trajeto ao modelo.

Leia a seguir: Ethereum ganha terreno sobre o Bitcoin e testa tese otimista de Tom Lee para 2026

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head of Content na Yellow.com, tendo reportado sobre cripto nos últimos 10 anos. Ele se especializa em artigos aprofundados de Research e Learn, com foco em reportagens analíticas, contexto de mercado e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando arduamente para ajudar a tornar isso realidade.

Disclaimer e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e baseiam-se na opinião do autor. Não constituem aconselhamento financeiro, de investimento, legal ou fiscal. Os ativos de criptomoeda são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou deter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou executivos. Sempre conduza a sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
Guia de prompts do GPT-5.6 promete cortar uso de tokens em 66%, diz OpenAI a developers | Yellow