B.AI, plataforma de próxima geração de infraestrutura de IA, desencadeou recentemente uma verdadeira corrida entre developers ao oferecer acesso gratuito a modelos de topo. Em poucos dias, o volume diário de tokens na plataforma superou 1,33 biliões – um marco histórico.
O número recorde confirma a tração explosiva da campanha, mas representa apenas o primeiro passo no roteiro estratégico mais amplo da B.AI. Para além dos modelos tradicionais de distribuição de computação, a B.AI quer construir a camada global de liquidação da inteligência: um hub de infraestrutura central, concebido para suportar colaboração entre nós, orquestração e distribuição de valor entre agentes de IA em fluxos de trabalho empresariais complexos.
Ao posicionar-se estrategicamente “acima de todos os modelos, abaixo de todos os agentes”, a B.AI integra profundamente uma gama diversa de modelos de ponta com componentes full-stack, criando um alicerce sólido e insubstituível para a adoção massiva de agentes autónomos e o consequente salto de produtividade.
Volume diário supera 1,33 biliões de tokens: acesso gratuito da B.AI dispara utilização
A decisão recente da B.AI de abrir acesso gratuito a modelos de IA premium conquistou a comunidade de developers e dominou rapidamente a discussão no setor. A ofensiva pela computação acessível não só impulsionou fortemente a atividade na plataforma como quebrou todos os recordes de utilização.
Em poucos dias, a procura via API fez o throughput diário ultrapassar uns impressionantes 1,33 biliões de tokens. Numa janela de 15 dias, o volume acumulado chegou a 8,19 biliões de tokens, atraindo mais de 220.000 novos utilizadores de API. A 3 de setembro, a base total de utilizadores da B.AI já superava os 2,3 milhões.
Esta adoção massiva está diretamente ligada ao portefólio de modelos a custo zero, uma estratégia pensada para eliminar de raiz as preocupações com preços por parte dos developers. Sem barreiras, a B.AI oferece hoje acesso gratuito e ilimitado a seis modelos de fronteira: DeepSeek-V4-Flash, DeepSeek-V4-Flash-Vision-Exp, Tencent Hy3, Xiaomi MiMo-V2.5, GLM-5.3-Flash (Ox Alpha) e Qwen3.8-Flash.

Em destaque, a 3 de setembro a B.AI introduziu uma nova grelha de preços para os modelos DeepSeek-V4-Flash e DeepSeek-V4-Flash-Vision-Exp, com descontos escalonados. Os developers passam a ter 50% de desconto em horas de pico e tarifas reduzidas a apenas 25% do preço padrão fora do pico. Em paralelo, o acesso gratuito é mantido para GLM-5.3-Flash (Ox Alpha), Qwen3.8-Flash, Tencent Hy3 e Xiaomi MiMo-V2.5. Apesar do movimento de comercialização, o ritmo dos developers não abrandou: o throughput de tokens continua a subir de forma consistente.
Esta dinâmica sustentada mostra que a campanha foi muito mais do que uma operação tática de oferta de computação – é um sinal de viragem na evolução da infraestrutura de IA. Romper a barreira de 1,33 biliões de tokens diários deixa claro que as aplicações de IA já deixaram para trás o simples chatbot. Assente num stack técnico de alta performance e numa mecânica de serviços flexível, a B.AI está a preparar o terreno para a próxima fronteira: agentes de IA autónomos a operar em escala.
A “rede elétrica de IA”: B.AI ancora a camada global de liquidação da economia de agentes
Para a B.AI, democratizar acesso à computação é apenas o prólogo. Olhando mais à frente, a plataforma está focada em construir uma infraestrutura full-stack para a era agentic, consolidando-se como a camada global de liquidação da inteligência.
Na era dos agentes, uma tarefa típica exige alternância constante entre modelos. Nenhum fornecedor consegue, sozinho, suportar um fluxo de trabalho completo; developers acabam a gerir APIs fragmentadas, sistemas de faturação desalinhados e limites de taxa divergentes.
É precisamente esse fosso que a camada de liquidação da B.AI pretende colmatar. Posicionada estrategicamente “acima de todos os modelos, abaixo de todos os agentes”, a B.AI abstrai modelos de diferentes fornecedores, capacidades e estruturas de custos, consolidando-os num pool unificado de recursos escalonáveis.
Sustentada por uma arquitetura dual de API – combinando rotas oficiais, com fiabilidade garantida, e canais customizados de menor custo – a B.AI permite aos developers escolher entre ligações diretas garantidas e alternativas com descontos agressivos, numa ampla seleção de modelos. Aliado ao smart routing na interface Chat, a B.AI funciona como uma verdadeira “rede elétrica de IA”, garantindo que cada pedido de agente é encaminhado para o modelo mais adequado, maximizando performance e eficiência de custos.

No plano da liquidação, esta “rede elétrica” liga, de forma transparente, modelos Web2 e Web3. No mundo Web2, os developers podem recorrer a meios de pagamento tradicionais, num processo de carregamento simples e com fricção mínima. No universo Web3, a B.AI tira partido de rails de pagamento on-chain para oferecer à comunidade global de developers opções de liquidação descentralizadas, auditáveis e de baixo atrito.
Com sistemas de pagamento dual a correr em paralelo, a B.AI permite que developers e aplicações de agentes, independentemente da infraestrutura em que operam, encontrem o caminho ótimo de liquidação na “rede”, através de uma integração única com alcance global sem fronteiras.
A produtividade no centro: B.AI redefine a colaboração entre agentes
Para lá da camada base de encaminhamento de computação e liquidação global, a B.AI está a dar o passo seguinte: transformar infraestrutura em produtividade tangível. Ao viabilizar a colaboração fluida entre agentes em fluxos de trabalho complexos, fornece a camada de execução que faltava à economia de agentes.
No coração desta camada de execução está a integração nativa com o Codex. Graças à compatibilidade total com a Responses API, os developers podem agora usar uma única chave B.AI dentro do Codex para correr, lado a lado, modelos líderes como os GPT e favoritos como DeepSeek.

Os engenheiros conseguem assim incorporar estes modelos de alto desempenho diretamente no seu stack diário de desenvolvimento. Da geração e raciocínio de código à depuração e refatoração, a B.AI unifica todo o workflow sob o mesmo teto – criando uma linha direta que vai da escolha do modelo ao código em produção.
Para além do coding, e para manter agentes a funcionar de forma fiável em produção e em escala, a B.AI construiu uma infraestrutura full-stack assente em cinco componentes centrais, dotando os agentes de um motor operacional fino e otimizado:
- Protocolo de Pagamento x402: Introduz um modelo inovador de “pay-before-response”, executando microliquidações on-chain, de alta frequência, em background durante chamadas de API entre agentes e processos de orquestração de computação.
- Protocolo de Identidade 8004: Emite credenciais on-chain verificáveis para cada agente, registando histórico de execução e um score de crédito, criando uma camada de confiança robusta para colaboração entre nós.
- Skills Matrix: Blocos de construção padronizados e plug-and-play que se ligam diretamente a servidores MCP, conferindo a agentes capacidades modulares de tool-calling de forma imediata.
- BAIclaw e BAIcode: Assistentes nativos da plataforma, concebidos para execução ponta a ponta. O BAIclaw gere operações de terminal all-in-one e fluxos multiagente, enquanto o BAIcode funciona como um motor avançado para developers, racionalizando todo o pipeline, da análise de requisitos e desenho de arquitetura ao coding e testing.
Do pico de tokens impulsionado pelo acesso gratuito a modelos, ao seu papel como camada global de liquidação da inteligência; da integração transparente com o Codex à infraestrutura full-stack assente em x402, 8004, Skills e assistentes nativos – a B.AI oferece muito mais do que um stack técnico testado em produção: apresenta um roteiro claro para o que vem a seguir. A B.AI não está apenas a disponibilizar computação acessível hoje; está a construir a plataforma de lançamento da economia de agentes. O futuro já começou – e isto é apenas o início.
Equipa B.AI
Singapura
