B.AI, plataforma de infraestrutura de IA de nova geração, desencadeou recentemente uma corrida entre desenvolvedores ao oferecer acesso gratuito a modelos de ponta. Em poucos dias, o volume diário de tokens processados pela plataforma ultrapassou 1,33 trilhão — um marco histórico.
O número recorde reforça a força do lançamento da campanha, mas é apenas o primeiro passo de um plano estratégico mais amplo. Indo além dos modelos tradicionais de distribuição de computação, a B.AI quer construir a camada global de liquidação da inteligência: um hub central de infraestrutura projetado para sustentar colaboração entre nós, orquestração e distribuição de valor entre agentes de IA em fluxos de trabalho corporativos complexos.
Posicionada estrategicamente “acima de todos os modelos, abaixo de todos os agentes”, a B.AI integra de forma profunda um conjunto diverso de modelos de ponta a componentes full stack, criando uma base sólida e difícil de substituir para a adoção em massa de agentes autônomos — e para a onda de produtividade que vem na sequência.
Volume diário passa de 1,33 trilhão de tokens: acesso gratuito da B.AI dispara uso da plataforma
A decisão recente da B.AI de liberar acesso gratuito a modelos premium de IA capturou a atenção dos desenvolvedores e rapidamente dominou o debate no setor. A ofensiva por computação acessível não apenas impulsionou fortemente a atividade na plataforma, como também quebrou sucessivos recordes de uso.
Em questão de dias, a explosão da demanda por API levou o volume diário de tokens a superar impressionantes 1,33 trilhão. Em uma janela de 15 dias, o volume acumulado chegou a 8,19 trilhões de tokens, atraindo mais de 220 mil novos usuários de API. Em 3 de setembro, a base total de usuários da B.AI já havia ultrapassado oficialmente 2,3 milhões.
Essa adoção em massa está diretamente ligada ao portfólio de modelos a custo zero da plataforma — um lançamento calculado para eliminar de vez a preocupação com orçamento entre desenvolvedores. Com as barreiras de preço removidas, a B.AI oferece hoje acesso gratuito e ilimitado a seis modelos de fronteira: DeepSeek-V4-Flash, DeepSeek-V4-Flash-Vision-Exp, Tencent Hy3, Xiaomi MiMo-V2.5, GLM-5.3-Flash (Ox Alpha) e Qwen3.8-Flash.

Em 3 de setembro, a B.AI introduziu uma nova estrutura de preços para os modelos DeepSeek-V4-Flash e DeepSeek-V4-Flash-Vision-Exp, com descontos em camadas. Desenvolvedores passaram a contar com desconto de 50% no horário de pico, enquanto as tarifas fora de pico caem para apenas 25% do valor padrão de pico. Ao mesmo tempo, a plataforma manteve o acesso a custo zero para GLM-5.3-Flash (Ox Alpha), Qwen3.8-Flash, Tencent Hy3 e Xiaomi MiMo-V2.5. Apesar da guinada gradual rumo à comercialização, o ritmo da base de desenvolvedores não desacelerou, e o volume de tokens processados pela plataforma segue em trajetória ascendente.
A força dessa tendência mostra que a campanha foi muito mais do que uma ação pontual de “compute” grátis — é um termômetro da evolução estrutural da infraestrutura de IA. Quebrar a barreira de 1,33 trilhão de tokens diários deixa algo claro: as aplicações de IA estão indo muito além de simples chatbots. Com um stack técnico de alta performance e modelos flexíveis de serviço, a B.AI está preparando o terreno para a próxima fronteira — agentes autônomos operando em escala.
Alimentando a “rede de IA”: B.AI ancora a camada global de liquidação da economia de agentes
Para a B.AI, democratizar acesso à computação é apenas o prelúdio. Olhando adiante, a plataforma está focada em construir uma infraestrutura full stack para a era dos agentes, consolidando-se como a camada global de liquidação da inteligência.
Na era dos agentes, uma tarefa típica exige alternância constante entre modelos. Nenhum provedor isolado consegue sustentar todo o fluxo de trabalho; o resultado é um cenário em que desenvolvedores precisam lidar com protocolos de API fragmentados, sistemas de cobrança desconectados e limites de uso divergentes.
A camada de liquidação da B.AI fecha exatamente essa lacuna. Posicionada “acima de todos os modelos, abaixo de todos os agentes”, a B.AI abstrai modelos de diferentes provedores, níveis de capacidade e estruturas de custo em um único pool de recursos agendáveis.
Com uma arquitetura de API em dois níveis — que combina a confiabilidade de rotas oficiais com canais customizados de menor custo —, os desenvolvedores podem escolher entre conexões diretas garantidas e opções com descontos agressivos em uma ampla gama de modelos. Somado ao roteamento inteligente na interface de Chat, a B.AI opera como uma verdadeira “rede de IA” full stack, garantindo que cada requisição de agente seja direcionada ao modelo ideal, equilibrando desempenho e eficiência de custo.

Do ponto de vista de liquidação, essa “rede elétrica” de IA conecta, de forma transparente, modelos Web2 e Web3. No universo Web2, desenvolvedores contam com meios de pagamento tradicionais e familiares para fazer recargas com mínimo atrito. No ecossistema Web3, a B.AI usa trilhos de pagamento on-chain para oferecer a desenvolvedores globais opções descentralizadas, auditáveis e de baixa fricção.
Com sistemas de pagamento duplos operando em paralelo, a B.AI permite que developers e aplicações de agentes, independentemente da infraestrutura em que estejam, encontrem sua rota ideal de liquidação dentro da rede, por meio de uma única integração com alcance global.
Impulsionando produtividade: B.AI redefine colaboração entre agentes
Além de construir a base para roteamento de computação e liquidação global, a B.AI avança além da infraestrutura bruta para entregar produtividade no mundo real. Ao viabilizar colaboração fluida entre agentes em fluxos de trabalho complexos, a plataforma fornece a camada de execução que faltava para a economia de agentes.
No centro dessa camada de execução está a integração nativa com o Codex. A compatibilidade total com a Responses API permite que desenvolvedores usem uma única chave B.AI dentro do Codex para rodar, lado a lado, modelos GPT de referência e os principais modelos da DeepSeek.

Engenheiros podem trazer esses modelos poderosos diretamente para o stack de desenvolvimento do dia a dia. De geração de código e raciocínio a depuração e refatoração, a B.AI unifica todo o fluxo de trabalho sob o mesmo teto — criando uma linha direta que vai da escolha do modelo ao código em produção.
Para manter agentes rodando de forma consistente em ambiente produtivo, em larga escala, a B.AI construiu uma infraestrutura full stack apoiada em cinco componentes centrais, que fornecem aos agentes um motor operacional sob medida:
- Protocolo de Pagamentos x402: introduz um modelo inovador de “pagar antes da resposta”, que executa microliquidações on-chain de alta frequência em segundo plano, durante chamadas de API entre agentes e orquestração de computação.
- Protocolo de Identidade 8004: emite credenciais verificáveis on-chain para cada agente, registrando histórico de execução e scores de crédito, criando uma camada confiável de reputação para colaboração entre nós.
- Skills Matrix: blocos padronizados plug-and-play que se conectam diretamente a servidores MCP, dando aos agentes capacidades de uso de ferramentas de forma instantânea e modular.
- BAIclaw e BAIcode: assistentes nativos da plataforma, desenhados para execução ponta a ponta. O BAIclaw gerencia operações completas em terminal e fluxos multiagente, enquanto o BAIcode atua como motor avançado para developers, organizando todo o pipeline — da análise da tarefa e desenho de arquitetura até código e testes.
Do salto de uso gerado pelo acesso a modelos a custo zero ao posicionamento como camada global de liquidação da inteligência; da integração transparente com o Codex à infraestrutura full stack apoiada em x402, 8004, Skills e assistentes nativos — a B.AI entrega muito mais do que um stack técnico robusto: apresenta um roteiro claro do que vem pela frente. A empresa não está apenas construindo computação acessível hoje, mas a plataforma de lançamento de referência para uma economia vibrante de agentes. O futuro já começou — e este é só o primeiro capítulo.
Equipe B.AI
Singapura
