B.AIは、次世代型のAIインフラ・プラットフォームとして、有力モデルを無料開放したことで開発者の関心を一気に集めた。リリースから数日のうちに、プラットフォーム全体の1日あたりトークン処理量は1.33兆トークンを突破し、業界でも歴史的な水準に到達した。
この記録的な数字はキャンペーンの爆発的な立ち上がりを象徴するが、B.AIの長期戦略ロードマップにおいては、まだ第一段階に過ぎない。同社が見据えるのは、従来型の「計算リソース配布」モデルを超え、インテリジェンス(知能)のグローバルな決済レイヤーを築くことだ。ノード間の協調・オーケストレーション・価値分配を一手に担う中核インフラとして、複雑なビジネスワークフローを走るAIエージェントの裏側を支える構想である。
B.AIは「すべてのモデルの上、すべてのエージェントの下」に位置づけられるレイヤーとして、多様なトップモデル群をフルスタック構成で深く統合。自律エージェントの大規模普及と、その先の生産性ブームを土台から支える「替えの利かない」基盤を打ち立てつつある。
日次トークン処理量1.33兆超 無料開放で爆発的な利用拡大
B.AIが有力AIモデルの無料利用を開放した動きは、瞬く間に開発者の間で話題をさらい、業界の議論を席巻した。計算リソースへのアクセス障壁をゼロにしたことで、プラットフォーム上のアクティビティは急増し、従来の利用実績を一気に塗り替えた。
数日のうちにAPI需要が急膨張し、日次トークン処理量は1.33兆トークンという桁違いの水準に到達。15日間累計では8.19兆トークンに達し、新規APIユーザーは22万超を獲得した。9月3日時点で、B.AIのユーザー総数は230万人を突破している。
こうした急拡大の背景には、開発者のコスト負担を徹底的に取り除く「ゼロコスト・モデル群」の戦略展開がある。B.AIは現在、次の6つの先端モデルを無制限・無料で提供している:DeepSeek-V4-Flash、DeepSeek-V4-Flash-Vision-Exp、Tencent Hy3、Xiaomi MiMo-V2.5、GLM-5.3-Flash (Ox Alpha)、Qwen3.8-Flash。

注目すべきは、9月3日に導入されたDeepSeek-V4-FlashおよびDeepSeek-V4-Flash-Vision-Exp向けの新料金体系だ。B.AIは両モデルについて段階的なディスカウント制を採用し、ピーク時間帯でも50%引き、オフピークでは通常ピーク料金の25%まで単価を引き下げた。一方で、GLM-5.3-Flash (Ox Alpha)、Qwen3.8-Flash、Tencent Hy3、Xiaomi MiMo-V2.5は引き続き無料開放を維持している。
収益化へのシフトにもかかわらず、開発者の勢いは衰えず、プラットフォーム全体のトークン処理量はむしろ増加傾向を保っている。この持続的なトラフィックは、今回の取り組みが単なる短期的な「計算リソースのばらまき」にとどまらず、AIインフラの構造転換を先取りするものだと示している。
1日1.33兆トークンという閾値を超えたことで、AIアプリケーションが単純なチャットボットの時代を終えつつあることは明白だ。高性能な技術スタックと柔軟なサービス設計を武器に、B.AIは次のフロンティア――大規模に稼働する自律型AIエージェントの世界――に向けた地ならしを進めている。
「AIグリッド」を駆動 エージェント経済のグローバル決済レイヤーを標榜
B.AIにとって、計算能力の民主化はあくまで序章にすぎない。同社が視線を向けるのは、エージェント時代に向けたフルスタック・インフラの構築であり、「インテリジェンスのグローバル決済レイヤー」としての地位を固めることだ。
エージェント時代の典型的なタスクは、複数モデルを常時切り替えながら進行する。単一プロバイダーだけではワークフロー全体を賄うことが難しく、開発者はバラバラなAPI仕様、分断された課金システム、競合するレート制限に翻弄されがちだ。
B.AIの決済レイヤーは、この断絶を埋めることを狙う。「すべてのモデルの上、すべてのエージェントの下」に配されたアブストラクションレイヤーとして、異なるプロバイダー・機能・コスト構造を持つモデル群を、スケジューリング可能な一つのリソース・プールに統合する。
公式ルートの安定性と、最安コストのカスタムチャネルを併せ持つ二層構造のAPIにより、開発者は「品質保証された直結ルート」と「大幅割引のコスト重視ルート」をモデル横断で選択できる。さらにChatインターフェース上のスマートルーティングと組み合わせることで、B.AIはフルスタックの「AIグリッド」として機能し、エージェントからのリクエストを最適なモデルへ自動的に振り分ける。これにより、性能とコスト効率を両立した実行環境を提供する。

決済面では、この「パワーグリッド」がWeb2とWeb3の双方をシームレスにまたいでいる点も特徴だ。Web2領域では、開発者は従来型の決済手段を用いてスムーズにチャージできる。一方Web3領域では、オンチェーン決済レールを活用し、世界中の開発者に対して分散型かつ検証可能で、摩擦の小さい支払いオプションを提供する。
二つの決済システムを並行稼働させることで、B.AIはあらゆるインフラ環境上の開発者とエージェントアプリケーションに、それぞれ最適な決済パスを提供。単一の統合ポイントから、ボーダーレスに広がるグローバル・リーチを実現している。
生産性の中核を強化 エージェント協調を再設計するB.AI
B.AIは、コンピュートルーティングとグローバル決済の基盤を整えるだけにとどまらない。実世界でのプロダクティビティ向上を実現するため、より上位レイヤーに踏み込み、複雑なワークフローをまたぐエージェント同士の協調実行にフォーカスしている。これにより、エージェント経済に欠けていた「実行レイヤー」を補完しようとしている。
この実行レイヤーの中核にあるのが、Codexのネイティブ統合だ。Responses APIとの完全互換により、開発者はB.AIのAPIキー1つで、Codex内から看板GPTモデルとDeepSeek系モデルを横並びで呼び出せるようになった。

エンジニアは、これらの高性能モデルを日々の開発スタックに直接組み込める。コード生成や推論から、デバッグ、リファクタリングに至るまで、開発フロー全体をB.AI上に統合し、「モデル選定からコード出荷まで」を一本の導線でつなぐ。
さらに、実運用環境でエージェントを安定稼働させるため、B.AIは5つの中核コンポーネントから成るフルスタック・インフラを構築。エージェントに精緻にチューニングされた実行エンジンを提供している。
- x402 Payment Protocol:クロスエージェントのAPIコールや計算オーケストレーションの裏側で、「レスポンス前決済(pay-before-response)」モデルに基づく高頻度オンチェーン・マイクロ決済を自動実行する新たな支払いプロトコル。
- 8004 Identity Protocol:すべてのエージェントにオンチェーンで検証可能なクレデンシャルを発行し、実行履歴と信用スコアを記録。ノード間協調のための信頼レイヤーを構築する。
- Skills Matrix:MCPサーバーと直接連携するプラグ&プレイ型の標準化コンポーネント群。エージェントにモジュール式のツールコール機能を即時付与する。
- BAIclawおよびBAIcode:エンドツーエンドの実行に最適化された組み込みアシスタント。BAIclawはターミナル操作とマルチエージェント・ワークフローを一括管理し、BAIcodeはタスク分析・アーキテクチャ設計からコーディング、テストまで、開発パイプライン全体を効率化する高度な開発エンジンとして機能する。
ゼロコスト・モデル開放が引き金となったトークン消費の急増から、「インテリジェンスの決済レイヤー」としてのポジショニング、Codexとのシームレスな統合、x402・8004・Skills・ネイティブアシスタント群によるフルスタック・インフラまで——B.AIが提供するのは、単なる実績豊富な技術スタックを超え、これからのAIエージェント時代の明確な設計図だ。
B.AIが築こうとしているのは、今日利用可能な「安価な計算リソース」だけではない。エージェント経済を本格離陸させるための決定的なランチパッドである。未来のエージェント経済は既に動き出しており、今回の展開はその序章に過ぎない。
B.AI Team
Singapore
