Sol か Fable 5 か 創造性テストで勝ったAIモデルはどちらか

Sol か Fable 5 か 創造性テストで勝ったAIモデルはどちらか

OpenAIの新モデル GPT-5.6 SolAnthropic の Claude Fable 5 が、 ベンチマークで互いに勝ち星を分け合う展開となっている。こうしたなかで、 Fable 5の割引アクセス期間は7月19日に終了する予定だ。

重要ポイント

  • OpenAIはGPT-5.6をSol、Terra、Lunaの3ティア構成で展開し、従来の単一モデル戦略を転換した。
  • 独立テストでは、創造性とコーディングではClaude Fable 5がやや優勢だが、標準化ベンチマークの多くはSolが制した。
  • Anthropicは有料ユーザー向けのFable 5無料アクセスを3度延長しており、現行の締切は7月19日となっている。

Sol の料金体系

OpenAIは7月9日、GPT-5.6を一般提供へ移行。 これまでの「1モデル可変設定」ではなく、3モデルに分けてリリースした。 最上位がSol、中位がTerra、軽量用途向けがLunaという位置づけだ。

料金はSolが入力トークン100万件あたり5ドル、出力は30ドル。 これはFable 5の10ドル/50ドルの半額水準となる。さらに廉価なLunaは1ドル/6ドルに設定されており、 すでにコーディング系ベンチマークで Claude Opus 4.8 を上回っているとされ、 OpenAIも後にこの結果を確認している。

レビュー各誌によれば、Fable 5は足元でより不安定な局面を経験している。 米国の輸出規制により、当初予定していた無料アクセス期間の終了直前、6月12日に 世界的に停止に追い込まれたためだ。

規制は6月30日に解除され、Anthropicは7月1日にFable 5を再稼働。 その後、プロモーション価格の期限は3度延長され、直近の締切は7月19日に設定されている。

関連記事: デトロイト・ライオンズがESPN「人材調査」を席巻——予測市場はESPNと何が違うのか

テスト結果は「勝ち負け拮抗」

標準化ベンチマークでは、概ねSolが優位だ。 Artificial Analysis Coding Agent IndexではSolが80点、Fableは77.2点。 別のトラッカーであるAgents' Last Examでも、Solが53.6%、Fableは40.5%にとどまった。 一方、より広範な能力を測るIntelligence Indexでは、Fable 5がSolを1ポイントだけ上回った。

実務的なハンズオン検証では、差はさらに僅差との評価だ。 両モデルに同一プロンプトを投げたレビュー担当者は、創作文章や論理パズルの出力について、 強みの違いはあれど「ほぼ互角」との見方を示している。

明確な差が出たのは一部のコーディングタスクだ。 ブラウザゲームを1ショットで実装するテストでは、Fable 5がBGMやアニメーション、 パワーアップ要素まで含めて構築したのに対し、Sol版ではそこまで作り込めなかったという。

Fable 5の提供経緯も、6月9日の公開以来、異例の紆余曲折をたどっている。 当初は6月22日までの無料提供をうたっていたが、その前に輸出規制問題で停止。 7月1日に復帰したものの、週次の利用上限が厳格化されたうえ、有料化の「締切」は 7月12日、そして現在の7月19日へと二度にわたり後ろ倒しされている。

次に読みたい: Bitcoin価格予測——強気派は7万9,000ドル、弱気派は5万6,000ドル、7月相場はその狭間か

免責事項とリスク警告: この記事で提供される情報は教育および情報提供のみを目的としており、著者の意見に基づいています。金融、投資、法的、または税務上のアドバイスを構成するものではありません。 暗号資産は非常に変動性が高く、投資の全部または相当な部分を失うリスクを含む高いリスクにさらされています。暗号資産の取引または保有は、すべての投資家に適しているとは限りません。 この記事で表明された見解は著者のものであり、Yellow、その創設者、または役員の公式な方針や立場を表すものではありません。 投資決定を行う前に、常にご自身で十分な調査(D.Y.O.R.)を行い、ライセンスを持つ金融専門家にご相談ください。
関連する研究記事
Sol か Fable 5 か 創造性テストで勝ったAIモデルはどちらか | Yellow