OpenAIのGPT-5.6ファミリーが木曜日に一般公開され、SpaceXAIのGrok 4.5とAnthropicの復帰したClaude Fable 5をもたらした9日間の期間を終えました。価格は100万トークンあたり1ドルから50ドルの範囲です。
OpenAIは6月26日にGPT-5.6シリーズを発表し、今週の一般展開の前に米国政府と調整した限定プレビューで提供しました。フラッグシップモデルのSolは、入力トークン100万個あたり5ドル、出力トークン100万個あたり30ドルで、Terraはそれぞれ2.50ドルと15ドルです。最速ティアのLunaは1ドルと6ドルです。
SpaceXAIはこのデビューを1日早く行いました。同社は水曜日に開発者向け、木曜日に一般向けにGrok 4.5を提供し、価格は入力トークン100万個あたり2ドル、出力トークン100万個あたり6ドルです。Elon Muskはこれを「Opusクラスのモデルだが、より高速で、トークン効率が良く、低コスト」と表現しました。
Anthropicは、ワシントンが6月12日に課した輸出規制を解除した後、7月1日に世界中でClaude Fable 5を復旧させ、三つ巴の競争体制を完成させました。
このモデルのコストは、入力トークン100万個あたり10ドル、出力トークン100万個あたり50ドルで、3社の中で最も高いレートです。
関連記事: Bitwiseの新規申請後、SolanaのETFモーメントは無視できなくなる
ベンダーのデータによると、Fable 5は最も困難なコーディングテストで先行しており、SWE-Bench Proで80.4%のスコアを記録しました。これに対し、Grok 4.5は64.7%、GPT-5.6が置き換えるモデルであるGPT-5.5は58.6%でした。Terminal-Bench 2.1では差が縮まり、以前の3つのフラッグシップモデルは互いに約1ポイント以内に収まりました。GPT-5.6はこの状況を変え、OpenAIは新しいウルトラモードを通じて並列サブエージェント間で作業を分割し、同じターミナルテストでSolが91.9%を記録したと報告しました。
一般提供時には、より包括的なベンチマークスイートが提供される予定です。
独立したテストではコストを中心に競争が展開されており、Artificial Analysisはそのインテリジェンス指数でGrok 4.5を168モデル中4位にランク付けし、Fable 5、GPT-5.5、Claude Opus 4.8に次ぐ位置としています。ただし、完了したエージェント型コーディングタスクのコストは、Grokでは2.49ドルであるのに対し、Claude Code内で実行されるFable 5では11.80ドルであり、購買決定を見直すのに十分な格差があります。同じテスターは、モデルが誤っている場合でも自信を持つようになるにつれて、ある知識指標での幻覚発生率が25%から54%に急増したことを指摘しました。
Grok 4.5のトレーニングを支援したCursorの最高経営責任者Michael Truellは、このモデルが「私たちのチームの多くのメンバーにとって日常の主力ツールになった」と投稿しました。Muskは内部的にこれをOpus 4.7とほぼ同等だが、より高速であると位置付けていますが、レビュアーは両方の推奨がリリースに直接的利害関係を持つ当事者から来ていることに注目しました。
アナリストたちは、単一の勝者ではなく、ルーティング市場が登場しつつあると increasingly 説明しており、LunaやGrok 4.5などの安価なティアが大量の作業を吸収し、Fable 5が他のモデルでは解決できない問題を引き受けています。Solのサブエージェントモードは、その中間にある長時間のターミナルセッションを対象としています。
一方、ワシントンは現在リリースカレンダーを形成しており、GPT-5.6とFable 5の両方がユーザーに届く前に政府の審査を通過しました。
Fable 5自身の6月の経緯は、規制当局が介入した場合のリスクを示しています。Anthropicは6月9日にこのモデルを起動しましたが、Amazonの研究者がソフトウェアの脆弱性を露呈させるジェイルブレイクを報告し、3日後に輸出規制が促されました。その後、このモデルは19日間オフラインとなり、報告された手法を99%以上のケースでブロックする分類器の背後で復帰しました。
次に読む: Grok 4.5、より安価なエージェント型AIでOpenAIとAnthropicに挑戦

