OpenAIは、公式発表からわずか20日後、 GPT-5.6ファミリーのAIモデル2機種について大幅な値下げを発表しました。GPT -5.6 Lunaは80%、 GPT-5.6 Terraは20%値下げされ、主力モデルであるGPT-5.6 Solにはより高速なAPIオプションが導入されました。7月30日に発効したこれらの変更は、特に大量のAIを活用した自動化タスクを扱う企業にとって、コスト、速度、処理能力のバランスを改善することを目的としています。
同社は、価格引き下げはハードウェアルーティングの改善、推論ソフトウェアの強化、よりスマートなコンテキストキャッシュアルゴリズムなど、ソフトウェアスタック全体にわたる最適化によるものだと説明した。実際、これらの改善の一部はモデル自体によってもたらされた。教師ありテスト中に、GPT-5.6 Solは重要な本番環境ソフトウェアコアを自律的に書き換えて最適化し、サービスオーバーヘッドを20%削減し、トークン生成効率を15%以上向上させた。これにより、OpenAIは既存のサーバークラスタからより高いパフォーマンスを引き出すことができるようになった。
GPT-5.6 LunaとTerraの新しい価格
新しい価格設定により、GPT-5.6 Luna の価格は、トークン入力100万個あたり0,20ドル、出力100万トークンあたり1,20ドルとなり、それぞれ以前の1ドルと6ドルから値下げされました。このモデルは、ファミリーの中で最も高速かつコスト効率が高く、顧客インタラクションの分類、大規模な文書分析、バックグラウンド自動化などの大量処理タスク向けに設計されています。OpenAI は、約1年前には最先端と考えられていたモデルと同等のパフォーマンスを、はるかに低いコストで提供できると主張しています。
一方、日常業務向けに設計されたGPT-5.6 Terraは、投資トークン100万枚あたり2ドル、発行トークン100万枚あたり12ドルで販売されています。そのアプローチは、ビジネスアシスタント、プログラミング、ワークスペース関連のクエリにおいて、推論能力、速度、コストのバランスを取ることを目指しています。この戦略では、同じプロセス内で異なるモデルを組み合わせることが可能です。例えば、企業はSolを使用して不確実性を解消し、計画を策定した後、Lunaを実装、テスト、結果評価に割り当てることができます。
高速モード:GPT-5.6 Sol の速度をさらに向上
OpenAIは、APIにおける従来の優先処理に代わり、GPT-5.6 Sol向けに高速モードを導入しました。このモードでは、主力モデルであるGPT-5.6 Solの処理速度が標準処理の最大2,5倍になりますが、利用コストは2倍になります。同社は、処理速度の向上によってモデルの知能が損なわれることはないと保証しています。優先度が高いと判断された既存のリクエストは、自動的に高速モードに切り替わり、既存の実装との互換性が維持されます。
これらの価格変更は、ChatGPT Work および Codex のユーザーと組織のクレジットまたは時間制限にも影響し、Luna および Terra を使用すると、月額サブスクリプションレベルを変更せずに消費クレジットが少なくなります。OpenAI は、X アカウントを通じてこのニュースを発表し、「コスト効率、容量、および速度の点でモデルの限界を押し上げるというコミットメント」により、価格を引き下げたと述べています。この価格引き下げは、中国のスタートアップ企業 Moonshot AI の Kimi K3のようなモデルが最近登場するなど、この分野での競争が激化している時期に行われました。
新料金体系は7月30日から適用されており、パフォーマンスデータは主にOpenAI社内の評価と一部の顧客データに基づいているものの、同社は多様な大規模ワークロードにおいてコスト削減効果が持続すると確信している。この戦略により、OpenAIは問題の複雑さに基づいて推論をセグメント化するというトレンドを強化し、組織が業務に必要なコンピューティング能力と財務コストを正確に比較検討できるようにする。
