OpenAIがGPT-5.6 LunaのAPI価格を80%引き下げ、より高速なSolティアを追加

Lunaは100万トークンあたり入力が$0.20、出力が$1.20に下落; SolのFastモードは標準レートの2倍の料金で最大2.5倍の速度を約束する。

By · Published

Primary source: OpenAI on X

Why it matters

Luna's 80% price cut can materially lower the cost of coding agents, review systems and high-volume automation. OpenAI is using inference pricing and latency tiers to drive API adoption without cutting Sol's standard rate.

OpenAI cuts GPT-5.6 Luna API prices 80% and adds faster Sol tier

OpenAI (@OpenAI) は7月30日にGPT-5.6 LunaのAPI価格を80%引き下げ、GPT-5.6 Terraを20%引き下げる一方、フラッグシップのGPT-5.6 Solモデルにより高速な処理オプションを導入しました。値下げによりLunaは入力トークン100万あたり$0.20、出力トークン100万あたり$1.20に、Terraは入力が$2、出力が$12になりました。 (developers.openai.com)

共同創業者でCEOのSam Altmanにとって、この価格改定は彼が4月に再表明した配布に関する仮説を前進させるものです:OpenAIは、より多くの人々の手により高い能力を持つ汎用AIを届けたいと考えています。即時の商業的効果はより狭く、測定しやすいものです。開発者はGPT-5.6ファミリーが7月9日に一般提供されたときにOpenAIが課していた価格の5分の1で、Luna上で高ボリュームのワークロードを実行できます。 (openai.com)

OpenAIはGPT-5.6を三つのティアで立ち上げました:最上位の作業向けがSol、性能とコストのバランスを取るのがTerra、コストに敏感な高ボリューム用途向けがLunaです。ローンチ時、OpenAIはLunaを入力トークン100万あたり$1、出力トークン100万あたり$6に設定しました。Terraはそれぞれ$2.50と$15からのスタートでした。Solの標準価格は入力$5、出力$30のままです。 (openai.com)

変更点

更新されたLunaのドキュメントは、新しい入力$0.20と出力$1.20の価格に加えて、キャッシュ済み入力を$0.02と記載しています。Terraのドキュメントはキャッシュ済み入力を$0.20、標準入力を$2、出力を$12と記載しています。両モデルとも105万トークンのコンテキストウィンドウと最大出力128,000トークンを維持しています。入力トークンが272,000を超えるリクエストは引き続き長コンテキスト料金の対象となります。 (developers.openai.com)

OpenAIはまた、GPT-5.6 Sol向けにFast modeを導入し、Standard処理と同じモデルの知性を保ちながら最大2.5倍の速度を約束しています。Fast modeは標準のトークン当たり料金の2倍で、短いコンテキストのSolリクエストは入力トークン100万あたり$10、キャッシュ済み入力トークン100万あたり$1、出力トークン100万あたり$60になります。開発者は service_tier: "fast" または以前の設定である service_tier: "priority" のいずれかでこれを有効化できます。OpenAIは7月30日にPriority processingの名称をFast modeに変更しました。 (developers.openai.com)

この価格設定は、応答時間がコンバージョン、完了率、あるいは人間による審査に影響を与えるアプリケーションにとって直接的なトレードオフを生みます。開発者はSolの標準処理をバックグラウンド作業に維持し、レイテンシーがトークンより高いコストを生むユーザー向けリクエストにはプレミアムを支払う、という使い分けができます。OpenAIのドキュメントは、大規模なバッチやデータ処理ジョブをFast modeで送ることは推奨していません。 (developers.openai.com)

OpenAIはLunaをエージェントワークフローにさらに深く組み込む

同社はまた、ChatGPTアプリとCodex CLIのAuto-reviewをGPT-5.4からGPT-5.6 Lunaに移行しています。OpenAIは、モデルの変更と価格引き下げによりAuto-reviewのコストが概ね約10分の1になるはずだと述べています。この見積もりは同社提供のもので、実際の節約額はレビューが消費するトークン数やワークロードが長コンテキスト料金を引き起こすかどうかに依存します。

Auto-reviewの変更は、OpenAIがどこで最大の価格効果を見込んでいるかを示しています。エージェント製品は、計画、ツール使用、検証、レビューのために繰り返しモデル呼び出しを生成する可能性があるため、ワークフローのコストは単一プロンプトの価格よりずっと速く増加し得ます。80%の削減は、開発者に副次的なチェックを実行したり、セッションを長く維持したり、低価値のタスクをGPT-5.6ファミリーから移行させずに提供したりする余地を与えます。

OpenAIは6月26日に限定的なGPT-5.6プレビューをリリースし、7月9日にファミリーを一般提供しました。Lunaの価格をわずか3週間後に引き下げたことは、推論の経済性が製品リリースサイクルそのものの一部になったことを示しています。OpenAIは、Solにはプレミアム価格を維持しつつ、より低コストのモデルを使ってAPIの普及を拡大し、顧客がより高い速度を必要とする場合には別途料金を請求する形をとっています。 (openai.com)

Reader comments

Conversation for this story loads after sign-in.