GPT-6 Sol vs Luna
結果をどう検証するかと、合格タスク当たりの費用で選びます。
GPT-6 SolとLunaの比較では、複雑な開発か、範囲を絞った大量処理かが出発点です。同じ課金トークン数と処理方式ならSolは 20倍。能力や完了タスクの費用が20倍という意味ではありません。
2026年9月23日確認。 本記事はOpenAIの公式仕様と再計算できる費用例に基づく公開直後のレビューです。独自の比較ベンチマークは実施していません。用途の提案は検証の出発点であり、精度や速度の実測結果ではありません。
SolとLunaは何が違う?
OpenAI直結APIのStandard料金です。単位は100万トークン当たりUSDで、OmniaKeyの料金ではありません。
| 項目 | GPT-6 Sol | GPT-6 Luna |
|---|---|---|
| APIモデルID | gpt-6-sol | gpt-6-luna |
| 公式の位置付け | 複雑なコードとエージェント | 範囲を絞った大量タスク |
| 非キャッシュ入力 | $2.00 | $0.10 |
| キャッシュ読み取り | $0.20 | $0.01 |
| キャッシュ書き込み | $2.50 | $0.125 |
| 出力 | $10.00 | $0.50 |
| コンテキスト(トークン) | 1,050,000 | 1,050,000 |
| 最大入力(トークン) | 922,000 | 922,000 |
| 最大出力(トークン) | 128,000 | 128,000 |
| 知識のカットオフ | 2026-04-20 | 2026-05-18 |
両者は2026年9月22日公開で、テキスト・画像入力とテキスト出力に対応します。none、low、標準の medium、high、xhigh、max も共通です。同じ機能でも信頼性、速度、消費量が同じとは限りません。Lunaの知識が新しいことは推論の優位を示しません。
同じ処理量でAPI料金を比較
| 仮定した処理量 | GPT-6 Sol | GPT-6 Luna |
|---|---|---|
| 非キャッシュ入力100K + 課金出力10K | $0.30 | $0.015 |
| 非キャッシュ入力300K + 課金出力10K | $1.35 | $0.0675 |
| 入力10K + 出力1Kのタスクを1,000件 | $30.00 | $1.50 |
入力が 272Kトークンを超えるとリクエスト全体で入力・キャッシュ料金が2倍、出力料金が1.5倍になります。超過分だけの加算ではありません。現行の説明では272Kちょうどは低い料金区分です。
実測請求額ではなく計算例です。出力には推論と可視テキストを含みます。各1回、キャッシュ読み書きなしを仮定し、ツール、保存、税金、人による確認は除外しています。実際の精算はusageを確認してください。
コーディングや抽出はどちらを選ぶ?
Solを試す: モジュール間のデバッグ、互換性の維持、複数ツールの結果をまとめる判断。
Lunaを試す: 抽出、既知カテゴリへの分類、検証が簡単な局所変換。
1つのエージェントで併用できます。計画や難しい修正はSol、検証済み抽出はLunaとし、合格基準はそろえます。
Lunaから始めてSolへ回すと安くなる?
入力100K・出力10KならLunaは$0.015、Solで完全にやり直すと$0.30です。**仮に20%**をSolへ回す場合:
$0.015 + 0.20 × $0.30 = $0.075
この仮定ではSolだけより75%低い費用です。20%は実測値ではありません。検証、追加コンテキスト、ツール、人の作業で節約は減ります。検証器が誤りを見逃すなら品質比較が成立しません。
0.015 + p × 0.30 < 0.30 の条件は p < 0.95。95%はトークン費用だけの損益分岐で、許容失敗率ではありません。全費用を合格件数で割り、残る誤りも確認します。
API互換性とツール呼び出し
両モデルはResponsesとChat Completionsに対応します。推論とツールを併用する場合は Responses API を使います。Chat Completionsのfunction callingは reasoning_effort=none の場合のみ対応しており、両エンドポイントの動作は同一ではありません。
Responsesの reasoning.effort は none、low、medium、high、xhigh、max に対応します。比較時は設定を固定してください。構造化出力と画像入力に対応しますが、モデル自体の出力はテキストです。画像生成ツールは別の処理です。
料金と例はOpenAI直結を対象としています。OmniaKeyの経路・機能・料金はモデル一覧で確認してください。OpenAIでの公開だけでは、ゲートウェイ、Codex、ChatGPTプランでの利用可否は確認できません。
公平に性能を比較する方法
難しい例を含む20–50件の代表タスクを選び、入力、リポジトリ版、ツール、権限、推論設定、タイムアウトを固定します。同じ設定名でも計算量は同じとは限りません。
初回合格、再試行、失敗、入力・キャッシュ・推論・出力トークン、ツール費用、p50/p95遅延、手修正時間を記録します。合格例も検査し重要な例は繰り返します。安さから速さを、高さから20倍の品質を推測しないでください。
よくある質問
Solは本当に20倍高い?
同じトークン、処理方式、対応料金区分では、キャッシュと出力を含めて20倍です。実際のタスクでは消費量が変わります。
コーディングエージェントにはどちら?
関連する判断の多い作業ではSol、テストできる限定ステップではLunaを評価してください。本記事は独自の品質ベンチマーク結果ではありません。
GPT-6 Terraが中間モデル?
現行の公開一覧はAstra、Sol、Lunaで、gpt-6-terra はありません。GPT-5.6 TerraをGPT-6の公開モデルと混同しないでください。