GPT-6 Sol vs Luna
Scegliere in base alla verificabilità e al costo di ogni risultato accettato.
GPT-6 Sol vs Luna dipende dal lavoro: codice complesso o attività circoscritte ad alto volume. A token fatturati e modalità uguali Sol costa 20x. Non è un rapporto di intelligenza né il costo garantito per attività completata.
Verificato il 23 settembre 2026. Questa recensione del lancio usa documentazione OpenAI e calcoli riproducibili. Non abbiamo eseguito un benchmark controllato. Le raccomandazioni indicano cosa valutare, non risultati misurati di precisione o velocità.
Differenze tra Sol e Luna
Prezzi diretti OpenAI in USD per milione di token con elaborazione Standard. Non sono preventivi OmniaKey.
| Caratteristica | GPT-6 Sol | GPT-6 Luna |
|---|---|---|
| ID API | gpt-6-sol | gpt-6-luna |
| Posizionamento ufficiale | Codice complesso e agenti | Attività specifiche ad alto volume |
| Input senza cache | $2.00 | $0.10 |
| Lettura cache | $0.20 | $0.01 |
| Scrittura cache | $2.50 | $0.125 |
| Output | $10.00 | $0.50 |
| Contesto (token) | 1,050,000 | 1,050,000 |
| Input massimo (token) | 922,000 | 922,000 |
| Output massimo (token) | 128,000 | 128,000 |
| Conoscenze aggiornate al | 2026-04-20 | 2026-05-18 |
Entrambi sono usciti il 22 settembre 2026, ricevono testo e immagini e producono testo. Condividono none, low, medium predefinito, high, xhigh e max. Stesse funzioni non provano pari affidabilità, velocità o consumo. Conoscenze più recenti di Luna non provano ragionamento migliore.
Prezzi per lo stesso carico
| Carico ipotetico | GPT-6 Sol | GPT-6 Luna |
|---|---|---|
| 100K input senza cache + 10K output fatturato | $0.30 | $0.015 |
| 300K input senza cache + 10K output fatturato | $1.35 | $0.0675 |
| 1.000 attività da 10K input + 1K output ciascuna | $30.00 | $1.50 |
Oltre 272K token di input, l’intera richiesta usa tariffe 2x per input/cache e 1,5x per output. Non aumenta soltanto il costo dei token eccedenti. Esattamente 272K resta nella fascia inferiore secondo il testo attuale.
Sono calcoli, non fatture osservate. L’output include ragionamento e testo visibile. Si assume un tentativo senza letture/scritture cache; esclusi strumenti, storage, imposte e revisione umana. Verificare i dati usage effettivi.
Quale modello per ciascun lavoro?
Provare Sol per debugging tra moduli, compatibilità e interpretazione di più risultati degli strumenti.
Provare Luna per estrazione, categorie note e trasformazioni locali facili da verificare.
Un agente può usare entrambi: Sol per pianificazione o riparazioni difficili, Luna per estrazione validata. Tenere costante lo standard di accettazione.
Luna prima e Sol quando necessario
Con 100K input e 10K output, Luna costa $0.015 e una ripetizione completa su Sol $0.30. Con un 20% ipotetico di escalation:
$0.015 + 0.20 × $0.30 = $0.075
Il 75% in meno rispetto a Sol diretto, sotto queste ipotesi. Il 20% non è misurato. Validazione, contesto extra, strumenti e persone possono annullare il vantaggio. Errori ignorati dal validatore invalidano il confronto qualitativo.
0.015 + p × 0.30 < 0.30 richiede p < 0.95. Il 95% riguarda soltanto il pareggio dei token, non un tasso di errore accettabile. Dividere tutti i costi per attività accettate e analizzare gli errori residui.
Compatibilità API e strumenti
Entrambi supportano Responses e Chat Completions. Per ragionamento con strumenti usare Responses API. Chat Completions consente function calling solo con reasoning_effort=none: gli endpoint non sono equivalenti.
Responses accetta none, low, medium, high, xhigh e max per reasoning.effort. Mantenere fisso il livello nel confronto. Sono supportati output strutturati e immagini in ingresso; l’output nativo è testo. La generazione di immagini tramite strumento è un’operazione separata.
Esempi e prezzi si riferiscono a OpenAI diretto. Verificare percorso, funzioni e tariffa nel catalogo OmniaKey. Il lancio non conferma accesso tramite gateway, Codex o abbonamento ChatGPT.
Come confrontare i modelli correttamente
Scegliere 20–50 attività rappresentative, inclusi casi difficili. Fissare input, revisione del repository, strumenti, permessi, sforzo e timeout. Livelli con lo stesso nome non garantiscono lo stesso calcolo.
Registrare successo iniziale, tentativi, errori, token input/cache/ragionamento/output, strumenti, latenza p50/p95 e riparazione umana. Controllare i risultati accettati e ripetere i casi importanti. Prezzo basso non dimostra velocità; prezzo alto non dimostra qualità 20 volte superiore.
Domande frequenti
Sol costa davvero 20 volte di più?
Sì a token uguali, stessa modalità e fasce corrispondenti, compresi cache e output. Le attività reali possono consumare quantità diverse.
Quale usare per un agente di codice?
Valutare Sol per sviluppo connesso e Luna per passaggi delimitati testabili. Non presentiamo un benchmark qualitativo misurato internamente.
GPT-6 Terra è la via di mezzo?
Il catalogo attuale contiene Astra, Sol e Luna, non gpt-6-terra. GPT-5.6 Terra non è un modello GPT-6 confermato.