Home Fondamenti Storia dell'AI Reti Neurali Backpropagation Architetture Token Modelli AI Case Studies Tecniche RAG RAG Avanzato GraphRAG MCP Orchestrazione LangChain LangGraph Prompt Engineering Usare l'AI ChipsBot News

OpenAI lancia GPT‑6 Sol e Luna: prezzi API dimezzati e benchmark

MarkTechPost 25 settembre 2026

Introduzione

OpenAI ha annunciato il rilascio di GPT‑6 Sol e GPT‑6 Luna, due nuovi modelli della serie GPT‑6 che si collocano sotto GPT‑6 Astra, lanciato all’inizio del mese. Entrambi i modelli sono stati addestrati con metodologie analoghe a quelle di Astra, ma con l’obiettivo specifico di trasferire i miglioramenti di Astra a soluzioni più rapide ed economiche.

Famiglia GPT‑6: tre livelli, una ricetta

Con l’arrivo di Sol e Luna, la famiglia GPT‑6 si struttura in tre tier distinti:

    • Astra: modello di fascia alta per i compiti più complessi.
    • Sol: ottimizzato per attività di programmazione avanzata e lavori professionali a costo inferiore.
    • Luna: pensato per operazioni rapide, ad alto volume e di routine quotidiana.

OpenAI sottolinea che miglioramenti nel caching e nell’inferenza consentono di servire questi modelli a un prezzo notevolmente più basso.

Prezzi API: il taglio del 50 %

I nuovi modelli sono disponibili sin da subito nell’API di OpenAI con i nomi gpt-6-sol e gpt-6-luna. Non esistono pesi scaricabili: sono esclusivamente “API‑only”. Di seguito la tabella dei costi per milione di token, comparata con i prezzi promozionali di GPT‑5.6:

    • GPT‑6 Astra: ingresso $10, uscita $50.
    • GPT‑6 Sol: ingresso $2 (era $4), uscita $10 (era $20).
    • GPT‑6 Luna: ingresso $0,10 (era $0,20), uscita $0,50 (era $1,20).
      Nota: la riduzione del prezzo di uscita di Luna è del 58 %, non del 50 %.

Benchmark professionali

OpenAI ha pubblicato una serie di benchmark per dimostrare le capacità di Sol e Luna rispetto a concorrenti come Claude Opus 5 e Claude Fable 5.

AutomationBench 1.0.6

    • Sol a sforzo “xhigh” segna il 33,2 % a $0,27 per task, superando Claude Opus 5 a sforzo massimo (26,9 % a 11,1 × il costo).
    • Astra a basso sforzo raggiunge il 30,3 % a 3,9 × il costo di Sol.
    • Luna a sforzo “high” guadagna 5,4 punti rispetto al predecessore, con una riduzione del 58 % dei costi per task.

Agents’ Last Exam

    • Sol al massimo sforzo ottiene il 56,4 %, battendo Claude Opus 5 con un risparmio del 60 % sul costo per task.

Benchmark di programmazione

DeepSWE v1.1

    • Sol a sforzo massimo raggiunge il 68,8 %, appena 1,1 punti al di sotto di Claude Fable 5 a “xhigh”, ma a circa l’80 % del costo.
    • Luna a sforzo massimo ottiene il 66,6 %, comparabile a Opus 5 e Fable 5 a sforzo medio, con una riduzione dei costi del 93 % rispetto a Opus 5 e del 96 % rispetto a Fable 5.

FrontierCode 1.1 Main

    • Sol eguaglia Claude Fable 5.1 a “xhigh” con costi nettamente inferiori, confermando la capacità di produrre codice pronto per il merge.

Uso del computer e factualità

OSWorld 2.0 (offline)

    • Sol a “xhigh” ottiene il 60,5 % contro il 60,3 % di Opus 5 a sforzo medio, con un risparmio circa dell’80 % sul costo per task.
    • Luna a sforzo massimo supera GPT‑5.6 Sol a sforzo medio con un decimo del costo.

Factualità

    • I test interni di OpenAI, basati su conversazioni de‑identificate di ChatGPT, mostrano che Sol commette circa la metà degli errori del modello precedente.
    • Luna a sforzo più alto eguaglia GPT‑5.6 Sol ma a circa 1/100 del costo.

Stile di comunicazione

OpenAI ha trasferito lo stile comunicativo di Astra anche su Sol e Luna. Le risposte sono più chiare, leggermente più brevi e contengono meno gergo, soprattutto nelle conversazioni di programmazione.

Prompt caching per agenti a lunga durata

Gli agenti inviano le stesse istruzioni, strumenti e cronologia ad ogni turno. GPT‑6 introduce un sistema di prompt caching migliorato con tassi di hit più alti per impostazione predefinita. Le letture di input memorizzate ricevono sconti fino al 90 %.

    • Cache condivise riutilizzabili entro una finestra di 30 minuti ottengono sconti.
    • Un Prompt Caching Dashboard monitora i tassi di hit nel tempo.
    • Uno strumento di diagnostica spiega i fallimenti, ad esempio “reason”: “tools_changed”.
    • Breakpoints espliciti consentono di definire dove termina un prefisso cache.
    • Il “reasoning effort” può variare durante la conversazione tramite configuration_update senza interrompere la cache.
    • Il parametro allowed_tools limita gli strumenti invocabili mantenendo stabili le definizioni.
    • Il “prewarming” prepara il contesto noto prima della prima richiesta utente.

La guida completa al caching, disponibile su GitHub, afferma che queste modifiche hanno ridotto di oltre il 50 % la percentuale di token di prompt che richiedono elaborazione fresca, accelerando la risposta di Copilot.

Disponibilità

    • API: gpt-6-sol e gpt-6-luna.
    • ChatGPT Work e Codex: piani Plus, Pro, Business, Enterprise ed Edu.
    • Free e Go: Luna è disponibile nell’app desktop di ChatGPT.
  • Chat non è ancora incluso; il rollout su
Leggi l'articolo originale →
← Torna alle news