Back to all posts

GPT-5.6 ora è integrato in Zero

GPT-5.6 è ora integrato in Zero come famiglia di tre modelli: Sol per il lavoro multi-agente più impegnativo, Terra per un'esecuzione quotidiana bilanciata e Luna per flussi di lavoro rapidi e ad alto volume.

Per i team che smistano carichi di lavoro di agenti diversificati, questo può essere più utile di un singolo nuovo modello di punta. Invece di pagare per il massimo ragionamento a ogni passaggio, puoi abbinare il modello al compito mantenendo intorno lo stesso ambiente Zero: strumenti connessi, file, accesso al browser, esecuzione isolata, competenze e follow-through.

Scegli il percorso Built-in e VM0 gestisce l'accesso al modello e fattura l'utilizzo in crediti. Se il tuo team utilizza già una chiave API OpenAI o un abbonamento ChatGPT/Codex, Zero supporta anche questi percorsi.

Una famiglia, tre punti operativi

OpenAI ha progettato GPT-5.6 attorno a livelli di capacità duraturi. Il numero identifica la generazione; Sol, Terra e Luna descrivono il compromesso tra intelligenza, velocità e costo.

Confronto tra GPT-5.6 Sol, Terra e Luna per utilizzo migliore, ragionamento, punti di forza, contesto, livello VM0 e prezzo di listino OpenAI

GPT-5.6 Sol: il lavoro più impegnativo

Sol è il modello di punta. Rivolgiti a esso quando un compito è abbastanza difficile da far sì che un piano migliore, più controlli o il lavoro in parallelo possano cambiare in modo sostanziale il risultato.

L'integrazione di GPT-5.6 Sol in Zero utilizza il ragionamento Ultra per impostazione predefinita. OpenAI descrive Ultra come il coordinamento di quattro agenti in parallelo, seguito dalla sintesi del loro lavoro. Questo rende Sol particolarmente adatto agli incarichi con diversi flussi di lavoro indipendenti, come:

  • Migrare una grande base di codice testando al contempo la compatibilità e documentando il risultato.
  • Studiare un mercato attraverso molte fonti, mettere in discussione i risultati e produrre un documento pronto per la decisione.
  • Trasformare un brief di prodotto in un'interfaccia rifinita, ispezionare il risultato renderizzato e correggere i problemi visivi o funzionali.
  • Indagare un incidente in produzione tra log, codice, ticket e stato del browser prima di proporre una correzione.

Sol appartiene al livello VM0 Built-in $$$. Usalo dove un passo falso è costoso, non per ogni breve risposta.

GPT-5.6 Terra: il cavallo da lavoro bilanciato

Terra è il punto di partenza sensato per il lavoro professionale ripetibile. OpenAI lo posiziona come il livello bilanciato e riporta prestazioni competitive con GPT-5.5 a metà del prezzo di listino per token dell'API.

Usa Terra per lavori che richiedono ancora ragionamento e uso di strumenti ma non necessitano della massima potenza di calcolo di Sol:

  • Ricerca quotidiana, monitoraggio della concorrenza e sintesi multi-fonte.
  • Modifiche di codice ordinarie, analisi delle pull request e indagine sui problemi.
  • Redazione di report, piani di lancio, documenti per i clienti e documenti operativi.
  • Flussi di lavoro di agenti che necessitano di una solida gestione del contesto lungo a un costo più moderato.

Terra appartiene al livello VM0 Built-in $$. Non è imposto come impostazione predefinita universale; è semplicemente il livello che testeremmo per primo per molti flussi di lavoro generici.

GPT-5.6 Luna: velocità e volume

Luna è il membro più veloce e più conveniente della famiglia. È pensato per lavori in cui il throughput e il tempo di risposta contano più della profondità massima.

Tra i buoni carichi di lavoro per Luna:

  • Classificare o smistare grandi lotti di ticket, lead o messaggi.
  • Estrarre campi strutturati da documenti coerenti.
  • Eseguire un primo triage prima di promuovere i casi ambigui a Terra o Sol.
  • Produrre brevi sintesi o trasformazioni ad alto volume.

Luna appartiene al livello VM0 Built-in $. Non è la scelta giusta per ogni compito economico: la valutazione a contesto lungo condotta da OpenAI stessa mostra un ampio divario tra Luna e i due livelli superiori nel recupero delle informazioni su input molto grandi. Instrada i contesti profondi e ambigui verso Terra o Sol.

Cosa dicono — e cosa non dicono — i benchmark

OpenAI riporta risultati solidi per tutta la famiglia, ma la lezione utile è la forma del compromesso più che una singola posizione in classifica.

Confronto dei benchmark riportati da OpenAI per GPT-5.6 Sol Ultra, Sol, Terra, Luna e GPT-5.5 su Terminal-Bench, BrowseComp e recupero a contesto lungo OpenAI MRCR v2 a 8 aghi

Su Terminal-Bench 2.1, che valuta i flussi di lavoro di agenti da riga di comando, OpenAI riporta il 91,9% per Sol Ultra, l'88,8% per Sol, l'87,4% per Terra e l'84,7% per Luna. Su BrowseComp, i punteggi riportati sono del 92,2% per Sol Ultra, del 90,4% per Sol, dell'87,5% per Terra e dell'83,3% per Luna.

Il risultato a contesto lungo è il segnale di routing più importante. Su OpenAI MRCR v2, 8 aghi, 256K–512K, Sol ottiene il 91,5% e Terra l'89,6%, mentre Luna ottiene il 41,3%. Luna può comunque essere eccellente per lavori brevi e ripetuti; semplicemente non dovrebbe essere trattato come un Sol in miniatura per ogni carico di lavoro.

Queste sono valutazioni riportate dal fornitore, non una classifica universale. I benchmark misurano harness, strumenti, impostazioni di ragionamento e budget particolari. Il tuo flusso di lavoro può invertire l'ordine, quindi riesegui un compito rappresentativo prima di modificare un agente in produzione.

GPT-5.6 rispetto a GPT-5.5 e Claude Fable 5

Il confronto pratico non è "quale modello vince?". È "quale comportamento vale la pena pagare in questa fase dell'esecuzione?".

ModelloUtilizzo migliore in ZeroCosa si distingueLivello VM0 Built-in
GPT-5.6 SolLavori difficili e multi-fase in cui pianificazione, esecuzione parallela, giudizio progettuale o validazione possono cambiare il risultatoZero usa Ultra per impostazione predefinita; il livello GPT-5.6 più potente per coding, uso del computer, design, ricerca e contesto profondo$$$
GPT-5.6 TerraFlussi di lavoro professionali quotidiani che richiedono comunque ragionamento e strumenti affidabiliQualità, velocità e costo bilanciati; ottima adattabilità della famiglia al lavoro a contesto lungo$$
GPT-5.6 LunaLavori rapidi e ad alto volume con input coerenti e facile escalationLatenza e costo più bassi della famiglia; ideale per triage, estrazione e passaggi in blocco$
GPT-5.5Flussi di lavoro OpenAI esistenti già validati e che non necessitano ancora di un nuovo baselineComportamento di frontiera familiare e punto di confronto stabile per gli agenti attualiLa disponibilità dipende dalla configurazione dello spazio di lavoro
Claude Fable 5I flussi di lavoro Anthropic e Claude Code più avanzati, soprattutto dove un team è già calibrato sul suo comportamentoRagionamento premium a lungo orizzonte e un profilo distinto di fornitore/strumenti$$$$

OpenAI riporta che Sol supera Fable 5 su Agents' Last Exam e sull'Artificial Analysis Coding Agent Index, mentre Fable 5 rimane leggermente in vantaggio su GDPval-AA v2. È proprio per questo che "il modello migliore" è un'affermazione troppo ampia. Sol è convincente quando desideri il miglior comportamento agentico di OpenAI in fatto di coding, uso del computer, design e multi-agente. Fable rimane una scelta valida per il lavoro Anthropic di fascia alta e per i flussi di lavoro già calibrati attorno a Claude Code.

Terra è il candidato di aggiornamento più diretto per molti carichi di lavoro GPT-5.5: OpenAI afferma che è competitivo con GPT-5.5 a metà del prezzo di listino per token dell'API. Luna ha un obiettivo di ottimizzazione diverso — velocità e scala — quindi confrontalo sul lavoro completato per dollaro o per minuto, non solo sui punteggi di benchmark di picco.

Cosa significa Built-in in Zero

Built-in rende GPT-5.6 una scelta di routing anziché un progetto di credenziali. Seleziona il provider VM0 Managed e Zero gestisce l'accesso addebitando il corrispondente livello di crediti VM0. Non è necessario creare o mantenere una chiave API OpenAI separata per quel percorso.

I team che preferiscono un proprio rapporto con il fornitore possono comunque usare una chiave API OpenAI o collegare un abbonamento ChatGPT/Codex. Il nome del modello resta lo stesso; cambiano il percorso di fatturazione e la configurazione del provider. I livelli di crediti VM0 ($, $$, $$$) non coincidono con i prezzi pubblici per token dell'API OpenAI.

Come attivare GPT-5.6 in Zero

GPT-5.6 si seleziona nelle impostazioni del modello, non scrivendo "usa GPT-5.6" all'interno di un prompt.

  1. Apri Settings e scegli Models dalla barra laterale.
  2. Nella sezione Personal, aggiungi GPT 5.6 Sol, GPT 5.6 Terra o GPT 5.6 Luna.
  3. Scegli Built-in per usare il routing VM0 Managed, oppure seleziona il tuo provider OpenAI API o ChatGPT/Codex connesso.
  4. Avvia una chat o un'esecuzione, apri il selettore del modello e passa al livello desiderato.
  5. Una volta che un flusso di lavoro è stabile, imposta il modello appropriato a livello di agente o di competenza in modo che il lavoro di routine utilizzi costantemente il percorso previsto.

Un manuale di routing pratico

Inizia ponendoti tre domande:

  1. Quanto costa una risposta sbagliata? Usa Sol quando gli errori generano rilavorazioni, rischi o impatti a valle significativi.
  2. Quanto è profondo e ambiguo il contesto? Usa Terra o Sol per input ampi e disordinati che richiedono verifiche incrociate e sintesi.
  3. Con quale frequenza verrà eseguito? Usa Luna per lavori ad alto volume e prevedibili, quindi fai salire di livello le eccezioni.

Vale la pena testare uno schema di routing misto: Luna filtra e struttura l'input, Terra completa il grosso del lavoro e Sol gestisce le poche decisioni che giustificano il massimo ragionamento. Non serve un unico modello per fare tutto; serve che ogni fase utilizzi abbastanza modello.

GPT-5.6 rende questa scelta insolitamente chiara. Sol, Terra e Luna offrono a Zero tre punti operativi all'interno dello stesso ambiente di agente — così puoi aumentare la capacità quando il lavoro lo richiede e ridurre il costo quando non serve.

Fonti

Stay in the loop

// Get the latest insights on AI teammates and collaboration.

SubscribeJoin Discord