Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

GPT-5.6 Terra

Rilasciato 2026-07-09

chatVisioneCodiceChiamata di strumentiRagionamentoCaching dei prompt

GPT-5.6 Terra è il livello intermedio bilanciato della famiglia GPT-5.6 di OpenAI, descritto sulla sua pagina del modello come il modello GPT-5.6 che bilancia intelligenza e costo; OpenAI lo posiziona per compiti aziendali ad alto volume come assistenza clienti, strumenti interni e analisi dei documenti, collocandolo sotto il flagship come prezzo.

Input
testo immagine $2.5/M
Output
testo $15/M
Lettura cache
$0.25/M
Contesto
1.1M
vs GPT-4o
~50% più economico
Cutoff di conoscenza
2026-02

Benchmark

Sopra la mediaNessuno migliore42 / 557 / 55
GPT-5.6 Terra altri modelli misurati media dei modelli confrontati nessun altro modello ha fatto meglio
SWE-Bench Pro
63.4%
BioMysteryBench hard
nessun altro modello ha fatto meglio 49.4%
OSWorld 2.0
50.2%
ExploitBench (Cap%)
52.9%
HealthBench
57%
GDPval-AA v2 Elo · 642-1861
1593
Harvey Lab-AA
85.2%
GPQA Diamond
92.9%
BrowseComp
87.5%
LVBench
78.9%

Dati pubblicati dai fornitori: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Il prezzo nel contesto

Posizione del prezzo tra 60 modelli comparabili

Input$2.5/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
Output$15/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
Lettura da cache$0.25/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.

Specifiche e limiti

Token

Finestra di contesto (specifica del fornitore) 1.050.000
Output massimo (specifica del vendor) 128.000
Cutoff di conoscenza 2026-02

Caching prompt

Modalità automatico
Prefisso min. 1.024
Durata 5-10 min, fino a 1 ora

Ragionamento

Parametro del fornitore reasoning.effort
Valori accettati none · low · medium · high · xhigh · max
Valore predefinito medium applicato se la richiesta non specifica nulla
Disattivabile
Comportamento del ragionamento La Responses API accetta anche reasoning.mode, con valore standard (il predefinito) o pro; mode ed effort sono manopole indipendenti.
Parametro reasoning_effort
Valori minimal · low · medium · high la superficie parametri del gateway - vale la mappatura del fornitore sopra

Modello

Modalità testo + immagine → testo
  • Livello intermedio per carichi di lavoro che bilanciano intelligenza e costo
  • OpenAI lo posiziona per compiti aziendali ad alto volume a un prezzo più basso del flagship
  • 1,05M di contesto / 128k di output massimo
  • i prompt oltre i 272k token in input sono fatturati a 2x in input / 1,5x in output

fonte: documentazione ufficiale OpenAI ↗

Un solo prompt, misurato attraverso il gateway

PROMPT Explain to a CFO, in exactly three sentences, why our LLM bill doubled after we enabled reasoning. VERIFICA esattamente 3 frasi

GPT-5.6 Terra superato · 3 sentences

Enabling reasoning makes the model generate additional internal analysis tokens and perform more computation before producing the final answer, increasing usage per request. Those extra tokens are billed like other model output or are reflected in higher-priced reasoning-model rates, so even unchanged user traffic can cost substantially more. The bill doubled because average cost per request rose, likely from longer reasoning traces, more complex model routing, or both.

out 120 tok (+31 ragionamento) latenza 2.4 s

Rispetto dell'istruzione (esattamente tre frasi - contabili), adattamento al pubblico (registro da CFO), e il divario di fatturazione del pensiero nascosto che i contatori di token qui sotto rivelano.

PROMPT This function is supposed to return the longest run of consecutive equal items, but callers report it is off by one on single-element inputs and misses runs that end at the last index. Fix it and explain the bug in one paragraph. VERIFICA la correzione supera i test

GPT-5.6 Terra superato · 8/8 cases

```python def longest_run(xs): if not xs: return 0 best = 1 cur = 1 for i in range(1, len(xs)): if xs[i] == xs[i - 1]: cur += 1 else: cur = 1 best = max(best, cur) return best ``` The bug is that `cur` and `best` were counting adjacent *matches* rather than the number of items in a run: a run of one item has zero matching adjacent pairs, and a run of length `n` has only `n - 1` such pairs. Initializing both counters to `1` for a nonempty list and resetting `cur` to `1` when the value changes makes them represent actual run lengths. Updating `best` on every iteration also ensures a run that continues through the final element is included.

out 196 tok latenza 2.6 s

Se la correzione è davvero giusta (eseguibile), la densità della spiegazione, e l'efficienza in token su un compito delimitato.

PROMPT Extract a JSON object with fields {company, quarter, revenue_usd_m, growth_pct, guidance} from this text. Use null for anything not stated; add no other fields. VERIFICA JSON valido, schema esatto

GPT-5.6 Terra superato · 5/5 fields, guidance "withheld pending the Q4 close"

{"company":"Meridian Robotics","quarter":"September quarter","revenue_usd_m":412,"growth_pct":null,"guidance":"withheld pending the Q4 close"}

out 149 tok (+103 ragionamento) latenza 2.3 s

Aderenza allo schema (nessun campo inventato), pressione di allucinazione (guidance è esplicitamente sospesa), e differenze nel percorso di output strutturato.

PROMPT Write a 120-word product announcement for an API gateway feature that caches prompts across providers. Forbidden words: "seamless", "unlock", "game-changer", "revolutionize", "empower". Exactly one sentence must be a question. VERIFICA 120 parole, 0 parole vietate

GPT-5.6 Terra superato · 120 words, 0 banned, 1 question

Today, our API gateway introduces cross-provider prompt caching, reducing repeated token processing while preserving your existing model routing. Teams can store reusable system prompts, policy blocks, and long context prefixes once, then serve them to supported providers with consistent cache keys and observability. The feature tracks hit rates, latency savings, and estimated cost reductions in the dashboard you already use for requests. Why pay to recompute identical context on every call? Configure cache policies by route, tenant, model, or TTL, and fall back automatically when a provider lacks compatible caching. Built-in controls help protect sensitive data through encryption, regional settings, and explicit expiration. Start with a single endpoint, compare results across providers, and scale prompt reuse without rewriting application logic.

out 631 tok (+475 ragionamento) latenza 6.0 s

Rispetto dei vincoli (budget di parole, elenco di parole vietate, l'unica domanda), impronta stilistica, e controllo della lunghezza.

Usa GPT-5.6 Terra in 30 secondi

Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gpt-5.6-terra",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Informazioni su GPT-5.6 Terra

  • La mappatura dei livelli di OpenAI dice che Terra corrisponde all'incirca al livello mini delle famiglie GPT-5 precedenti, e la sua guida alla scelta lo raccomanda quando si vogliono prestazioni solide a un prezzo più basso del flagship.
  • Condivide la finestra di contesto da 1.050.000 token della famiglia (specifica del vendor), i 128K token di output massimo, l'input di immagini, il supporto per i token di ragionamento e la suite di strumenti hosted dalla ricerca web fino a computer use e MCP, con un cutoff di conoscenza a febbraio 2026.
  • Il reasoning effort si risolve in medium quando omesso e arriva al nuovo livello max della generazione; la modalità pro della Responses API e l'orchestrazione di subagent multi-agent in beta sono disponibili qui come in tutta la famiglia GPT-5.6.
  • L'input in cache costa un decimo dell'input di listino, con le scritture in cache a 1,25x, e i prompt sopra i 272K token di input sono fatturati a 2x l'input e 1,5x l'output per l'intera richiesta.
  • Per i team che hanno adottato GPT-5.5 come predefinito, Terra è il sostituto diretto a costo più basso.
  • Su Synthorai, GPT-5.6 Terra sta dietro la stessa API compatibile OpenAI del resto della flotta.

FAQ

L'API di GPT-5.6 Terra si può provare gratis?

Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. A $2.5/M token in input, quel credito da solo copre circa 49 richieste da ~8K token verso GPT-5.6 Terra.

In cosa eccelle GPT-5.6 Terra?

Prestazioni competitive con GPT-5.5 a costo 2x inferiore; costruito per carichi di lavoro aziendali ad alto volume; contesto completo da 1.050.000 token e strumenti hosted. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.

Quanto costa GPT-5.6 Terra?

Su Synthorai, GPT-5.6 Terra costa $2.5 per milione di token in input e $15 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma. I token di input in cache si fatturano a $0.25/M.

GPT-5.6 Terra supporta il caching dei prompt?

Sì, in automatico: i prompt serviti da OpenAI vanno in cache senza modifiche al codice. I token di input in cache si fatturano a $0.25/M contro $2.5/M senza cache; per andare in cache i prompt richiedono un prefisso stabile di 1,024 token (TTL 5-10 min, fino a 1 ora). Guida al caching dei prompt →

Come ottengo l'accesso a GPT-5.6 Terra?

Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="gpt-5.6-terra" e hai finito: una sola chiave API copre tutti i modelli del gateway.

Qual è il cutoff di conoscenza di GPT-5.6 Terra?

Il cutoff di conoscenza di GPT-5.6 Terra è 2026-02, secondo la documentazione ufficiale del vendor (dato aggiornato al 2026-07-10).

Modelli correlati

Confronta

Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.

Ottieni la tua chiave API Confronta il tuo costo →