GPT-6.1 Sol è l'aggiornamento di GPT-6 Sol del 29 settembre 2026, che OpenAI posiziona come prestazioni vicine ad Astra per il lavoro complesso a un costo inferiore, pensato per programmazione, uso del computer e lavoro professionale.
- Input
- testo immagine $2/M
- Output
- testo $10/M
- Lettura cache
- $0.1/M
- Contesto
- 1.1M
- vs GPT-4o
- ~60% più economico
- Cutoff di conoscenza
- 2026-04
Prompt oltre 272K token: l'intera richiesta viene fatturata a $4/M in input · $15/M in output
Il prezzo nel contesto
Posizione del prezzo tra 68 modelli comparabili
La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.
Specifiche e limiti
Token
| Finestra di contesto (specifica del fornitore) | 1.050.000 |
|---|---|
| Output massimo (specifica del vendor) | 128.000 |
| Cutoff di conoscenza | 2026-04 |
Caching prompt
| Modalità | automatico |
|---|---|
| Prefisso min. | 1.024 |
| Durata | 5-10 min, fino a 1 ora |
Ragionamento
| Parametro del fornitore | reasoning.effort |
|---|---|
| Valori accettati | low · medium · high · xhigh · max |
| Valore predefinito | medium applicato se la richiesta non specifica nulla |
| Disattivabile | No |
| Parametro | reasoning_effort |
| Valori | minimal · low · medium · high la superficie parametri del gateway - vale la mappatura del fornitore sopra |
Modello
| Modalità | testo + immagine → testo |
|---|
- Upgrade to GPT-6 Sol with near-Astra performance for complex coding, computer use and professional work. 1.05M context of which up to 922K can be input, 128K max output. Cached input is 0.05x the input rate, half of GPT-6 Sol's. Prompts over 272K input tokens move the whole request onto the long-context rate (2x input and cache, 1.5x output). Reasoning cannot be turned off: none and minimal are not supported. Tool calling requires the Responses API
- Chat Completions is supported without tools
Un solo prompt, misurato attraverso il gateway
GPT-6.1 Sol superato · 3 sentences
Enabling reasoning makes the model do more computational work before answering, and many providers bill the resulting reasoning tokens even though users never see them. That means the same number of requests can cost twice as much because each request consumes more billable tokens, even if the visible answers stay the same length. We should confirm the increase in our usage breakdown and reserve higher reasoning levels for tasks where the improvement justifies the added cost.
out 144 tok (+54 ragionamento) latenza 6.6 s
Rispetto dell'istruzione (esattamente tre frasi - contabili), adattamento al pubblico (registro da CFO), e il divario di fatturazione del pensiero nascosto che i contatori di token qui sotto rivelano.
GPT-6.1 Sol superato · 8/8 cases
```python def longest_run(xs): if not xs: return 0 best = cur = 1 for i in range(1, len(xs)): if xs[i] == xs[i - 1]: cur += 1 else: cur = 1 best = max(best, cur) return best ``` The original function counts equal adjacent pairs rather than items in a run: a run of length `n` has only `n - 1` equal pairs, so a single-element input returns `0`, and a run ending at the last index is also undercounted. It does process the last index, so the issue is not a missing final check. Initializing each nonempty run to `1` and updating `best` after every iteration correctly counts items, including singleton and trailing runs; empty inputs still return `0`.
out 189 tok latenza 6.3 s
Se la correzione è davvero giusta (eseguibile), la densità della spiegazione, e l'efficienza in token su un compito delimitato.
GPT-6.1 Sol superato · 5/5 fields, guidance "Withheld pending the Q4 close"
{ "company": "Meridian Robotics", "quarter": "September quarter", "revenue_usd_m": null, "growth_pct": "eleven and change", "guidance": "Withheld pending the Q4 close" }
out 345 tok (+285 ragionamento) latenza 10.2 s
Aderenza allo schema (nessun campo inventato), pressione di allucinazione (guidance è esplicitamente sospesa), e differenze nel percorso di output strutturato.
GPT-6.1 Sol superato · 120 words, 0 banned, 1 question
Introducing Cross-Provider Prompt Cache, a new API gateway feature that stores reusable prompts and manages caching across your supported AI providers. Why rebuild the same context every time your application switches models? With one configuration, teams can reuse shared instructions, standardize cache policies, and reduce repeated prompt processing wherever provider caching is available. The gateway handles provider-specific requirements while giving you clear visibility into cache hits, usage, and estimated savings. Set expiration windows, isolate cached content by project, and invalidate entries when prompts change. Your existing routing logic stays intact, so you can compare models without rebuilding your caching workflow. […]
out 588 tok (+435 ragionamento) latenza 13.9 s
Rispetto dei vincoli (budget di parole, elenco di parole vietate, l'unica domanda), impronta stilistica, e controllo della lunghezza.
Usa GPT-6.1 Sol in 30 secondi
Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gpt-6.1-sol",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gpt-6.1-sol",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gpt-6.1-sol",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gpt-6.1-sol")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Informazioni su GPT-6.1 Sol
- Mantiene la finestra di contesto da 1.050.000 token della famiglia GPT-6, di cui fino a 922.000 in input, con 128K token di output massimo, input di testo e immagini, output strutturati, streaming, chiamate di funzione, caching dei prompt e un limite di conoscenza ad aprile 2026.
- I prezzi di listino di input e output sono quelli di GPT-6 Sol, ma l'input in cache costa la metà, cosa che si accumula nei loop di agenti che reinviano prefissi lunghi.
- I prompt con più di 272K token di input spostano l'intera richiesta sulla tariffa a contesto lungo, con input e cache raddoppiati e output a 1,5 volte.
- Il ragionamento è sempre attivo: l'effort va da low a max con medium come predefinito, e OpenAI non supporta none né minimal su questo modello, quindi Synthorai esegue a low le richieste che li chiedono invece di rifiutarle.
- OpenAI riserva le chiamate di funzione alla Responses API; tramite Synthorai una richiesta Chat Completions con strumenti funziona comunque, perché il gateway la invia all'upstream nella forma che supporta le chiamate di funzione.
- Synthorai offre GPT-6.1 Sol tramite la stessa API compatibile con OpenAI del resto della flotta.
FAQ
L'API di GPT-6.1 Sol si può provare gratis?
Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. A $2/M token in input, quel credito da solo copre circa 62 richieste da ~8K token verso GPT-6.1 Sol.
In cosa eccelle GPT-6.1 Sol?
Aggiornamento di GPT-6 Sol con prestazioni vicine ad Astra per codice, uso del computer e lavoro professionale; contesto da 1,05M, output da 128K, effort di ragionamento da low a max; input in cache a metà del prezzo di GPT-6 Sol, tariffa a contesto lungo oltre 272K token di input. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.
Quanto costa GPT-6.1 Sol?
Su Synthorai, GPT-6.1 Sol costa $2 per milione di token in input e $10 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma. I token di input in cache si fatturano a $0.1/M.
GPT-6.1 Sol supporta il caching dei prompt?
Sì, in automatico: i prompt serviti da OpenAI vanno in cache senza modifiche al codice. I token di input in cache si fatturano a $0.1/M contro $2/M senza cache; per andare in cache i prompt richiedono un prefisso stabile di 1,024 token (TTL 5-10 min, fino a 1 ora). Guida al caching dei prompt →
Come ottengo l'accesso a GPT-6.1 Sol?
Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="gpt-6.1-sol" e hai finito: una sola chiave API copre tutti i modelli del gateway.
Qual è il cutoff di conoscenza di GPT-6.1 Sol?
Il cutoff di conoscenza di GPT-6.1 Sol è 2026-04, secondo la documentazione ufficiale del vendor (dato aggiornato al 2026-09-30).
Modelli correlati
Confronta
Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.