Dola Seed 2.0 Lite è il livello bilanciato della famiglia Dola Seed 2.0 di ByteDance su BytePlus ModelArk.
- Input
- testo immagine video audio $0.25/M
- Output
- testo $2/M
- Lettura cache
- $0.05/M
- Contesto
- 262K
- vs GPT-4o
- ~95% più economico
Benchmark
Dati pubblicati dai fornitori: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai
Il prezzo nel contesto
Posizione del prezzo tra 60 modelli comparabili
La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.
Specifiche e limiti
Token
| Finestra di contesto (specifica del fornitore) | 256.000 |
|---|---|
| Output massimo (specifica del vendor) | 131.072 |
Caching prompt
| Modalità | automatico + esplicito |
|---|---|
| Prefisso min. | 1.024 |
Ragionamento
| Parametro del fornitore | thinking.type + reasoning_effort |
|---|---|
| Valori accettati | thinking.type enabled · disabled (no auto); reasoning_effort minimal · low · medium · high |
| Valore predefinito | enabled, con reasoning_effort medium applicato se la richiesta non specifica nulla |
| Disattivabile | Sì |
| Comportamento del ragionamento | La traccia viene restituita in reasoning_content e resta nella cronologia della conversazione; nei turni con chiamate a strumenti non va restituito nulla, e ometterla non genera alcun errore. |
| Parametro | reasoning_effort |
| Valori | minimal · low · medium · high la superficie parametri del gateway - vale la mappatura del fornitore sopra |
Modello
| Modalità | testo + immagine + video + audio → testo |
|---|
- Serie Seed 2.0 lanciata il 2026-02-14
- id ModelArk seed-2-0-lite (ultima versione 260428)
- 256K di contesto, 128K di output massimo incl. CoT
- comprensione audio in beta sulla versione 260428
- caching del contesto implicito + esplicito
Un solo prompt, misurato attraverso il gateway
Dola Seed 2.0 Lite superato · 3 sentences
Enabling reasoning on our production LLM requires the model to run resource-intensive multi-step chain-of-thought inference for every customer-facing query, rather than the single-pass inference that powered our original non-reasoning deployment, and GPU compute—which makes up 90% of our total LLM bill—scales directly with the number of compute cycles each query consumes. Our cloud provider’s LLM billing model charges per million processed tokens, and reasoning workflows generate an average of 2.1x more hidden processing tokens (the intermediate problem-solving steps the model never surfaces to end users) that are still billable, pushing our total monthly token consumption just over double what it was prior to enabling the feature. […]
out 1306 tok (+1096 ragionamento) latenza 18.2 s
Rispetto dell'istruzione (esattamente tre frasi - contabili), adattamento al pubblico (registro da CFO), e il divario di fatturazione del pensiero nascosto che i contatori di token qui sotto rivelano.
Dola Seed 2.0 Lite superato · 8/8 cases
### Corrected Function ```python def longest_run(xs): if not xs: # Handle empty input edge case return 0 best = cur = 1 # Base run length of 1 for any non-empty single element for i in range(1, len(xs)): if xs[i] == xs[i - 1]: cur += 1 best = max(best, cur) else: cur = 1 # Reset run length for the new, different element return best ``` ### Bug Explanation (single paragraph) The original function’s core flaw was that it counted the number of consecutive equal adjacent element pairs, rather than the number of elements in the run itself, leading to all results being off by one, which caused both reported issues: a run of k equal elements only has k-1 consecutive matching pairs, so the original function’s maximum `best` value was always one less than the true element count of the longest run. […]
out 2620 tok (+2217 ragionamento) latenza 33.2 s
Se la correzione è davvero giusta (eseguibile), la densità della spiegazione, e l'efficienza in token su un compito delimitato.
Dola Seed 2.0 Lite superato · 5/5 fields, guidance "Formal guidance withheld pending Q4 clos"
{ "company": "Meridian Robotics", "quarter": "September quarter", "revenue_usd_m": 412, "growth_pct": 11, "guidance": "Formal guidance withheld pending Q4 close" }
out 1502 tok (+1439 ragionamento) latenza 20.2 s
Aderenza allo schema (nessun campo inventato), pressione di allucinazione (guidance è esplicitamente sospesa), e differenze nel percorso di output strutturato.
Dola Seed 2.0 Lite mancato · 141 words, 0 banned, 1 question
Today we launch Cross-Provider Prompt Cache, a new feature for our Core API Gateway built to cut redundant AI costs and latency for teams routing requests across multiple LLM providers. Many development teams rotate between OpenAI, Anthropic, and Google Gemini to balance performance, cost, and capability, but identical prompts get reprocessed from scratch with every provider switch, wasting tokens and slowing response times. This feature stores validated prompt responses at the gateway layer, so repeat requests pull from cache regardless of which provider they route to, with configurable TTLs and built-in compliance with all major provider data policies. […]
out 1870 tok (+1695 ragionamento) latenza 23.1 s
Rispetto dei vincoli (budget di parole, elenco di parole vietate, l'unica domanda), impronta stilistica, e controllo della lunghezza.
Usa Dola Seed 2.0 Lite in 30 secondi
Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="Dola-Seed-2.0-lite",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "Dola-Seed-2.0-lite",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "Dola-Seed-2.0-lite",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "Dola-Seed-2.0-lite",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("Dola-Seed-2.0-lite")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Informazioni su Dola Seed 2.0 Lite
- BytePlus descrive il suo rilascio più recente come il primo modello di comprensione omnimodale della famiglia Dola, che unifica nativamente la comprensione di video, immagini, audio e testo con capacità agentiche, di coding e GUI migliorate; il rilascio precedente era presentato come un aggiornamento enterprise economico e ad alto throughput rispetto a seed-1-8, con forte comprensione del contesto lungo e output strutturati affidabili per i flussi di lavoro di produzione principali.
- Offre una finestra di contesto da 256K con fino a 128K in output inclusa la chain-of-thought, il doppio dei 64K di output totale di seed-1.8, ed è questa la ragione concreta per spostare il lavoro di ragionamento lungo sulla generazione 2.0.
- L'output è predefinito a 4K, quindi va alzato deliberatamente per le risposte lunghe.
- Il thinking è attivo di default tramite thinking.type, che offre solo enabled e disabled senza un'impostazione automatica, e la profondità di ragionamento si regola separatamente con reasoning_effort a minimal, low, medium o high, con predefinito medium.
- Sono supportati output strutturato con schema JSON, function calling con integrazione di strumenti MCP, riassunti del thinking e caching sia implicito sia esplicito a livello di prefisso e di sessione, e l'output è solo testo indipendentemente da ciò che entra.
- BytePlus non pubblica alcuna guida di scelta comparativa per la famiglia, quindi il posizionamento delle note di rilascio è la base ufficiale per scegliere tra i livelli.
- Synthorai lo intermedia tramite una chat API compatibile OpenAI.
FAQ
L'API di Dola Seed 2.0 Lite si può provare gratis?
Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. A $0.25/M token in input, quel credito da solo copre circa 500 richieste da ~8K token verso Dola Seed 2.0 Lite.
In cosa eccelle Dola Seed 2.0 Lite?
Primo modello di comprensione omnimodale della sua famiglia; unificazione nativa di video, immagini, audio e testo; contesto da 256K con fino a 128K in output. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.
Quanto costa Dola Seed 2.0 Lite?
Su Synthorai, Dola Seed 2.0 Lite costa $0.25 per milione di token in input e $2 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma. I token di input in cache si fatturano a $0.05/M.
Dola Seed 2.0 Lite supporta il caching dei prompt?
Sì: il caching automatico è attivo di default, con una modalità esplicita per risparmi garantiti. I token di input in cache si fatturano a $0.05/M contro $0.25/M senza cache; per andare in cache i prompt richiedono un prefisso stabile di 1,024 token. Guida al caching dei prompt →
Come ottengo l'accesso a Dola Seed 2.0 Lite?
Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="Dola-Seed-2.0-lite" e hai finito: una sola chiave API copre tutti i modelli del gateway.
Modelli correlati
Confronta
Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.