Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

Dola Seed 2.0 Lite

Lançado em 2026-02-14

chatCódigoChamada de ferramentasVisãoRaciocínioCache de prompts

O Dola Seed 2.0 Lite é o nível balanceado da família Dola Seed 2.0 da ByteDance no BytePlus ModelArk.

Entrada
texto imagem vídeo áudio $0.25/M
Saída
texto $2/M
Leitura de cache
$0.05/M
Contexto
262K
vs GPT-4o
~95% mais barato

Benchmarks

Acima da médiaNenhum melhor4 / 103 / 10
Dola Seed 2.0 Lite outros modelos medidos média dos modelos comparados nenhum outro modelo pontuou mais alto
SWE Multilingual GPT-5.4 High
66.6%
WenetSpeech test-net (CER)
nenhum outro modelo pontuou mais alto 4.47%
OSWorld-Verified
64.4%
GPQA Diamond
88.4%
BrowseComp
64%
MMVU
76.7%

Publicado pelos fornecedores: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai

O preço em contexto

Posição do preço entre 60 modelos comparáveis

Entrada$0.25/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
Saída$2/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
Leitura em cache$0.05/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

A barra mostra onde fica o preço deste modelo entre todos os modelos do mesmo tipo na Synthorai. Em cada extremidade está o mais barato e o mais caro. São tarifas base; os descontos de lote, região e escrita em cache estão na página de preços.

Especificações e limites

Tokens

Janela de contexto (especificação do fornecedor) 256.000
Saída máxima (especificação do fornecedor) 131.072

Cache de prompts

Modo automático + explícito
Prefixo mín. 1.024

Raciocínio

Parâmetro do fornecedor thinking.type + reasoning_effort
Valores aceites thinking.type enabled · disabled (no auto); reasoning_effort minimal · low · medium · high
Valor predefinido enabled, com reasoning_effort medium aplicado quando o pedido nada indica
Pode ser desativado Sim
Comportamento do raciocínio O trace retorna em reasoning_content e é mantido no histórico da conversa; nos turnos com chamada de ferramentas nada deve ser devolvido, e nenhum erro é gerado se ele for omitido.
Parâmetro reasoning_effort
Valores minimal · low · medium · high a superfície de parâmetros do gateway - aplica-se o mapeamento do fornecedor acima

Modelo

Modalidades texto + imagem + vídeo + áudio → texto
  • Série Seed 2.0 lançada em 2026-02-14
  • id do ModelArk seed-2-0-lite (versão mais recente 260428)
  • contexto de 256K, saída máxima de 128K incluindo CoT
  • entendimento de áudio em beta na versão 260428
  • cache de contexto implícito + explícito

conforme documentação oficial da ByteDance ↗

Um prompt, medido pelo gateway

PROMPT Explain to a CFO, in exactly three sentences, why our LLM bill doubled after we enabled reasoning. VERIFICAR exatamente 3 frases

Dola Seed 2.0 Lite passou · 3 sentences

Enabling reasoning on our production LLM requires the model to run resource-intensive multi-step chain-of-thought inference for every customer-facing query, rather than the single-pass inference that powered our original non-reasoning deployment, and GPU compute—which makes up 90% of our total LLM bill—scales directly with the number of compute cycles each query consumes. Our cloud provider’s LLM billing model charges per million processed tokens, and reasoning workflows generate an average of 2.1x more hidden processing tokens (the intermediate problem-solving steps the model never surfaces to end users) that are still billable, pushing our total monthly token consumption just over double what it was prior to enabling the feature. […]

saída 1306 tok (+1096 pensamento) latência 18.2 s

Cumprimento da instrução (exatamente três frases - contáveis), ajuste ao público (registro de CFO), e a lacuna de cobrança do pensamento oculto que os medidores de tokens abaixo expõem.

PROMPT This function is supposed to return the longest run of consecutive equal items, but callers report it is off by one on single-element inputs and misses runs that end at the last index. Fix it and explain the bug in one paragraph. VERIFICAR a correção passa nos testes

Dola Seed 2.0 Lite passou · 8/8 cases

### Corrected Function ```python def longest_run(xs): if not xs: # Handle empty input edge case return 0 best = cur = 1 # Base run length of 1 for any non-empty single element for i in range(1, len(xs)): if xs[i] == xs[i - 1]: cur += 1 best = max(best, cur) else: cur = 1 # Reset run length for the new, different element return best ``` ### Bug Explanation (single paragraph) The original function’s core flaw was that it counted the number of consecutive equal adjacent element pairs, rather than the number of elements in the run itself, leading to all results being off by one, which caused both reported issues: a run of k equal elements only has k-1 consecutive matching pairs, so the original function’s maximum `best` value was always one less than the true element count of the longest run. […]

saída 2620 tok (+2217 pensamento) latência 33.2 s

Se a correção é de fato certa (executável), a densidade da explicação, e a eficiência em tokens numa tarefa delimitada.

PROMPT Extract a JSON object with fields {company, quarter, revenue_usd_m, growth_pct, guidance} from this text. Use null for anything not stated; add no other fields. VERIFICAR JSON válido, esquema exato

Dola Seed 2.0 Lite passou · 5/5 fields, guidance "Formal guidance withheld pending Q4 clos"

{ "company": "Meridian Robotics", "quarter": "September quarter", "revenue_usd_m": 412, "growth_pct": 11, "guidance": "Formal guidance withheld pending Q4 close" }

saída 1502 tok (+1439 pensamento) latência 20.2 s

Obediência ao esquema (sem campos inventados), pressão de alucinação (guidance é explicitamente retida), e diferenças no caminho de saída estruturada.

PROMPT Write a 120-word product announcement for an API gateway feature that caches prompts across providers. Forbidden words: "seamless", "unlock", "game-changer", "revolutionize", "empower". Exactly one sentence must be a question. VERIFICAR 120 palavras, 0 palavras proibidas

Dola Seed 2.0 Lite falhou · 141 words, 0 banned, 1 question

Today we launch Cross-Provider Prompt Cache, a new feature for our Core API Gateway built to cut redundant AI costs and latency for teams routing requests across multiple LLM providers. Many development teams rotate between OpenAI, Anthropic, and Google Gemini to balance performance, cost, and capability, but identical prompts get reprocessed from scratch with every provider switch, wasting tokens and slowing response times. This feature stores validated prompt responses at the gateway layer, so repeat requests pull from cache regardless of which provider they route to, with configurable TTLs and built-in compliance with all major provider data policies. […]

saída 1870 tok (+1695 pensamento) latência 23.1 s

Obediência às restrições (orçamento de palavras, lista de palavras proibidas, a única pergunta), impressão digital de estilo, e controle de comprimento.

Use o Dola Seed 2.0 Lite em 30 segundos

Compatível com OpenAI: troque a base_url, mantenha seu SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="Dola-Seed-2.0-lite",
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

Sobre o Dola Seed 2.0 Lite

  • A BytePlus descreve seu lançamento mais recente como o primeiro modelo de entendimento omnimodal da família Dola, unificando nativamente o entendimento de vídeo, imagem, áudio e texto com capacidades de agente, código e GUI aprimoradas; o lançamento anterior era anunciado como uma atualização empresarial de custo eficiente e alta vazão em relação ao seed-1-8, com forte entendimento de contexto longo e saídas estruturadas confiáveis para os fluxos de produção essenciais.
  • Ele oferece uma janela de contexto de 256K com até 128K de saída incluindo chain-of-thought, o dobro da saída total de 64K do seed-1.8, que é a razão concreta para mover trabalho de raciocínio longo para a geração 2.0.
  • A saída assume 4K por padrão, então aumente-a deliberadamente para respostas longas.
  • O raciocínio vem ligado por padrão via thinking.type, que oferece apenas enabled e disabled, sem configuração automática, e a profundidade de raciocínio é ajustada separadamente por reasoning_effort em minimal, low, medium ou high, com medium como padrão.
  • Saída estruturada com um JSON schema, function calling com integração de ferramentas MCP, resumos de raciocínio e cache implícito e explícito em nível de prefixo e de sessão são suportados, e a saída é somente texto, independentemente do que entra.
  • A BytePlus não publica um guia de seleção comparativo para a família, então o posicionamento das notas de lançamento é a base oficial para escolher entre os níveis.
  • A Synthorai o intermedia por uma API de chat compatível com OpenAI.

Perguntas frequentes

A API do Dola Seed 2.0 Lite é gratuita para testar?

Sim. Contas novas recebem 10 chamadas de teste e até $1 em créditos gratuitos, sem precisar de cartão. A $0.25/M de tokens de entrada, só esse crédito já cobre cerca de 500 requisições de ~8K tokens ao Dola Seed 2.0 Lite.

Em que o Dola Seed 2.0 Lite é melhor?

Primeiro modelo de entendimento omnimodal da sua família; unifica nativamente vídeo, imagem, áudio e texto; 256K de contexto com até 128K de saída. Veja a seção Sobre para o quadro completo, extraído das notas de lançamento do próprio fornecedor.

Quanto custa o Dola Seed 2.0 Lite?

Na Synthorai, o Dola Seed 2.0 Lite custa $0.25 por milhão de tokens de entrada e $2 por milhão de tokens de saída. É o preço de tabela do provedor, sem margem da plataforma. Tokens de entrada em cache são cobrados a $0.05/M.

O Dola Seed 2.0 Lite suporta cache de prompts?

Sim: o cache automático vem ativado por padrão, com um modo explícito para economia garantida. Tokens de entrada em cache são cobrados a $0.05/M, contra $0.25/M sem cache; os prompts precisam de um prefixo estável de 1,024 tokens para entrar em cache. Guia de cache de prompts →

Como obtenho acesso ao Dola Seed 2.0 Lite?

Aponte seu SDK da OpenAI existente para base_url="https://synthorai.io/v1", defina model="Dola-Seed-2.0-lite" e pronto. Uma única chave de API cobre todos os modelos do gateway.

Modelos relacionados

Comparar

Cada valor desta página é transcrito da documentação do fornecedor, ligada acima, e traz a data em que foi verificado. Os preços são comparados em todo o catálogo; os valores de especificação que os fornecedores definem de forma diferente são apresentados com a diferença indicada em vez de representados num gráfico. Nada aqui é medido por nós, e nada é pontuado.

Obtenha sua chave API Compare seu custo →