Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

ByteDance Seed 1.8

Lançado em 2025-12

chatChamada de ferramentasVisãoRaciocínioCache de prompts

O ByteDance-Seed-1.8 é um modelo de raciocínio profundo (deep-thinking) no BytePlus ModelArk, atualmente em beta, que sua página de modelo credita com entendimento multimodal e capacidades de agente mais fortes e desempenho superior em uma ampla gama de tarefas complexas do mundo real.

Entrada
texto imagem vídeo $0.25/M
Saída
texto $2/M
Leitura de cache
$0.05/M
Contexto
262K
vs GPT-4o
~95% mais barato

O preço em contexto

Posição do preço entre 60 modelos comparáveis

Entrada$0.25/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
Saída$2/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
Leitura em cache$0.05/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

A barra mostra onde fica o preço deste modelo entre todos os modelos do mesmo tipo na Synthorai. Em cada extremidade está o mais barato e o mais caro. São tarifas base; os descontos de lote, região e escrita em cache estão na página de preços.

Especificações e limites

Tokens

Janela de contexto (especificação do fornecedor) 256.000
Saída máxima (especificação do fornecedor) 65.536

Cache de prompts

Modo automático + explícito
Prefixo mín. 1.024

Raciocínio

Parâmetro do fornecedor thinking.type + reasoning_effort
Valores aceites thinking.type enabled · disabled (no auto); reasoning_effort minimal · low · medium · high
Valor predefinido enabled, com reasoning_effort medium aplicado quando o pedido nada indica
Pode ser desativado Sim
Comportamento do raciocínio O trace retorna em reasoning_content; a partir do seed-1.8 ele é mantido no histórico da conversa em vez de descartado, e o modelo decide se o realimenta na inferência.
Parâmetro reasoning_effort
Valores minimal · low · medium · high a superfície de parâmetros do gateway - aplica-se o mapeamento do fornecedor acima

Modelo

Modalidades texto + imagem + vídeo → texto
  • Modelo agêntico generalista (capacidades de busca, código e agente de GUI, visão nativa)
  • id do ModelArk seed-1-8 (versão seed-1-8-251228, Beta)
  • contexto de 256K, saída máxima de 64K incluindo CoT
  • raciocínio profundo minimal/low/medium/high
  • function calling em modo estrito

conforme documentação oficial da ByteDance ↗

Um prompt, medido pelo gateway

PROMPT Explain to a CFO, in exactly three sentences, why our LLM bill doubled after we enabled reasoning. VERIFICAR exatamente 3 frases

ByteDance Seed 1.8 passou · 3 sentences

Enabling reasoning capabilities means our LLMs now run multi-step inference chains instead of generating short, direct responses, which doubles the compute resources consumed per query since each step requires processing additional context and intermediate outputs to arrive at a logical conclusion. Additionally, teams across finance, legal, and operations have rapidly adopted these reasoning tools for high-complexity workflows—like automated contract clause analysis and quarterly forecast variance checks—that were previously done manually, leading to a 20% uptick in overall query volume on top of higher per-query costs. While this has temporarily doubled our LLM bill, the time saved on labor-intensive tasks is already reducing overtime costs for senior staff, and we project these efficiency gains will offset the increased LLM expenses and generate net savings by Q4 of this year.

saída 741 tok (+581 pensamento) latência 11.1 s

Cumprimento da instrução (exatamente três frases - contáveis), ajuste ao público (registro de CFO), e a lacuna de cobrança do pensamento oculto que os medidores de tokens abaixo expõem.

PROMPT This function is supposed to return the longest run of consecutive equal items, but callers report it is off by one on single-element inputs and misses runs that end at the last index. Fix it and explain the bug in one paragraph. VERIFICAR a correção passa nos testes

ByteDance Seed 1.8 passou · 8/8 cases

### Fixed Function ```python def longest_run(xs): if not xs: return 0 best = 1 cur = 1 for i in range(1, len(xs)): if xs[i] == xs[i-1]: cur += 1 best = max(best, cur) else: cur = 1 return best ``` ### Bug Explanation The original function had two critical bugs: 1) It initialized `best` and `cur` to 0, ignoring that any non-empty list has a minimal run length of 1 (causing single-element inputs to return 0 instead of 1). 2) It counted consecutive equal transitions (e.g., for a run of 3 elements, it counted 2 transitions) instead of the actual run length, leading to off-by-one errors for all runs—including those ending at the last index (like [2,2,2] returning 2 instead of 3). […]

saída 2072 tok (+1817 pensamento) latência 26.1 s

Se a correção é de fato certa (executável), a densidade da explicação, e a eficiência em tokens numa tarefa delimitada.

PROMPT Extract a JSON object with fields {company, quarter, revenue_usd_m, growth_pct, guidance} from this text. Use null for anything not stated; add no other fields. VERIFICAR JSON válido, esquema exato

ByteDance Seed 1.8 passou · 5/5 fields, guidance "withheld pending the Q4 close"

{ "company": "Meridian Robotics", "quarter": "Q3", "revenue_usd_m": 412, "growth_pct": 11, "guidance": "withheld pending the Q4 close" }

saída 757 tok (+695 pensamento) latência 10.6 s

Obediência ao esquema (sem campos inventados), pressão de alucinação (guidance é explicitamente retida), e diferenças no caminho de saída estruturada.

PROMPT Write a 120-word product announcement for an API gateway feature that caches prompts across providers. Forbidden words: "seamless", "unlock", "game-changer", "revolutionize", "empower". Exactly one sentence must be a question. VERIFICAR 120 palavras, 0 palavras proibidas

ByteDance Seed 1.8 falhou · 147 words, 0 banned, 1 question

Today, we’re launching a cross-provider prompt caching feature for our API gateway, built to solve key challenges for teams leveraging multiple AI service providers. Many teams reuse standardized prompts across tools but incur unnecessary latency and inflated costs from resubmitting identical requests to different platforms. This feature automatically detects and stores matching prompts across all connected providers in an encrypted, user-configurable cache, cutting redundant API calls by up to 55% and reducing average request latency by 40% for repeated prompts. It supports all major AI providers and integrates with existing gateway workflows, with options to set cache expiration times per prompt category. […]

saída 1146 tok (+970 pensamento) latência 15.2 s

Obediência às restrições (orçamento de palavras, lista de palavras proibidas, a única pergunta), impressão digital de estilo, e controle de comprimento.

Use o ByteDance Seed 1.8 em 30 segundos

Compatível com OpenAI: troque a base_url, mantenha seu SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="ByteDance-Seed-1.8",
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

Sobre o ByteDance Seed 1.8

  • As notas de lançamento acrescentam entendimento multimodal aprimorado e gerenciamento de contexto mais flexível.
  • Ele aceita entrada de texto, imagem e vídeo e retorna texto, com uma janela de contexto de 256K, entrada máxima de 224K e saída de 64K incluindo um orçamento de chain-of-thought de 32K, além de function calling, saída estruturada e cache de contexto.
  • Dois detalhes valem ser configurados antes de ir para produção: a saída máxima assume 4K por padrão, bem abaixo do teto de 64K, e thinking.type vem habilitado por padrão, sem modo automático, então o raciocínio profundo precisa ser desligado explicitamente se você não o quiser.
  • A profundidade é ajustada separadamente por reasoning_effort em minimal, low, medium ou high, com medium como padrão.
  • A mudança principal desta geração é o codificador visual: imagens de até quatro megapixels agora custam 44,4% dos tokens que a versão anterior cobrava, a entrada de alto detalhe alcança nove megapixels e o teto de quadros de vídeo dobra para 1.280, embora enviar vídeo pela Files API exija nomear este modelo, ou o codificador antigo será usado.
  • O cache funciona de forma implícita e explícita tanto em nível de prefixo quanto de sessão, a edição de contexto pode limpar raciocínio ou chamadas de ferramentas anteriores, e a inferência em lote é suportada.
  • A Synthorai o serve pelo seu endpoint de gateway compatível com OpenAI.

Perguntas frequentes

A API do ByteDance Seed 1.8 é gratuita para testar?

Sim. Contas novas recebem 10 chamadas de teste e até $1 em créditos gratuitos, sem precisar de cartão. A $0.25/M de tokens de entrada, só esse crédito já cobre cerca de 500 requisições de ~8K tokens ao ByteDance Seed 1.8.

Em que o ByteDance Seed 1.8 é melhor?

Entendimento multimodal e capacidades de agente mais fortes; entrada de texto, imagem e vídeo; 256K de contexto com orçamento de chain-of-thought de 32K. Veja a seção Sobre para o quadro completo, extraído das notas de lançamento do próprio fornecedor.

Quanto custa o ByteDance Seed 1.8?

Na Synthorai, o ByteDance Seed 1.8 custa $0.25 por milhão de tokens de entrada e $2 por milhão de tokens de saída. É o preço de tabela do provedor, sem margem da plataforma. Tokens de entrada em cache são cobrados a $0.05/M.

O ByteDance Seed 1.8 suporta cache de prompts?

Sim: o cache automático vem ativado por padrão, com um modo explícito para economia garantida. Tokens de entrada em cache são cobrados a $0.05/M, contra $0.25/M sem cache; os prompts precisam de um prefixo estável de 1,024 tokens para entrar em cache. Guia de cache de prompts →

Como obtenho acesso ao ByteDance Seed 1.8?

Aponte seu SDK da OpenAI existente para base_url="https://synthorai.io/v1", defina model="ByteDance-Seed-1.8" e pronto. Uma única chave de API cobre todos os modelos do gateway.

Modelos relacionados

Comparar

Cada valor desta página é transcrito da documentação do fornecedor, ligada acima, e traz a data em que foi verificado. Os preços são comparados em todo o catálogo; os valores de especificação que os fornecedores definem de forma diferente são apresentados com a diferença indicada em vez de representados num gráfico. Nada aqui é medido por nós, e nada é pontuado.

Obtenha sua chave API Compare seu custo →