O ByteDance-Seed-1.8 é um modelo de raciocínio profundo (deep-thinking) no BytePlus ModelArk, atualmente em beta, que sua página de modelo credita com entendimento multimodal e capacidades de agente mais fortes e desempenho superior em uma ampla gama de tarefas complexas do mundo real.
- Entrada
- texto imagem vídeo $0.25/M
- Saída
- texto $2/M
- Leitura de cache
- $0.05/M
- Contexto
- 262K
- vs GPT-4o
- ~95% mais barato
O preço em contexto
Posição do preço entre 60 modelos comparáveis
A barra mostra onde fica o preço deste modelo entre todos os modelos do mesmo tipo na Synthorai. Em cada extremidade está o mais barato e o mais caro. São tarifas base; os descontos de lote, região e escrita em cache estão na página de preços.
Especificações e limites
Tokens
| Janela de contexto (especificação do fornecedor) | 256.000 |
|---|---|
| Saída máxima (especificação do fornecedor) | 65.536 |
Cache de prompts
| Modo | automático + explícito |
|---|---|
| Prefixo mín. | 1.024 |
Raciocínio
| Parâmetro do fornecedor | thinking.type + reasoning_effort |
|---|---|
| Valores aceites | thinking.type enabled · disabled (no auto); reasoning_effort minimal · low · medium · high |
| Valor predefinido | enabled, com reasoning_effort medium aplicado quando o pedido nada indica |
| Pode ser desativado | Sim |
| Comportamento do raciocínio | O trace retorna em reasoning_content; a partir do seed-1.8 ele é mantido no histórico da conversa em vez de descartado, e o modelo decide se o realimenta na inferência. |
| Parâmetro | reasoning_effort |
| Valores | minimal · low · medium · high a superfície de parâmetros do gateway - aplica-se o mapeamento do fornecedor acima |
Modelo
| Modalidades | texto + imagem + vídeo → texto |
|---|
- Modelo agêntico generalista (capacidades de busca, código e agente de GUI, visão nativa)
- id do ModelArk seed-1-8 (versão seed-1-8-251228, Beta)
- contexto de 256K, saída máxima de 64K incluindo CoT
- raciocínio profundo minimal/low/medium/high
- function calling em modo estrito
conforme documentação oficial da ByteDance ↗
Um prompt, medido pelo gateway
ByteDance Seed 1.8 passou · 3 sentences
Enabling reasoning capabilities means our LLMs now run multi-step inference chains instead of generating short, direct responses, which doubles the compute resources consumed per query since each step requires processing additional context and intermediate outputs to arrive at a logical conclusion. Additionally, teams across finance, legal, and operations have rapidly adopted these reasoning tools for high-complexity workflows—like automated contract clause analysis and quarterly forecast variance checks—that were previously done manually, leading to a 20% uptick in overall query volume on top of higher per-query costs. While this has temporarily doubled our LLM bill, the time saved on labor-intensive tasks is already reducing overtime costs for senior staff, and we project these efficiency gains will offset the increased LLM expenses and generate net savings by Q4 of this year.
saída 741 tok (+581 pensamento) latência 11.1 s
Cumprimento da instrução (exatamente três frases - contáveis), ajuste ao público (registro de CFO), e a lacuna de cobrança do pensamento oculto que os medidores de tokens abaixo expõem.
ByteDance Seed 1.8 passou · 8/8 cases
### Fixed Function ```python def longest_run(xs): if not xs: return 0 best = 1 cur = 1 for i in range(1, len(xs)): if xs[i] == xs[i-1]: cur += 1 best = max(best, cur) else: cur = 1 return best ``` ### Bug Explanation The original function had two critical bugs: 1) It initialized `best` and `cur` to 0, ignoring that any non-empty list has a minimal run length of 1 (causing single-element inputs to return 0 instead of 1). 2) It counted consecutive equal transitions (e.g., for a run of 3 elements, it counted 2 transitions) instead of the actual run length, leading to off-by-one errors for all runs—including those ending at the last index (like [2,2,2] returning 2 instead of 3). […]
saída 2072 tok (+1817 pensamento) latência 26.1 s
Se a correção é de fato certa (executável), a densidade da explicação, e a eficiência em tokens numa tarefa delimitada.
ByteDance Seed 1.8 passou · 5/5 fields, guidance "withheld pending the Q4 close"
{ "company": "Meridian Robotics", "quarter": "Q3", "revenue_usd_m": 412, "growth_pct": 11, "guidance": "withheld pending the Q4 close" }
saída 757 tok (+695 pensamento) latência 10.6 s
Obediência ao esquema (sem campos inventados), pressão de alucinação (guidance é explicitamente retida), e diferenças no caminho de saída estruturada.
ByteDance Seed 1.8 falhou · 147 words, 0 banned, 1 question
Today, we’re launching a cross-provider prompt caching feature for our API gateway, built to solve key challenges for teams leveraging multiple AI service providers. Many teams reuse standardized prompts across tools but incur unnecessary latency and inflated costs from resubmitting identical requests to different platforms. This feature automatically detects and stores matching prompts across all connected providers in an encrypted, user-configurable cache, cutting redundant API calls by up to 55% and reducing average request latency by 40% for repeated prompts. It supports all major AI providers and integrates with existing gateway workflows, with options to set cache expiration times per prompt category. […]
saída 1146 tok (+970 pensamento) latência 15.2 s
Obediência às restrições (orçamento de palavras, lista de palavras proibidas, a única pergunta), impressão digital de estilo, e controle de comprimento.
Use o ByteDance Seed 1.8 em 30 segundos
Compatível com OpenAI: troque a base_url, mantenha seu SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="ByteDance-Seed-1.8",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "ByteDance-Seed-1.8",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "ByteDance-Seed-1.8",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "ByteDance-Seed-1.8",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("ByteDance-Seed-1.8")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Sobre o ByteDance Seed 1.8
- As notas de lançamento acrescentam entendimento multimodal aprimorado e gerenciamento de contexto mais flexível.
- Ele aceita entrada de texto, imagem e vídeo e retorna texto, com uma janela de contexto de 256K, entrada máxima de 224K e saída de 64K incluindo um orçamento de chain-of-thought de 32K, além de function calling, saída estruturada e cache de contexto.
- Dois detalhes valem ser configurados antes de ir para produção: a saída máxima assume 4K por padrão, bem abaixo do teto de 64K, e thinking.type vem habilitado por padrão, sem modo automático, então o raciocínio profundo precisa ser desligado explicitamente se você não o quiser.
- A profundidade é ajustada separadamente por reasoning_effort em minimal, low, medium ou high, com medium como padrão.
- A mudança principal desta geração é o codificador visual: imagens de até quatro megapixels agora custam 44,4% dos tokens que a versão anterior cobrava, a entrada de alto detalhe alcança nove megapixels e o teto de quadros de vídeo dobra para 1.280, embora enviar vídeo pela Files API exija nomear este modelo, ou o codificador antigo será usado.
- O cache funciona de forma implícita e explícita tanto em nível de prefixo quanto de sessão, a edição de contexto pode limpar raciocínio ou chamadas de ferramentas anteriores, e a inferência em lote é suportada.
- A Synthorai o serve pelo seu endpoint de gateway compatível com OpenAI.
Perguntas frequentes
A API do ByteDance Seed 1.8 é gratuita para testar?
Sim. Contas novas recebem 10 chamadas de teste e até $1 em créditos gratuitos, sem precisar de cartão. A $0.25/M de tokens de entrada, só esse crédito já cobre cerca de 500 requisições de ~8K tokens ao ByteDance Seed 1.8.
Em que o ByteDance Seed 1.8 é melhor?
Entendimento multimodal e capacidades de agente mais fortes; entrada de texto, imagem e vídeo; 256K de contexto com orçamento de chain-of-thought de 32K. Veja a seção Sobre para o quadro completo, extraído das notas de lançamento do próprio fornecedor.
Quanto custa o ByteDance Seed 1.8?
Na Synthorai, o ByteDance Seed 1.8 custa $0.25 por milhão de tokens de entrada e $2 por milhão de tokens de saída. É o preço de tabela do provedor, sem margem da plataforma. Tokens de entrada em cache são cobrados a $0.05/M.
O ByteDance Seed 1.8 suporta cache de prompts?
Sim: o cache automático vem ativado por padrão, com um modo explícito para economia garantida. Tokens de entrada em cache são cobrados a $0.05/M, contra $0.25/M sem cache; os prompts precisam de um prefixo estável de 1,024 tokens para entrar em cache. Guia de cache de prompts →
Como obtenho acesso ao ByteDance Seed 1.8?
Aponte seu SDK da OpenAI existente para base_url="https://synthorai.io/v1", defina model="ByteDance-Seed-1.8" e pronto. Uma única chave de API cobre todos os modelos do gateway.
Modelos relacionados
Comparar
Cada valor desta página é transcrito da documentação do fornecedor, ligada acima, e traz a data em que foi verificado. Os preços são comparados em todo o catálogo; os valores de especificação que os fornecedores definem de forma diferente são apresentados com a diferença indicada em vez de representados num gráfico. Nada aqui é medido por nós, e nada é pontuado.