🎁 Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.
Comparativo ao vivo

Cada modelo. Preços reais, zero margem.

Compare preços transparentes de pagamento por uso em 9 fornecedores · 90 modelos, USD por milhão de tokens. Ao vivo via /api/pricing.

Estes são os preços de tabela oficiais. Clientes autenticados podem ver os preços efetivos com descontos do espaço de trabalho em /console/pricing.

OpenAI

24 modelos
Família GPT · raciocínio de ponta
Modelo · Capacidades
Contexto
Entrada/1M
Saída/1M
Cache/1M
16K
$1.25
$5.00
16K
$2.50
$10.00
16K
$2.50
$2.50
400K
$1.75
$14.00
$0.875
400K
$1.75
$14.00
$0.875
400K
$1.75
$14.00
$0.875
922K
$2.50
$15.00
$1.25
400K
$0.750
$4.50
$0.375
400K
$0.200
$1.25
$0.100
922K
$30.00
$180.00
$15.00
922K
$5.00
$30.00
$0.500
1.1M
$30.00
$180.00
1.1M
$5.00
$30.00
$0.500
1.1M
$1.00
$6.00
$0.100
1.1M
$5.00
$30.00
$0.500
1.1M
$2.50
$15.00
$0.250
$5.00
$40.00
$2.00
$8.00
$5.00
$32.00
$5.00
$30.00
$4.00
$16.00
$0.400
$4.00
$24.00
$0.400
$0.600
$2.40
$0.060
$0.006/min

Anthropic

9 modelos
Claude · contexto longo, ferramentas confiáveis
Modelo · Capacidades
Contexto
Entrada/1M
Saída/1M
Cache/1M
200K
$10.00
$50.00
$1.00
200K
$1.00
$5.00
$0.100
200K
$5.00
$25.00
$0.500
1M
$5.00
$25.00
$0.500
1M
$5.00
$25.00
$0.500
1M
$5.00
$25.00
$0.500
200K
$3.00
$15.00
$0.300
1M
$3.00
$15.00
$0.300
1M
$2.00
$10.00
$0.200

Google

15 modelos
Gemini · multimodal, contexto amplo
Modelo · Capacidades
Contexto
Entrada/1M
Saída/1M
Cache/1M
$0.016/min
$0.016/min
1.0M
$0.300
$2.50
$0.030
$0.300
$30.00
1.0M
$0.100
$0.400
$0.010
$0.500
$2.00
1.0M
$1.25
$10.00
$0.125
1.0M
$0.500
$3.00
$0.050
$2.00
$120.00
$0.500
$60.00
$0.250
$30.00
1.0M
$0.250
$1.50
$0.750
$4.50
1.0M
$2.00
$12.00
$0.200
1.0M
$1.50
$9.00
$0.150

Alibaba

19 modelos
Qwen · custo-eficiente, pesos abertos
Modelo · Capacidades
Contexto
Entrada/1M
Saída/1M
Cache/1M
$0.002/min
$0.002/min
$0.002/min
$0.002/min
$0.002/min
$0.04/call
$0.07/call
$0.002/min
$0.002/min
256K
$1.20+
$6.00
$0.359
256K
$0.050+
$0.400
$0.022
256K
$0.200+
$1.60
$0.143
1.0M
$0.100
$0.400
$0.029
1.0M
$0.400+
$2.40
$0.115
256K
$0.250
$1.50
$0.050
1M
$2.50
$7.50
$0.500
1M
$0.400
$1.60
$0.080
$0.03/call
$0.07/call

DeepSeek

2 modelos
DeepSeek · raciocínio forte, pesos abertos
Modelo · Capacidades
Contexto
Entrada/1M
Saída/1M
Cache/1M
1M
$0.138
$0.275
$0.003
131K
$1.61
$3.22
$0.013

Moonshot

3 modelos
Kimi · contexto longo
Modelo · Capacidades
Contexto
Entrada/1M
Saída/1M
Cache/1M
262K
$0.574
$3.01
$0.115
256K
$0.950
$4.00
$0.190
1M
$3.00
$15.00
$0.300

MiniMax

1 modelo
MiniMax · multimodal, agêntico
Modelo · Capacidades
Contexto
Entrada/1M
Saída/1M
Cache/1M
1M
$0.300
$1.20
$0.060

Z.ai

4 modelos
GLM · bilíngue, uso de ferramentas
Modelo · Capacidades
Contexto
Entrada/1M
Saída/1M
Cache/1M
200K
$1.00
$3.20
$0.200
205K
$1.20
$4.00
$0.240
200K
$1.40
$4.40
$0.260
1.0M
$1.40
$4.40
$0.260

ByteDance

13 modelos
Doubao · inferência de alta vazão
Modelo · Capacidades
Contexto
Entrada/1M
Saída/1M
Cache/1M
262K
$0.250+
$2.00
$0.050
262K
$0.250+
$2.00
$0.050
262K
$0.100+
$0.400
$0.020
262K
$0.500+
$3.00
$0.100
$7.00
$0.002/min
$1.00
$2.40
$0.03/call
$0.04/call
$0.04/call

Notas sobre preços

  • Todos os preços são em USD. A cobrança é baseada no uso real de tokens.
  • Tokens de entrada = seu prompt. Tokens de saída = a resposta do modelo.
  • Preços por faixas: a contagem total de tokens de uma requisição é cobrada à taxa da faixa em que sua entrada se enquadra. Entradas maiores avançam para uma faixa superior.
  • Acerto de cache: quando o mesmo prefixo de prompt é reutilizado (cache de contexto), os tokens de entrada são cobrados à taxa reduzida Cache/1M mostrada acima.
  • Modelos de geração de imagem e áudio são cobrados por chamada de API.
  • Descontos por volume disponíveis para clientes corporativos. Fale conosco.

Encontrou seu modelo? Comece a chamá-lo em 60 segundos.

Obtenha sua API key, grátis

Perguntas frequentes

Como comparo os preços das APIs de LLM entre provedores?

A página de modelos do Synthorai é uma comparação de preços em tempo real entre todos os grandes provedores — ordene por preço de entrada ou saída por milhão de tokens, filtre por provedor, sempre sincronizada com os preços de tabela reais do gateway. Cada valor é exatamente o que uma requisição debita do seu saldo, com 0% de acréscimo de plataforma.

Quais provedores de API de LLM o Synthorai suporta?

O Synthorai é um gateway de IA multimodal: uma API e uma fatura para GPT (OpenAI), Claude (Anthropic), Gemini (Google), Qwen (Alibaba), DeepSeek e mais, em chat, imagem e áudio, com cache de prompts nativo, BYOK e retenção de dados zero por padrão. A tabela acima lista cada modelo com seu preço em tempo real.

Qual é a API de LLM mais barata?

A tabela acima está ordenada por preço de tabela, então você pode escolher o modelo mais barato que atenda ao seu padrão de qualidade. O cache de prompts cobra os acertos de cache a cerca de 10% do preço de entrada, e não há taxa de plataforma — então o custo efetivo costuma ser menor que o de um agregador ao mesmo preço de tabela.