Gemini 3.6 Flash
Preços de tabela do provedor: sem margem da plataforma, pagamento por uso. Estes são os preços de tabela oficiais. Clientes autenticados podem ver os preços efetivos com descontos do espaço de trabalho em /console/pricing. Entrada efetiva com taxa de acerto de cache de 70%:$0.555/M. O cache implícito vem ativado por padrão para os modelos Gemini atuais (com desconto automático em acertos de cache), além de uma API explícita CachedContent com cobrança baseada em armazenamento para economia garantida.
Use o Gemini 3.6 Flash em 30 segundos
Compatível com OpenAI: troque a base_url, mantenha seu SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gemini-3.6-flash",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gemini-3.6-flash",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.6-flash",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gemini-3.6-flash",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gemini-3.6-flash")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Sobre o Gemini 3.6 Flash
Gemini 3.6 Flash é um modelo em disponibilidade geral (GA) que a documentação do Google posiciona como inteligência de nível fronteira sustentada para a era agêntica, otimizado para maior velocidade e menor custo — a doc afirma desempenho mais forte em tarefas agênticas e multimodais complexas reduzindo o uso de tokens, a um preço menor que o 3.5 Flash.
- Suporta raciocínio e o conjunto de ferramentas integradas incluindo Computer Use, aceita texto, imagem, vídeo e áudio, com contexto de 1 M de tokens e até 65.536 tokens de saída; a página do modelo sinaliza que temperature, top_p e top_k estão obsoletos e são ignorados a partir desta geração.
- A Synthorai o serve pelo endpoint de chat compatível com OpenAI.
Especificações e limites
| Saída máxima (especificação do fornecedor) | 65,536 |
| Modalidades | text + image + video + audio → text |
| Recursos | tools · structured_output · streaming · vision · batch · caching · reasoning · computer_use |
| Destaques | GA; 1M-token context, 64K max output; thinking plus the full built-in tool suite including Computer Use; officially positioned as stronger on complex agentic and multimodal tasks with lower token usage than 3.5 Flash. Note: temperature/top_p/top_k are deprecated and ignored from this generation. |
| Cache de prompts | automático + explícito · prefixo mínimo de 1,024 tokens |
conforme documentação oficial da Google ↗
Perguntas frequentes
A API do Gemini 3.6 Flash é gratuita para testar?
Sim. Contas novas recebem 10 chamadas de teste e até $1 em créditos gratuitos, sem precisar de cartão. A $1.5/M de tokens de entrada, só esse crédito já cobre cerca de 83 requisições de ~8K tokens ao Gemini 3.6 Flash.
Em que o Gemini 3.6 Flash é melhor?
Inteligência de fronteira mais rápida e barata, além de menor uso de tokens que o 3.5 Flash, segundo o Google e contexto 1 M, Computer Use integrado. Veja a seção Sobre para o quadro completo, extraído das notas de lançamento do próprio fornecedor.
Quanto custa o Gemini 3.6 Flash?
Na Synthorai, o Gemini 3.6 Flash custa $1.5 por milhão de tokens de entrada e $7.5 por milhão de tokens de saída. É o preço de tabela do provedor, sem margem da plataforma. Tokens de entrada em cache são cobrados a $0.15/M.
O Gemini 3.6 Flash suporta cache de prompts?
Sim: o cache automático vem ativado por padrão, com um modo explícito para economia garantida. Tokens de entrada em cache são cobrados a $0.15/M, contra $1.5/M sem cache; os prompts precisam de um prefixo estável de 1,024 tokens para entrar em cache. Guia de cache de prompts →
Como obtenho acesso ao Gemini 3.6 Flash?
Aponte seu SDK da OpenAI existente para base_url="https://synthorai.io/v1", defina model="gemini-3.6-flash" e pronto. Uma única chave de API cobre todos os modelos do gateway.