InícioModelos de IA › Gemini 3.8 Flash

Gemini 3.8 Flash por token, em reais

Fronteira A geração mais recente da linha Gemini na variante rápida. Raciocina antes de responder, e o raciocínio conta como saída — reserve um limite de tokens folgado.

Entrada
R$ 9,45
por 1M de tokens
Saída
R$ 45,90
por 1M de tokens
Contexto
128.000
tokens

Onde ele se sai bem

Contexto longo e tarefas multimodais, com custo baixo por token na variante Flash. Janela de contexto de 128.000 tokens.

Onde ele não é a melhor escolha

Trabalho agêntico de muitas etapas, em que as outras famílias costumam ir melhor.

O que muda pagando em reais

Comprando direto do fabricante você paga em dólar e soma duas coisas que não estão na tabela dele: o IOF de 3,5% da compra internacional e o spread de câmbio do emissor do cartão, que costuma somar de 2% a 4% e não vem discriminado na fatura. Aqui a cobrança é em reais, por Pix ou cartão nacional, sem nenhum dos dois.

O preço em real também é travado: quando o dólar sobe, o custo do fabricante sobe junto na sua fatura e o daqui não.

Como usar no GPUBrasil

A API fala o formato da OpenAI. Troque a base_url, use uma chave gpub_live_ e passe gemini-3.8-flash no campo model.

from openai import OpenAI

client = OpenAI(
    base_url="https://gpubrasil.com.br/v1",
    api_key="gpub_live_...",
)

r = client.chat.completions.create(
    model="gemini-3.8-flash",
    messages=[{"role": "user", "content": "Explique o que é um token."}],
)
print(r.choices[0].message.content)

O mesmo endereço funciona em Cursor, Cline, Continue, Zed, Aider, Open WebUI e LibreChat — todos aceitam um endpoint compatível com a OpenAI.

Criar conta e usar →   Ver todos os modelos e preços →

Perguntas frequentes

Quanto custa o Gemini 3.8 Flash no GPUBrasil?
R$ 9,45 por 1 milhão de tokens de entrada e R$ 45,90 por 1 milhão de tokens de saída, cobrados em reais. Não há assinatura nem mínimo de compra: você paga só os tokens que usar, debitados do mesmo saldo que paga as instâncias de GPU.
Como uso o Gemini 3.8 Flash pela API?
A API é compatível com a da OpenAI. Aponte a base_url para https://gpubrasil.com.br/v1, use uma chave gpub_live_ e passe gemini-3.8-flash no campo model. Funciona com o SDK da OpenAI e com ferramentas como Cursor, Cline, Continue, Zed e Open WebUI sem adaptação.
Preciso pagar em dólar para usar o Gemini 3.8 Flash?
Não. A cobrança é em reais, por Pix ou cartão nacional. Você não paga o IOF de 3,5% da compra internacional nem o spread de câmbio do emissor do cartão, e o preço em real não muda quando o dólar sobe.
Qual é a janela de contexto do Gemini 3.8 Flash?
128.000 tokens. Esse é o tamanho máximo somando o que você envia e o que o modelo responde numa mesma chamada.

Modelos parecidos

GPT-5.4 nanoGPT-5.6 LunaGemini 3.1 Flash Liteo4-miniGemini 3.5 Flash LiteClaude Sonnet 4.6