Fronteira A geração mais recente da linha Gemini na variante rápida. Boa escolha para volume com qualidade.
Contexto longo e tarefas multimodais, com custo baixo por token na variante Flash. Janela de contexto de 128.000 tokens.
Trabalho agêntico de muitas etapas, em que as outras famílias costumam ir melhor.
Comprando direto do fabricante você paga em dólar e soma duas coisas que não estão na tabela dele: o IOF de 3,5% da compra internacional e o spread de câmbio do emissor do cartão, que costuma somar de 2% a 4% e não vem discriminado na fatura. Aqui a cobrança é em reais, por Pix ou cartão nacional, sem nenhum dos dois.
O preço em real também é travado: quando o dólar sobe, o custo do fabricante sobe junto na sua fatura e o daqui não.
A API fala o formato da OpenAI. Troque a base_url, use uma chave gpub_live_ e passe gemini-3.6-flash no campo model.
from openai import OpenAI
client = OpenAI(
base_url="https://gpubrasil.com.br/v1",
api_key="gpub_live_...",
)
r = client.chat.completions.create(
model="gemini-3.6-flash",
messages=[{"role": "user", "content": "Explique o que é um token."}],
)
print(r.choices[0].message.content)
O mesmo endereço funciona em Cursor, Cline, Continue, Zed, Aider, Open WebUI e LibreChat — todos aceitam um endpoint compatível com a OpenAI.
Criar conta e usar → Ver todos os modelos e preços →