Fronteira A variante leve da geração 6 e o preço por token mais baixo da linha GPT aqui. Para classificar, extrair e responder curto em volume, com latência baixa.
Volume alto com o melhor preço por token do catálogo — classificação, extração e resumo. Janela de contexto de 128.000 tokens.
Tarefa em que a qualidade de fronteira muda o resultado; aí compensa pagar mais.
Comprando direto do fabricante você paga em dólar e soma duas coisas que não estão na tabela dele: o IOF de 3,5% da compra internacional e o spread de câmbio do emissor do cartão, que costuma somar de 2% a 4% e não vem discriminado na fatura. Aqui a cobrança é em reais, por Pix ou cartão nacional, sem nenhum dos dois.
O preço em real também é travado: quando o dólar sobe, o custo do fabricante sobe junto na sua fatura e o daqui não.
A API fala o formato da OpenAI. Troque a base_url, use uma chave gpub_live_ e passe gpt-6-luna no campo model.
from openai import OpenAI
client = OpenAI(
base_url="https://gpubrasil.com.br/v1",
api_key="gpub_live_...",
)
r = client.chat.completions.create(
model="gpt-6-luna",
messages=[{"role": "user", "content": "Explique o que é um token."}],
)
print(r.choices[0].message.content)
O mesmo endereço funciona em Cursor, Cline, Continue, Zed, Aider, Open WebUI e LibreChat — todos aceitam um endpoint compatível com a OpenAI.
Criar conta e usar → Ver todos os modelos e preços →