Qwen 3.8 27B por token, em reais
Essenciais Geração mais recente da linha, com qualidade acima do modelo econômico pelo mesmo perfil de custo. Boa escolha padrão para conversa e código.
Entrada
R$ 0,69
por 1M de tokens
Saída
R$ 3,99
por 1M de tokens
Onde ele se sai bem
Volume alto com o melhor preço por token do catálogo — classificação, extração e resumo. Janela de contexto de 1.000.000 tokens.
Onde ele não é a melhor escolha
Tarefa em que a qualidade de fronteira muda o resultado; aí compensa pagar mais.
Como usar no GPUBrasil
A API fala o formato da OpenAI. Troque a base_url, use uma chave gpub_live_ e passe gpub-plus no campo model.
from openai import OpenAI
client = OpenAI(
base_url="https://gpubrasil.com.br/v1",
api_key="gpub_live_...",
)
r = client.chat.completions.create(
model="gpub-plus",
messages=[{"role": "user", "content": "Explique o que é um token."}],
)
print(r.choices[0].message.content)
O mesmo endereço funciona em Cursor, Cline, Continue, Zed, Aider, Open WebUI e LibreChat — todos aceitam um endpoint compatível com a OpenAI.
Criar conta e usar →
Ver todos os modelos e preços →
Perguntas frequentes
- Quanto custa o Qwen 3.8 27B no GPUBrasil?
- R$ 0,69 por 1 milhão de tokens de entrada e R$ 3,99 por 1 milhão de tokens de saída, cobrados em reais. Não há assinatura nem mínimo de compra: você paga só os tokens que usar, debitados do mesmo saldo que paga as instâncias de GPU.
- Como uso o Qwen 3.8 27B pela API?
- A API é compatível com a da OpenAI. Aponte a base_url para https://gpubrasil.com.br/v1, use uma chave gpub_live_ e passe gpub-plus no campo model. Funciona com o SDK da OpenAI e com ferramentas como Cursor, Cline, Continue, Zed e Open WebUI sem adaptação.
- Preciso pagar em dólar para usar o Qwen 3.8 27B?
- Não. A cobrança é em reais, por Pix ou cartão nacional. Você não paga o IOF de 3,5% da compra internacional nem o spread de câmbio do emissor do cartão, e o preço em real não muda quando o dólar sobe.
- Qual é a janela de contexto do Qwen 3.8 27B?
- 1.000.000 tokens. Esse é o tamanho máximo somando o que você envia e o que o modelo responde numa mesma chamada.
Modelos parecidos