InícioModelos de IA › Qwen 3.8 27B

Qwen 3.8 27B por token, em reais

Essenciais Geração mais recente da linha, com qualidade acima do modelo econômico pelo mesmo perfil de custo. Boa escolha padrão para conversa e código.

Entrada
R$ 0,69
por 1M de tokens
Saída
R$ 3,99
por 1M de tokens
Contexto
1.000.000
tokens

Onde ele se sai bem

Volume alto com o melhor preço por token do catálogo — classificação, extração e resumo. Janela de contexto de 1.000.000 tokens.

Onde ele não é a melhor escolha

Tarefa em que a qualidade de fronteira muda o resultado; aí compensa pagar mais.

Como usar no GPUBrasil

A API fala o formato da OpenAI. Troque a base_url, use uma chave gpub_live_ e passe gpub-plus no campo model.

from openai import OpenAI

client = OpenAI(
    base_url="https://gpubrasil.com.br/v1",
    api_key="gpub_live_...",
)

r = client.chat.completions.create(
    model="gpub-plus",
    messages=[{"role": "user", "content": "Explique o que é um token."}],
)
print(r.choices[0].message.content)

O mesmo endereço funciona em Cursor, Cline, Continue, Zed, Aider, Open WebUI e LibreChat — todos aceitam um endpoint compatível com a OpenAI.

Criar conta e usar →   Ver todos os modelos e preços →

Perguntas frequentes

Quanto custa o Qwen 3.8 27B no GPUBrasil?
R$ 0,69 por 1 milhão de tokens de entrada e R$ 3,99 por 1 milhão de tokens de saída, cobrados em reais. Não há assinatura nem mínimo de compra: você paga só os tokens que usar, debitados do mesmo saldo que paga as instâncias de GPU.
Como uso o Qwen 3.8 27B pela API?
A API é compatível com a da OpenAI. Aponte a base_url para https://gpubrasil.com.br/v1, use uma chave gpub_live_ e passe gpub-plus no campo model. Funciona com o SDK da OpenAI e com ferramentas como Cursor, Cline, Continue, Zed e Open WebUI sem adaptação.
Preciso pagar em dólar para usar o Qwen 3.8 27B?
Não. A cobrança é em reais, por Pix ou cartão nacional. Você não paga o IOF de 3,5% da compra internacional nem o spread de câmbio do emissor do cartão, e o preço em real não muda quando o dólar sobe.
Qual é a janela de contexto do Qwen 3.8 27B?
1.000.000 tokens. Esse é o tamanho máximo somando o que você envia e o que o modelo responde numa mesma chamada.

Modelos parecidos

DeepSeek V4 FlashQwen 3.6 35BQwen3.8 Flash NextGLM 5.3 FlashGLM 5.2Ornith 1.5 397B