GPUs Preços IA por Token Templates Blog API Contato Login Começar Agora
Todas as GPUs disponíveis

Acesso imediato a mais de mil GPUs NVIDIA e a modelos de IA por token

Alugue H200, H100 e A100 por hora, ou chame Claude, GPT e Gemini por token. Tudo cobrado em reais, sem contrato e sem espera.

Começar Agora Ver GPUs Disponíveis
Pagamento em reais via Pix Sem contrato ou fidelidade Suporte em português

GPUs para Produção

As GPUs mais poderosas para suas cargas de trabalho de IA e HPC

Como funciona alugar GPU por hora →

Crédito extra

Primeira Recarga

Adicione R$ 100 e receba R$ 12 de crédito extra · R$ 300 recebe R$ 25

Criar conta grátis →
NVIDIA H100
⚡ Popular

NVIDIA H100

Alto desempenho para treinamento e inferência

Memória 80 GB HBM3
vCPU 96
R$ 14,40 /hora
NVIDIA A100
💰 Econômico

NVIDIA A100

Melhor custo-benefício para workloads de ML

Memória 80 GB HBM2e
vCPU 64
R$ 8,64 /hora
NVIDIA L40
🎨 Renderização

NVIDIA L40

Ideal para renderização e criação de conteúdo

Memória 48 GB GDDR6
vCPU 48
R$ 7,65 /hora
🚀 Blackwell

NVIDIA B200

A geração Blackwell para treino e inferência de fronteira

Memória 180 GB HBM3e
R$ 53,98 /hora
🚀 Blackwell Ultra

NVIDIA B300

O topo da linha, para os modelos maiores

Memória 288 GB HBM3e
R$ 62,73 /hora
🔧 Profissional

RTX 6000

Para visualização e design

Memória 48 GB
R$ 6,48 /hora
🎮 Gaming

RTX 4090

Para desenvolvimento e testes

Memória 24 GB
R$ 4,95 /hora
📋 Catálogo

+10 GPUs

Veja todas as opções disponíveis, com specs e preço por hora

Ver Todas →

Catálogo Completo de GPUs

Confira todos os modelos disponíveis, configurações e preços

Modelo vRAM vCPU RAM Regiões Preço/Hora

NVIDIA B300

Blackwell Ultra • SXM6
288 GB HBM3e 43 503 GB
Global
R$ 62,73 /h Criar

NVIDIA B200

Blackwell • SXM6
180 GB HBM3e 24 188 GB
Global
R$ 53,98 /h Criar

NVIDIA H200

Hopper • SXM5
141 GB HBM3e 128 512 GB
América do Norte
R$ 25,83 /h Criar

NVIDIA H100 SXM

Hopper • SXM5
80 GB HBM3 96 256 GB
América do Norte Europa
R$ 14,40 /h Criar

NVIDIA H100 PCIe

Hopper • PCIe
80 GB HBM2e 64 128 GB
América do Norte Europa Ásia-Pacífico
R$ 18,45 /h Criar

NVIDIA A100

Ampere • 80GB
80 GB HBM2e 64 128 GB
América do Norte Europa
R$ 14,94 /h Criar

NVIDIA A100

Ampere • 40GB
40 GB HBM2e 48 96 GB
América do Norte Europa Ásia-Pacífico
R$ 12,87 /h Criar

NVIDIA L40S

Ada Lovelace
48 GB GDDR6 48 96 GB
América do Norte Europa
R$ 8,10 /h Criar

NVIDIA L40

Ada Lovelace
48 GB GDDR6 48 96 GB
América do Norte Europa Ásia-Pacífico
R$ 7,65 /h Criar

RTX 6000 Ada

Ada Lovelace
48 GB GDDR6 48 96 GB
América do Norte
R$ 6,48 /h Criar

NVIDIA A6000

Ampere
48 GB GDDR6 32 64 GB
América do Norte Europa
R$ 6,47 /h Criar

RTX 4090

Ada Lovelace
24 GB GDDR6X 32 64 GB
América do Norte Europa Ásia-Pacífico
R$ 3,60 /h Criar

RTX 4080

Ada Lovelace
16 GB GDDR6X 24 48 GB
América do Norte Europa
R$ 3,60 /h Criar

RTX 3090

Ampere
24 GB GDDR6X 24 48 GB
América do Norte Europa Ásia-Pacífico
R$ 2,43 /h Criar

NVIDIA A4000

Ampere
16 GB GDDR6 16 32 GB
América do Norte Europa
R$ 1,80 /h Criar

RTX 3080

Ampere
10 GB GDDR6X 16 32 GB
América do Norte Europa
R$ 1,35 /h Criar

RTX 3070

Ampere
8 GB GDDR6 28 32 GB
América do Norte Europa
R$ 0,99 /h Criar

Compre Tokens Frontier com Desconto

Claude, GPT e Gemini na mesma API, cobrados em reais. Você não paga os 3,5% de IOF nem o spread do cartão — e o preço fica travado quando o dólar sobe.

Sem assinatura Sem IOF nem câmbio Pague só o que usar Uma base URL, todos os modelos
52 modelos · preço por 1 milhão de tokens, em reais
Modelo Prateleira Contexto Entrada / 1M Saída / 1M
Fronteiraos modelos de ponta da Anthropic, OpenAI e Google28 modelos · do mais capaz ao mais acessível

GPT-5.5 Pro

gpt-5.5-pro
Fronteira 128.000 R$ 306,00R$ 1836,00 Começar

Claude Fable 5

claude-fable-5
Fronteira 1.000.000 R$ 102,00R$ 510,00 Começar

Claude Fable 5.1

claude-fable-5-1
Fronteira 1.000.000 R$ 102,00R$ 510,00 Começar

GPT-6 Astra

gpt-6-astra
Fronteira 128.000 R$ 102,00R$ 510,00 Começar

GPT-5.5

gpt-5.5
Fronteira 128.000 R$ 51,00R$ 306,00 Começar

Claude Opus 4.7

claude-opus-4-7
Fronteira 1.000.000 R$ 51,00R$ 255,00 Começar

Claude Opus 4.8

claude-opus-4-8
Fronteira 1.000.000 R$ 51,00R$ 255,00 Começar

Claude Opus 5

claude-opus-5
Fronteira 1.000.000 R$ 51,00R$ 255,00 Começar

GPT-5.6 Sol

gpt-5.6-sol
Fronteira 128.000 R$ 40,80R$ 204,00 Começar

Claude Sonnet 4.6

claude-sonnet-4-6
Fronteira 1.000.000 R$ 30,60R$ 153,00 Começar

GPT-5.4

gpt-5.4
Fronteira 128.000 R$ 25,50R$ 153,00 Começar

Gemini 3.1 Pro

gemini-3.1-pro-preview
Fronteira 128.000 R$ 20,40R$ 122,40 Começar

GPT-5.6 Terra

gpt-5.6-terra
Fronteira 128.000 R$ 20,40R$ 122,40 Começar

Claude Sonnet 5

claude-sonnet-5
Fronteira 1.000.000 R$ 20,40R$ 102,00 Começar

Gemini 3.5 Flash

gemini-3.5-flash
Fronteira 128.000 R$ 15,30R$ 91,80 Começar

o3

o3
Fronteira 128.000 R$ 20,40R$ 81,60 Começar

Claude Haiku 4.5

claude-haiku-4-5
Fronteira 200.000 R$ 10,20R$ 51,00 Começar

GPT-5.4 mini

gpt-5.4-mini
Fronteira 128.000 R$ 7,65R$ 45,90 Começar

o4-mini

o4-mini
Fronteira 128.000 R$ 11,22R$ 44,88 Começar

Gemini 3.6 Flash

gemini-3.6-flash
Fronteira 128.000 R$ 7,65R$ 38,25 Começar

Gemini 3.7 Flash

gemini-3.7-flash
Fronteira 128.000 R$ 7,65R$ 38,25 Começar

Gemini 3.8 Flash

gemini-3.8-flash
Fronteira 128.000 R$ 7,65R$ 38,25 Começar

Gemini 3.1 Flash Image

gemini-3.1-flash-image
Imagem R$ 0,67 por imagem (aprox.) Começar

Gemini 3.5 Flash Lite

gemini-3.5-flash-lite
Fronteira 128.000 R$ 3,06R$ 25,50 Começar

Gemini 3.1 Flash Lite Image

gemini-3.1-flash-lite-image
Imagem R$ 0,38 por imagem (aprox.) Começar

Gemini 3.1 Flash Lite

gemini-3.1-flash-lite
Fronteira 128.000 R$ 2,55R$ 15,30 Começar

GPT-5.4 nano

gpt-5.4-nano
Fronteira 128.000 R$ 2,04R$ 12,75 Começar

GPT-5.6 Luna

gpt-5.6-luna
Fronteira 128.000 R$ 2,04R$ 12,24 Começar
Confidenciaisrodam em enclave lacrado por hardware14 modelos · do mais capaz ao mais acessível

Kimi K3

gpub-selado-kimi
Confidencial 128.000 R$ 38,95R$ 194,90 Começar

GLM 5.2

gpub-selado-glm52
Confidencial 128.000 R$ 18,95R$ 58,90 Começar

GLM 5.1

gpub-selado-glm51
Confidencial 128.000 R$ 17,95R$ 55,90 Começar

Qwen3.8 27B

gpub-selado-qwen38
Confidencial 128.000 R$ 5,95R$ 43,90 Começar

Kimi K2.6

gpub-selado-kimi26
Confidencial 128.000 R$ 6,74R$ 39,54 Começar

Qwen3.5 397B

gpub-selado-qwen397
Confidencial 128.000 R$ 5,23R$ 34,88 Começar

Qwen3.6 27B

gpub-selado-qwen27
Confidencial 128.000 R$ 3,95R$ 26,90 Começar

DeepSeek V4 Flash

gpub-selado-fast
Confidencial 128.000 R$ 5,39R$ 16,16 Começar

Qwen3 235B Thinking

gpub-selado-qwen235
Confidencial 128.000 R$ 3,95R$ 15,90 Começar

DeepSeek V3.2

gpub-selado-deepseek
Confidencial 128.000 R$ 11,63R$ 11,63 Começar

Gemma 4 31B

gpub-selado-gemma
Confidencial 128.000 R$ 1,95R$ 4,90 Começar

Qwen3 32B

gpub-selado-qwen32
Confidencial 128.000 R$ 0,70R$ 2,90 Começar

Mistral Nemo

gpub-selado-nemo
Confidencial 128.000 R$ 0,17R$ 0,66 Começar

Nemotron 3 Nano

gpub-selado-nemotron
Confidencial 128.000 R$ 0,15R$ 0,60 Começar
Essenciaismodelos de pesos abertos, cobrados por token10 modelos · do mais capaz ao mais acessível

Kimi K3

gpub-max
Essencial 1.000.000 R$ 24,95R$ 124,90 Começar

GLM 5.3

gpub-turbo
Essencial 128.000 R$ 17,14R$ 53,86 Começar

Ornith 1.5 397B

gpub-ultra
Essencial 128.000 R$ 8,57R$ 26,93 Começar

GLM 5.2

gpub-base
Essencial 250.000 R$ 8,95R$ 19,90 Começar

FLUX.2 Klein 4B

gpub-imagem
Imagem R$ 0,19 por imagem Começar

GLM 5.3 Flash

gpub-pro
Essencial 250.000 R$ 1,89R$ 5,90 Começar

Qwen 3.8 27B

gpub-plus
Essencial 1.000.000 R$ 0,69R$ 3,99 Começar

Qwen 3.6 35B

gpub-mini
Essencial 200.000 R$ 0,69R$ 3,90 Começar

DeepSeek V4 Flash

gpub-fast
Essencial 1.000.000 R$ 0,59R$ 1,29 Começar

DeepSeek V4.1 Flash

gpub-nano
Essencial 250.000 R$ 0,49R$ 1,09 Começar

Ver a página de cada modelo →  ·  Documentação da API de tokens →

Compatível com o formato da OpenAI: troque a URL base e a chave nas ferramentas que você já usa. O consumo cai no mesmo saldo em reais, com pagamento via Pix e suporte em português.

✦ Novo

GPUs Econômicas

As mesmas GPUs NVIDIA que você já conhece — RTX 4090, A100, H100 e até H200 — a partir de uma fração do preço. Conectamos você a um marketplace global de GPUs verificadas, sem abrir mão de acesso root, SSH e deploy em segundos.

Preços ao vivo, por hora, em reais — a partir de R$ 0,81/h

✓ Pague por hora, em R$ ✓ Acesso root + SSH ✓ Deploy em segundos ✓ Sem contratos, sem espera
Carregando preços ao vivo…
Ver todas as GPUs Econômicas →

Rode os modelos de IA open-source mais poderosos

Do Kimi K2 ao DeepSeek, Llama 4, Qwen, GLM e Mistral — provisione uma GPU NVIDIA em segundos e rode qualquer LLM open-source, com acesso root e sem filas. Você escolhe o modelo; a gente entrega o poder de processamento.

Preços Transparentes

Sem taxas ocultas. Pague apenas pelo que usar.

💳 Pagamento por Hora

Pague conforme usa. Desligue a instância quando quiser e pare de pagar imediatamente. Sem compromissos.

Começar Agora

🇧🇷 Pague em Reais

Aceitamos Pix e todos os cartões de crédito brasileiros. Sem taxas de conversão ou IOF.

Criar Conta Grátis

Feito por
Desenvolvedores,
para Desenvolvedores

Confiável desde 2024

API Completa

Lance instâncias GPU programaticamente e automatize sua infraestrutura de IA. Nossa API oferece controle total sobre todos os recursos.

Ver API

Pague em Reais

Sem complicação com dólar. Aceitamos Pix e cartões brasileiros. Sem IOF, sem taxas de conversão escondidas.

Começar com R$ 100

Comece em Minutos

1

Crie sua Conta

Cadastre-se gratuitamente e faça seu primeiro depósito a partir de R$ 100. Ganhe R$ 12 de bônus (ou R$ 25 a partir de R$ 300).

2

Escolha sua GPU

Navegue pelo catálogo de GPUs disponíveis. De RTX 3080 a H200, escolha a que melhor se adapta ao seu workload.

3

Deploy & Scale

Lance em segundos, automatize e execute treinamento ou inferência em qualquer escala. Pague apenas pelo que usar.

Começar Agora Documentação

Perguntas frequentes

GPUs por hora e modelos de IA por token — o que as pessoas mais perguntam.

Quanto custa alugar uma GPU?
O preço varia por modelo e aparece ao vivo no site, sempre por hora e em reais. As GPUs do tier Econômica começam abaixo de R$ 1,00/hora, e no topo estão H200, B200 e B300. Você paga apenas pelo tempo que usar, sem contrato.
Como posso pagar?
Aceitamos PIX para pagamentos instantâneos em reais. Após o pagamento, seus créditos são adicionados automaticamente.
Quais GPUs estão disponíveis?
Oferecemos NVIDIA H200, H100, A100, L40, RTX 6000, RTX 4090, RTX 4080, RTX 3090 e mais. Todas as GPUs incluem vCPU, RAM e storage dedicados.
Posso rodar modelos open-source como DeepSeek, Llama 4, Qwen e Kimi K2 na GPUBrasil?
Sim. Você aluga uma GPU NVIDIA por hora, com acesso root e SSH, e roda qualquer modelo open-source — DeepSeek, Qwen, Llama 4, Kimi K2, Mistral, GLM e outros — via deploy em 1 clique ou instalação própria.
Qual GPU é recomendada para rodar Llama 4 ou Kimi K2?
Para os modelos maiores (Llama 4, Kimi K2, DeepSeek) recomendamos a NVIDIA H200 ou H100. Modelos menores (Mistral, Qwen 7B) rodam bem em RTX 4090 ou A100, inclusive na aba Econômica, a partir de menos de R$ 1,00 por hora.
A GPUBrasil tem as GPUs NVIDIA B200 e B300 (Blackwell)?
Sim, já estão disponíveis. A B200 (180 GB HBM3e) e a B300 Blackwell Ultra (288 GB HBM3e) podem ser alugadas por hora, em reais, como qualquer outra GPU da plataforma — sem contrato e com acesso root via SSH.
Posso usar Claude, GPT e Gemini pela API da GPUBrasil, pagando em reais?
Sim. A API é compatível com a da OpenAI: você troca a URL base para https://gpubrasil.com.br/v1 e usa a sua chave gpub_live_. Qualquer SDK ou ferramenta que já fale com a OpenAI funciona sem mudar código. A cobrança é por token, em reais, do mesmo saldo que paga as GPUs — sem assinatura, sem mínimo e sem o IOF da compra internacional.
Dá para gerar imagens pela API?
Sim. O endpoint é POST /v1/images/generations, no mesmo padrão da OpenAI e com a mesma chave. São três modelos de geração de imagem; a cobrança é por imagem em uns e por token de imagem em outros, e o valor de cada um aparece ao vivo na tabela de preços. Modelos de imagem não atendem no endpoint de chat, e vice-versa.
A API aceita imagem na entrada (visão)?
Sim, em todos os modelos do catálogo que aceitam imagem — Claude, GPT, Gemini e os de pesos abertos. Use o bloco image_url padrão da OpenAI dentro de content, sem mudar nada no seu código. Áudio de entrada também funciona nos modelos que o aceitam, pelo bloco input_audio. Se um modelo não aceitar o que você mandou, a API recusa com um erro que explica o motivo em vez de ignorar a parte que não entendeu.
Qual a diferença entre alugar uma GPU e usar a API por token?
Alugar a GPU dá a máquina inteira, com acesso root e SSH: você escolhe o modelo, controla os pesos, os logs e os dados, e paga por hora enquanto ela estiver ligada — é o caminho para treinar, fazer fine-tuning, rodar geração de vídeo ou servir um modelo seu. A API por token não exige máquina nenhuma: você chama o modelo e paga só pelos tokens de cada chamada. Muita gente usa os dois, do mesmo saldo.

Pronto para começar?

Crie sua conta gratuitamente e tenha acesso às GPUs mais poderosas do mercado.

Criar Conta Grátis →