Alugue H200, H100 e A100 por hora, ou chame Claude, GPT e Gemini por token. Tudo cobrado em reais, sem contrato e sem espera.
As GPUs mais poderosas para suas cargas de trabalho de IA e HPC
A GPU mais poderosa para inferência de LLMs
Adicione R$ 100 e receba R$ 12 de crédito extra · R$ 300 recebe R$ 25
Criar conta grátis →
Alto desempenho para treinamento e inferência
Melhor custo-benefício para workloads de ML
Ideal para renderização e criação de conteúdo
A geração Blackwell para treino e inferência de fronteira
O topo da linha, para os modelos maiores
Para visualização e design
Para desenvolvimento e testes
Veja todas as opções disponíveis, com specs e preço por hora
Confira todos os modelos disponíveis, configurações e preços
| Modelo | vRAM | vCPU | RAM | Regiões | Preço/Hora | |
|---|---|---|---|---|---|---|
NVIDIA B300Blackwell Ultra • SXM6 |
288 GB HBM3e | 43 | 503 GB |
Global
|
R$ 62,73 /h | Criar |
NVIDIA B200Blackwell • SXM6 |
180 GB HBM3e | 24 | 188 GB |
Global
|
R$ 53,98 /h | Criar |
NVIDIA H200Hopper • SXM5 |
141 GB HBM3e | 128 | 512 GB |
América do Norte
|
R$ 25,83 /h | Criar |
NVIDIA H100 SXMHopper • SXM5 |
80 GB HBM3 | 96 | 256 GB |
América do Norte
Europa
|
R$ 14,40 /h | Criar |
NVIDIA H100 PCIeHopper • PCIe |
80 GB HBM2e | 64 | 128 GB |
América do Norte
Europa
Ásia-Pacífico
|
R$ 18,45 /h | Criar |
NVIDIA A100Ampere • 80GB |
80 GB HBM2e | 64 | 128 GB |
América do Norte
Europa
|
R$ 14,94 /h | Criar |
NVIDIA A100Ampere • 40GB |
40 GB HBM2e | 48 | 96 GB |
América do Norte
Europa
Ásia-Pacífico
|
R$ 12,87 /h | Criar |
NVIDIA L40SAda Lovelace |
48 GB GDDR6 | 48 | 96 GB |
América do Norte
Europa
|
R$ 8,10 /h | Criar |
NVIDIA L40Ada Lovelace |
48 GB GDDR6 | 48 | 96 GB |
América do Norte
Europa
Ásia-Pacífico
|
R$ 7,65 /h | Criar |
RTX 6000 AdaAda Lovelace |
48 GB GDDR6 | 48 | 96 GB |
América do Norte
|
R$ 6,48 /h | Criar |
NVIDIA A6000Ampere |
48 GB GDDR6 | 32 | 64 GB |
América do Norte
Europa
|
R$ 6,47 /h | Criar |
RTX 4090Ada Lovelace |
24 GB GDDR6X | 32 | 64 GB |
América do Norte
Europa
Ásia-Pacífico
|
R$ 3,60 /h | Criar |
RTX 4080Ada Lovelace |
16 GB GDDR6X | 24 | 48 GB |
América do Norte
Europa
|
R$ 3,60 /h | Criar |
RTX 3090Ampere |
24 GB GDDR6X | 24 | 48 GB |
América do Norte
Europa
Ásia-Pacífico
|
R$ 2,43 /h | Criar |
NVIDIA A4000Ampere |
16 GB GDDR6 | 16 | 32 GB |
América do Norte
Europa
|
R$ 1,80 /h | Criar |
RTX 3080Ampere |
10 GB GDDR6X | 16 | 32 GB |
América do Norte
Europa
|
R$ 1,35 /h | Criar |
RTX 3070Ampere |
8 GB GDDR6 | 28 | 32 GB |
América do Norte
Europa
|
R$ 0,99 /h | Criar |
Claude, GPT e Gemini na mesma API, cobrados em reais. Você não paga os 3,5% de IOF nem o spread do cartão — e o preço fica travado quando o dólar sobe.
| Modelo | Prateleira | Contexto | Entrada / 1M | Saída / 1M | |
|---|---|---|---|---|---|
| Fronteiraos modelos de ponta da Anthropic, OpenAI e Google28 modelos · do mais capaz ao mais acessível | |||||
GPT-5.5 Progpt-5.5-pro |
Fronteira | 128.000 | R$ 306,00 | R$ 1836,00 | Começar |
Claude Fable 5claude-fable-5 |
Fronteira | 1.000.000 | R$ 102,00 | R$ 510,00 | Começar |
Claude Fable 5.1claude-fable-5-1 |
Fronteira | 1.000.000 | R$ 102,00 | R$ 510,00 | Começar |
GPT-6 Astragpt-6-astra |
Fronteira | 128.000 | R$ 102,00 | R$ 510,00 | Começar |
GPT-5.5gpt-5.5 |
Fronteira | 128.000 | R$ 51,00 | R$ 306,00 | Começar |
Claude Opus 4.7claude-opus-4-7 |
Fronteira | 1.000.000 | R$ 51,00 | R$ 255,00 | Começar |
Claude Opus 4.8claude-opus-4-8 |
Fronteira | 1.000.000 | R$ 51,00 | R$ 255,00 | Começar |
Claude Opus 5claude-opus-5 |
Fronteira | 1.000.000 | R$ 51,00 | R$ 255,00 | Começar |
GPT-5.6 Solgpt-5.6-sol |
Fronteira | 128.000 | R$ 40,80 | R$ 204,00 | Começar |
Claude Sonnet 4.6claude-sonnet-4-6 |
Fronteira | 1.000.000 | R$ 30,60 | R$ 153,00 | Começar |
GPT-5.4gpt-5.4 |
Fronteira | 128.000 | R$ 25,50 | R$ 153,00 | Começar |
Gemini 3.1 Progemini-3.1-pro-preview |
Fronteira | 128.000 | R$ 20,40 | R$ 122,40 | Começar |
GPT-5.6 Terragpt-5.6-terra |
Fronteira | 128.000 | R$ 20,40 | R$ 122,40 | Começar |
Claude Sonnet 5claude-sonnet-5 |
Fronteira | 1.000.000 | R$ 20,40 | R$ 102,00 | Começar |
Gemini 3.5 Flashgemini-3.5-flash |
Fronteira | 128.000 | R$ 15,30 | R$ 91,80 | Começar |
o3o3 |
Fronteira | 128.000 | R$ 20,40 | R$ 81,60 | Começar |
Claude Haiku 4.5claude-haiku-4-5 |
Fronteira | 200.000 | R$ 10,20 | R$ 51,00 | Começar |
GPT-5.4 minigpt-5.4-mini |
Fronteira | 128.000 | R$ 7,65 | R$ 45,90 | Começar |
o4-minio4-mini |
Fronteira | 128.000 | R$ 11,22 | R$ 44,88 | Começar |
Gemini 3.6 Flashgemini-3.6-flash |
Fronteira | 128.000 | R$ 7,65 | R$ 38,25 | Começar |
Gemini 3.7 Flashgemini-3.7-flash |
Fronteira | 128.000 | R$ 7,65 | R$ 38,25 | Começar |
Gemini 3.8 Flashgemini-3.8-flash |
Fronteira | 128.000 | R$ 7,65 | R$ 38,25 | Começar |
Gemini 3.1 Flash Imagegemini-3.1-flash-image |
Imagem | — | R$ 0,67 por imagem (aprox.) | Começar | |
Gemini 3.5 Flash Litegemini-3.5-flash-lite |
Fronteira | 128.000 | R$ 3,06 | R$ 25,50 | Começar |
Gemini 3.1 Flash Lite Imagegemini-3.1-flash-lite-image |
Imagem | — | R$ 0,38 por imagem (aprox.) | Começar | |
Gemini 3.1 Flash Litegemini-3.1-flash-lite |
Fronteira | 128.000 | R$ 2,55 | R$ 15,30 | Começar |
GPT-5.4 nanogpt-5.4-nano |
Fronteira | 128.000 | R$ 2,04 | R$ 12,75 | Começar |
GPT-5.6 Lunagpt-5.6-luna |
Fronteira | 128.000 | R$ 2,04 | R$ 12,24 | Começar |
| Confidenciaisrodam em enclave lacrado por hardware14 modelos · do mais capaz ao mais acessível | |||||
Kimi K3gpub-selado-kimi |
Confidencial | 128.000 | R$ 38,95 | R$ 194,90 | Começar |
GLM 5.2gpub-selado-glm52 |
Confidencial | 128.000 | R$ 18,95 | R$ 58,90 | Começar |
GLM 5.1gpub-selado-glm51 |
Confidencial | 128.000 | R$ 17,95 | R$ 55,90 | Começar |
Qwen3.8 27Bgpub-selado-qwen38 |
Confidencial | 128.000 | R$ 5,95 | R$ 43,90 | Começar |
Kimi K2.6gpub-selado-kimi26 |
Confidencial | 128.000 | R$ 6,74 | R$ 39,54 | Começar |
Qwen3.5 397Bgpub-selado-qwen397 |
Confidencial | 128.000 | R$ 5,23 | R$ 34,88 | Começar |
Qwen3.6 27Bgpub-selado-qwen27 |
Confidencial | 128.000 | R$ 3,95 | R$ 26,90 | Começar |
DeepSeek V4 Flashgpub-selado-fast |
Confidencial | 128.000 | R$ 5,39 | R$ 16,16 | Começar |
Qwen3 235B Thinkinggpub-selado-qwen235 |
Confidencial | 128.000 | R$ 3,95 | R$ 15,90 | Começar |
DeepSeek V3.2gpub-selado-deepseek |
Confidencial | 128.000 | R$ 11,63 | R$ 11,63 | Começar |
Gemma 4 31Bgpub-selado-gemma |
Confidencial | 128.000 | R$ 1,95 | R$ 4,90 | Começar |
Qwen3 32Bgpub-selado-qwen32 |
Confidencial | 128.000 | R$ 0,70 | R$ 2,90 | Começar |
Mistral Nemogpub-selado-nemo |
Confidencial | 128.000 | R$ 0,17 | R$ 0,66 | Começar |
Nemotron 3 Nanogpub-selado-nemotron |
Confidencial | 128.000 | R$ 0,15 | R$ 0,60 | Começar |
| Essenciaismodelos de pesos abertos, cobrados por token10 modelos · do mais capaz ao mais acessível | |||||
Kimi K3gpub-max |
Essencial | 1.000.000 | R$ 24,95 | R$ 124,90 | Começar |
GLM 5.3gpub-turbo |
Essencial | 128.000 | R$ 17,14 | R$ 53,86 | Começar |
Ornith 1.5 397Bgpub-ultra |
Essencial | 128.000 | R$ 8,57 | R$ 26,93 | Começar |
GLM 5.2gpub-base |
Essencial | 250.000 | R$ 8,95 | R$ 19,90 | Começar |
FLUX.2 Klein 4Bgpub-imagem |
Imagem | — | R$ 0,19 por imagem | Começar | |
GLM 5.3 Flashgpub-pro |
Essencial | 250.000 | R$ 1,89 | R$ 5,90 | Começar |
Qwen 3.8 27Bgpub-plus |
Essencial | 1.000.000 | R$ 0,69 | R$ 3,99 | Começar |
Qwen 3.6 35Bgpub-mini |
Essencial | 200.000 | R$ 0,69 | R$ 3,90 | Começar |
DeepSeek V4 Flashgpub-fast |
Essencial | 1.000.000 | R$ 0,59 | R$ 1,29 | Começar |
DeepSeek V4.1 Flashgpub-nano |
Essencial | 250.000 | R$ 0,49 | R$ 1,09 | Começar |
Ver a página de cada modelo → · Documentação da API de tokens →
Compatível com o formato da OpenAI: troque a URL base e a chave nas ferramentas que você já usa. O consumo cai no mesmo saldo em reais, com pagamento via Pix e suporte em português.
As mesmas GPUs NVIDIA que você já conhece — RTX 4090, A100, H100 e até H200 — a partir de uma fração do preço. Conectamos você a um marketplace global de GPUs verificadas, sem abrir mão de acesso root, SSH e deploy em segundos.
Preços ao vivo, por hora, em reais — a partir de R$ 0,81/h
Do Kimi K2 ao DeepSeek, Llama 4, Qwen, GLM e Mistral — provisione uma GPU NVIDIA em segundos e rode qualquer LLM open-source, com acesso root e sem filas. Você escolhe o modelo; a gente entrega o poder de processamento.
O MoE de ~1T da Moonshot AI, referência em agentes autônomos e programação. Rode a variante que couber na sua GPU.
DeepSeek V3 e R1: raciocínio de ponta a custo baixo. Um dos modelos open-source mais usados do mundo.
A família da Alibaba, forte em português, código e contexto longo — do 7B ao 235B.
O Llama 4 Scout da Meta, com janela de contexto de até 10 milhões de tokens. Texto e imagem.
A linha GLM da Zhipu, SOTA open-source com 1M de contexto — excelente para agentes e código.
Modelos enxutos e rápidos que rodam até nas GPUs Econômicas — o melhor custo-benefício.
Sem taxas ocultas. Pague apenas pelo que usar.
Pague conforme usa. Desligue a instância quando quiser e pare de pagar imediatamente. Sem compromissos.
Começar AgoraAceitamos Pix e todos os cartões de crédito brasileiros. Sem taxas de conversão ou IOF.
Criar Conta GrátisConfiável desde 2024
Lance instâncias GPU programaticamente e automatize sua infraestrutura de IA. Nossa API oferece controle total sobre todos os recursos.
Ver APISem complicação com dólar. Aceitamos Pix e cartões brasileiros. Sem IOF, sem taxas de conversão escondidas.
Começar com R$ 100Cadastre-se gratuitamente e faça seu primeiro depósito a partir de R$ 100. Ganhe R$ 12 de bônus (ou R$ 25 a partir de R$ 300).
Navegue pelo catálogo de GPUs disponíveis. De RTX 3080 a H200, escolha a que melhor se adapta ao seu workload.
Lance em segundos, automatize e execute treinamento ou inferência em qualquer escala. Pague apenas pelo que usar.
GPUs por hora e modelos de IA por token — o que as pessoas mais perguntam.
https://gpubrasil.com.br/v1 e usa a sua chave gpub_live_. Qualquer SDK ou ferramenta que já fale com a OpenAI funciona sem mudar código. A cobrança é por token, em reais, do mesmo saldo que paga as GPUs — sem assinatura, sem mínimo e sem o IOF da compra internacional.POST /v1/images/generations, no mesmo padrão da OpenAI e com a mesma chave. São três modelos de geração de imagem; a cobrança é por imagem em uns e por token de imagem em outros, e o valor de cada um aparece ao vivo na tabela de preços. Modelos de imagem não atendem no endpoint de chat, e vice-versa.image_url padrão da OpenAI dentro de content, sem mudar nada no seu código. Áudio de entrada também funciona nos modelos que o aceitam, pelo bloco input_audio. Se um modelo não aceitar o que você mandou, a API recusa com um erro que explica o motivo em vez de ignorar a parte que não entendeu.Crie sua conta gratuitamente e tenha acesso às GPUs mais poderosas do mercado.
Criar Conta Grátis →