InícioTemplates › DeepSeek-R1 (full)
🧠 LLM Self-hosted

DeepSeek-R1 completo, em bloco multi-GPU

DeepSeek-R1 completo (671B) — raciocínio SOTA

A partir de
carregando…
máquina mais barata que atende este template
Subir em 1 clique →
Memória de vídeo
700 GB
Instalação
~15 min
Acesso
porta 8000
Cobrança
por hora, em reais

O R1 completo é um modelo de raciocínio de peso pesado e precisa de um bloco de GPUs para caber na memória. Este template já sobe o vLLM com o particionamento configurado — você só escolhe a máquina.

DeepSeek-R1 completo (671B MoE) servido via vLLM com API OpenAI-compatível. Raciocínio de ponta (AIME, matemática, código). ATENÇÃO: exige múltiplas GPUs H100/H200 ou variante quantizada (ajuste tensor-parallel e o modelo). Para 1 GPU, use o template DeepSeek-R1-Distill.

Para que serve

Como subir

  1. Crie sua conta e adicione saldo em reais (Pix ou cartão, sem mensalidade).
  2. No console, escolha o template DeepSeek-R1 (full) e a máquina — o próprio console esconde as que não atendem ao requisito.
  3. Em cerca de 15 minutos a instalação termina e o endereço de acesso aparece no painel, na porta 8000.

Terminou? Basta destruir a máquina: a cobrança para junto. Nada de contrato ou franquia mínima.

Perguntas frequentes

Quanta memória de vídeo?

Da ordem de 700 GB, ou seja, um bloco de oito placas grandes. Verifique a disponibilidade no console antes de reservar.

Existe opção mais barata?

Sim, as versões destiladas rodam em uma única placa de 24 GB com boa parte do resultado.

Quanto tempo até responder?

O download dos pesos é longo. Planeje uma janela de alguns minutos antes do primeiro teste.

DeepSeek-R1 (full) rodando hoje
Você paga só as horas em que a máquina fica ligada.
Subir em 1 clique →

Templates relacionados

vLLM
API OpenAI-compatível pronta para Llama, Qwen, Mistral e mais
TGI (HuggingFace)
Text Generation Inference do HuggingFace — alternativa ao vLLM
LiteLLM Proxy
1 endpoint OpenAI roteando 100+ provedores (cloud + local)
Ollama
Rode DeepSeek, Qwen3, Llama e Mistral com 1 comando