Se você treina ou roda modelos de IA em GPU alugada por hora, uma dúvida aparece cedo: onde ficam, de fato, os seus modelos, datasets e checkpoints? E, mais importante, o que sobrevive quando você desliga a máquina? Este guia organiza o assunto e mostra como evitar rebaixar tudo a cada sessão.
O disco que vem com a máquina é temporário — some ao excluir a instância. Para não perder (nem rebaixar) modelos e dados a cada uso, guarde-os em um disco persistente, que existe fora da máquina e é reaproveitado em qualquer instância nova.
Os dois tipos de armazenamento
Ao alugar uma GPU por hora, você lida com dois armazenamentos diferentes — e confundi-los é a origem de quase todo susto:
| Disco da máquina | Disco persistente | |
|---|---|---|
| O que é | o armazenamento local da instância | um volume independente, seu |
| Sobrevive ao excluir a máquina? | não — é apagado | sim — fica guardado |
| Bom para | sistema, arquivos temporários da sessão | modelos, datasets, checkpoints, resultados |
Onde cada coisa deve ficar
Modelos (pesos)
Os pesos de um modelo podem ter dezenas ou centenas de gigabytes. Baixá-los é o que mais custa tempo (e, portanto, GPU paga). Guarde-os no disco persistente e aponte o cache do seu framework para lá. Assim, o download acontece uma vez; nas próximas máquinas, o modelo já está disponível.
Datasets
Datasets de treino ou avaliação também pertencem ao disco persistente, especialmente os grandes. Para leitura eficiente durante o treino, vale empacotar muitos arquivos pequenos em formatos que a sua biblioteca leia em streaming — evita o gargalo de abrir milhões de arquivos individuais.
Checkpoints
Checkpoints são o coração de um treino longo: são eles que permitem pausar e continuar um fine-tune depois. Salve-os no disco persistente em intervalos regulares. Assim, se você encerrar a máquina (de propósito ou não), retoma do último checkpoint em vez de recomeçar.
Resultados e logs
Saídas geradas, métricas e logs que você quer manter também vão para o disco persistente — do contrário, somem com a máquina.
O erro clássico: guardar tudo no disco temporário
O padrão de muitas máquinas é gravar em uma pasta local que não sobrevive ao encerramento. É fácil trabalhar horas, desligar e só então perceber que o checkpoint e os resultados foram embora. A regra prática: o que você não quer perder mora no disco persistente. O disco da máquina é só rascunho.
Um fluxo que economiza
- Crie um disco persistente uma vez, com folga para os seus modelos e dados.
- Anexe-o à máquina e aponte cache de modelos, datasets e checkpoints para dentro dele.
- Trabalhe. Salve checkpoints com frequência.
- Ao terminar, desligue a máquina — você para de pagar a GPU, e tudo fica guardado.
- Na próxima sessão, anexe o mesmo disco e continue. Nada de baixar de novo.
Esse ciclo troca horas de GPU cara (mantendo máquina ligada ou refazendo setup) por armazenamento barato. É a diferença entre pagar pela placa só quando ela está de fato calculando, e pagar por ela parada.
Como fazer na GPUBrasil
Na GPUBrasil, esse volume é o Disco Persistente, disponível na sua conta em Meus Discos. Crie no tamanho que precisar (de 50 GB a 10 TB), anexe ao criar a instância — GPU ou CPU — e reutilize em qualquer máquina nova. Cobrança em reais, direto do saldo, só pelo tamanho contratado.
Pare de baixar tudo de novo a cada sessão
Na GPUBrasil, o Disco Persistente guarda seus modelos, datasets e checkpoints fora da máquina. Você desliga a GPU quando não usa e retoma em segundos na próxima. Em reais, sem contrato.
Criar meu Disco PersistentePerguntas frequentes
Onde ficam meus modelos ao alugar GPU por hora?
Por padrão, no disco temporário da máquina, que é apagado ao excluí-la. Para mantê-los entre sessões, guarde-os em um disco persistente.
Como não perder o progresso de um treino?
Salve checkpoints com frequência no disco persistente. Se a máquina encerrar, você retoma do último checkpoint em vez de recomeçar.
Qual o tamanho de disco eu preciso?
Depende dos seus modelos e datasets. Some o tamanho dos pesos que você usa, dos datasets e de alguns checkpoints, com uma folga. Na GPUBrasil dá para escolher de 50 GB a 10 TB.
Leia também: as 14 melhores cloud GPUs de 2026 · a crise de memória e o custo da GPU.