IA local · GPU sob demanda

Sua IA local. Com VRAM de verdade.

Ollama, Open WebUI, ComfyUI, PyTorch e Jupyter em GPUs com CUDA — a casa da IA local na Rackon. Suba o template, rode o modelo e pague só pelo tempo que a GPU ficar ligada. Independente dos Apps e do Apps Dedicado.

Ollama & RAGCobrança por horaCUDATemplates prontos
GPU
RACKON AIOLLAMA · CUDA · ON DEMAND
OLLAMALLMs locais
OPEN WEBUIchat privado
COMFYUIimagem e vídeo
PYTORCHtreino e fine-tune

Templates prontos para o que importa

O que antes vivia como “IA Local em CPU” agora roda onde faz sentido: com VRAM. Escolha o template, ligue a GPU e trabalhe.

LLM / Chat

Ollama + Open WebUI

Modelos locais com interface de chat. Ideal para atendimento interno, copilots e APIs privadas.

  • Llama, Mistral, Phi e outros
  • API REST + chat no browser
  • Dados no seu ambiente
IDEAL: chat privado · RAG leve · automações com LLM
Imagem / Vídeo

ComfyUI & Diffusion

Pipelines visuais para SDXL, Flux e workflows de geração — com a VRAM que o modelo pede.

  • Workflows ComfyUI
  • Stable Diffusion / Flux
  • Alta paralelismo CUDA
IDEAL: criativos · assets · lotes de imagem
Treino

PyTorch & Jupyter

Notebooks CUDA e stacks de treino/fine-tune quando você precisa experimentar de verdade.

  • Jupyter com CUDA
  • Fine-tune e experimentos
  • Pare a GPU quando terminar
IDEAL: pesquisa · fine-tune · protótipos
Ollama Open WebUI ComfyUI PyTorch Jupyter CUDA Stable Diffusion AnythingLLM Custom image

Apps Dedicado ou Cloud GPU?

Produtos diferentes, propósitos claros. Um isola e-mail e ERP; o outro entrega VRAM para IA.

Apps Dedicado

IP próprio · host gerenciado

Para e-mail, VoIP, ERP e SSO que precisam de IP e RAM exclusivos — sem LLM na máquina.

  • Mailu, FreePBX, Odoo, Authentik
  • 8–32 GB de RAM dedicada
  • Mensalidade fixa
  • Sem acesso root
IDEAL: e-mail · VoIP · ERP · marketing · SSO
Conhecer Apps Dedicado →
Cloud GPU · IA

VRAM e CUDA sob demanda

Para Ollama, geração de imagens, fine-tune e qualquer carga que realmente precisa de GPU.

  • 8 GB a 96 GB+ de VRAM
  • Templates de IA prontos
  • Cobrança por hora
  • Independente dos Apps
IDEAL: LLMs · SDXL/Flux · notebooks · treino
Ver GPUs →

Comece pelas GPUs mais baratas

Buscamos as melhores ofertas disponíveis e ordenamos do menor preço por hora ao maior. O hardware exato varia conforme disponibilidade.

Value

GPU Burst 16

SDXL e modelos médios

Consultando…preço ao vivo da API
  • VRAM14–18 GB
  • UsoImagem e modelos médios
Escolher GPU
Value

GPU Burst 24

Flux e LLMs compactos

Consultando…preço ao vivo da API
  • VRAM22–26 GB
  • UsoGeração e LLM
Escolher GPU

Atualizando ofertas Cloud GPU…

Da escolha ao CUDA em minutos

Catálogo, templates de IA e ciclo de vida próprios — separados dos Apps e do Apps Dedicado.

01

Escolha a VRAM

Selecione a faixa conforme o modelo (7B, 13B, SDXL…).

02

Escolha o template

Ollama, Open WebUI, ComfyUI, PyTorch ou Jupyter.

03

Inicie a instância

Acompanhe IP, acesso e status direto no painel.

04

Pare quando terminar

Você paga por hora; encerre a GPU ao concluir o trabalho.

IA local com a GPU certa — só pelo tempo que usar.

Suba Ollama, ComfyUI ou PyTorch em minutos. Para e-mail, VoIP e ERP com IP próprio, o caminho é Apps Dedicado.