// Hospedagem AI self-hosted

AI self-hosted, privado e sem pagar tokens.

Ollama, Open WebUI, Whisper e ComfyUI rodando em um VPS europeu. Modelos Llama, Qwen, DeepSeek e companhia rodando local — custo fixo, dados sob RGPD, sem filtros corporativos.

Sem cobrança por tokenDados na EuropaModelos open-weightSem fidelidade
// Por que AI self-hosted

Custo fixo, seus dados, modelos sem filtros corporativos.

Self-hostar LLMs muda três coisas: você para de pagar por token, seus prompts não saem do seu disco, e escolhe modelos open-weight sem políticas externas — incluídos uncensored se precisar. PulsarHost te dá o VPS europeu para isso.

Custo fixo vs pagar por token

OpenAI e Anthropic cobram por cada token de entrada e saída. Com 5-10 milhões de tokens/mês você facilmente vai parar em 100-300€/mês. Aqui você paga o VPS e roda tudo que a máquina aguentar — ilimitado e previsível.

Privacidade real, dados sob RGPD

Seus prompts, embeddings e arquivos ficam só no seu disco NVMe. Nada sai do VPS — nem para OpenAI, nem Anthropic, nem Google. Servidores físicos em Amsterdã (Países Baixos, UE), datacenter Tier III, dados sob jurisdição europeia.

Modelos open-weight, os últimos

Llama 3.x, Qwen 2.5, Mistral, DeepSeek, Gemma 2, Phi-4. Também uncensored como Hermes ou Dolphin se quiser sair do jardim murado dos modelos corporativos. Catálogo completo em ollama.com/library.

// Qual plano escolher

Três níveis conforme o tamanho do modelo.

LLMs em CPU escalam com RAM. 8B Q4 cabe em 12GB (Pulsar Pro). 70B Q4 cabe em 48GB (Pulsar Max ★ — o sweet spot real para AI self-hosted sério). 70B Q5 + ComfyUI batch em 64GB (Pulsar Ultra). Velocidades realistas, sem marketing.

Pulsar Pro
Llama 8B local · Whisper · embeddings
4 vCPU · 12 GB RAM · 50 GB NVMe
22,99€ a cada 30 dias+ IVA (UE)
27,82€ com IVA da Espanha (21 %)
  • Llama 3 8B Q4 a 8-15 tokens/s
  • Open WebUI estilo ChatGPT incluído
  • Whisper transcrição + RAG leve
Começar
★ Recomendado
Pulsar Max
Llama 70B Q4 · Open WebUI · RAG sério
12 vCPU · 48 GB RAM · 125 GB NVMe
67,99€ a cada 30 dias+ IVA (UE)
82,27€ com IVA da Espanha (21 %)
  • Llama 3.1 70B Q4 cabe confortável (48GB)
  • Qualidade próxima do GPT-4 sem pagar tokens
  • Async/batch a 1-3 t/s · ideal RAG e resumos
Começar
Pulsar Ultra
70B Q5 + ComfyUI batch · multi-modelo
16 vCPU · 64 GB RAM · 200 GB NVMe
97,99€ a cada 30 dias+ IVA (UE)
118,57€ com IVA da Espanha (21 %)
  • 70B Q5 com folga para contexto longo
  • ComfyUI / SD batch (não interativo)
  • Orquestração multi-modelo + workers
Começar
// Perguntas frequentes AI Self-Hosted

O realista, sem prometer demais.

Self-hostar AI é ótimo — mas vale saber o que funciona bem em CPU e o que precisa de GPU. Respostas sem fumaça. Se faltar alguma, escreva para info@pulsarhost.es.

É realista rodar LLMs em CPU sem GPU?
Depende do modelo e do uso. Llama 3 8B Q4 roda a 8-15 tokens/s no Pulsar Pro/Max — viável para chat pessoal e batch. Llama 70B Q4 a 1-3 tokens/s no Pulsar Max/Ultra — viável para async (resumos, RAG, geração batch). Para chat interativo fluido na velocidade do GPT-4 precisa de GPU; PulsarHost é CPU-only hoje. Se seu caso pede GPU, escreva e te orientamos.
Que privacidade tenho vs ChatGPT ou OpenAI?
Seus prompts, embeddings e arquivos ficam só no seu disco NVMe. Nada sai do VPS — nem para OpenAI, nem Anthropic, nem Google. Servidores físicos em Amsterdã (Países Baixos, UE), datacenter Tier III, dados sob RGPD europeu. Os dados da sua conta ficam à parte: o site e o painel de cliente são hospedados na Vercel (EUA) e o banco de dados do painel fica em Frankfurt (Alemanha, UE), embora o provedor dele, assim como o de pagamentos, também possa tratar dados nos EUA. Consulte a política de privacidade. Você pode rodar modelos uncensored (Hermes, Dolphin) sem políticas externas. Você decide o que entra e o que sai.
Que modelos o Ollama suporta?
Qualquer GGUF — Llama 3.x (8B / 70B / 405B), Qwen 2.5 (7B/14B/32B/72B), Mistral, DeepSeek (V2/V3, Coder), Gemma 2, Phi-4, Hermes/Dolphin uncensored. Troca de modelo com `ollama pull <name>`. Catálogo completo em ollama.com/library. Open WebUI te dá UI estilo ChatGPT para tudo.
ComfyUI ou Stable Diffusion funciona?
Sim, mas em CPU é lento — segundos a minutos por imagem conforme resolução e modelo. Útil para batch ou treinamento leve LoRA; não recomendado para uso interativo. Se vem para gerar imagens em tempo real estilo Midjourney/DALL-E, precisa de GPU (não oferecemos GPU dedicada ainda).

Seu AI, no seu VPS, sem contadores de tokens.

Pulsar Pro a partir de 22,99€. Llama 8B local · Open WebUI · Whisper. Sem fidelidade, dados na Europa.

Começar agora