Finetuning e inferenza di LLM
Finetuning di Llama, Mistral, Qwen, DeepSeek con LoRA / QLoRA / FT completo su H100. Oppure inferenza self-hosted con vLLM / TGI / Ollama per il serving di modelli in produzione.
Server NVIDIA GPU offshore in Paesi Bassi da $136.50/mese. Schede RTX 4090, RTX 5090 e H100 SXM5 in passthrough KVM con root completo. CUDA 12 + cuDNN preinstallati, preset immagine PyTorch / ComfyUI / Ollama pronti per la connessione SSH. Checkout solo in crypto, senza KYC, senza email — solo un token di account.
I Paesi Bassi offrono il calcolo GPU a minore latenza della nostra rete grazie al peering su AMS-IX. Se servi modelli di IA a utenti europei (inferenza sotto i 10ms verso l'Europa occidentale) o scarichi grandi dataset da registri di modelli europei, questa è la località da scegliere. La banda su AMS-IX è anche la più economica per TB della nostra rete.
Tutti i piani includono CUDA 12 + cuDNN preinstallati, SSD NVMe, RAM DDR5, accesso root completo, SSH + JupyterLab e banda illimitata.
| Piano | GPU | VRAM | CPU | RAM | NVMe | Banda | Prezzo | |
|---|---|---|---|---|---|---|---|---|
| NL-S | 1× NVIDIA RTX 4090 | 24 GB GDDR6X | 12 vCPU | 64 GB DDR5 | 1 TB NVMe | Illimitato | $136.50/mo | Ordine |
| NL-M Popolare | 1× NVIDIA RTX 5090 | 32 GB GDDR7 | 16 vCPU | 96 GB DDR5 | 1.5 TB NVMe | Illimitato | $220.00/mo | Ordine |
| NL-L | 1× NVIDIA H100 SXM5 | 80 GB HBM3 | 24 vCPU | 192 GB DDR5 | 2 TB NVMe | Illimitato | $881.50/mo | Ordine |
| NL-XL | 2× NVIDIA H100 SXM5 | 160 GB HBM3 | 32 vCPU | 384 GB DDR5 | 4 TB NVMe | Illimitato | $1665.50/mo | Ordine |
I server GPU eccellono nei carichi di lavoro che scalano con VRAM e tensor core — finetuning e inferenza di LLM, generazione di immagini con diffusione, video con IA e serving di modelli ad alto throughput.
Finetuning di Llama, Mistral, Qwen, DeepSeek con LoRA / QLoRA / FT completo su H100. Oppure inferenza self-hosted con vLLM / TGI / Ollama per il serving di modelli in produzione.
Stable Diffusion, FLUX.1, SDXL con ComfyUI o Forge. Allena il tuo LoRA, genera in batch su larga scala, oppure ospita tu stesso un endpoint di inferenza.
OpenSora, CogVideoX, Wan-2.1, AnimateDiff. La generazione video richiede molta VRAM — parti da RTX 5090 (32 GB) o H100 (80 GB).
Distribuisci modelli fine-tuned dietro la tua API personale. Costi prevedibili, nessuna tariffa per token, nessun dato che lascia la tua giurisdizione. JupyterLab + FastAPI inclusi.
RTX 4090 (24 GB), RTX 5090 (32 GB), H100 SXM5 (80 GB), 2× H100 (160 GB).
Fino a 4 TB NVMe SSD, insieme a RAM DDR5 per I/O rapido sui dataset.
Del ordine pagado al risultato di nvidia-smi in meno di 60 secondi.
SSH con accesso root completo, più JupyterLab preconfigurato sulla porta 8888 con autenticazione a token.
I Paesi Bassi offrono il miglior peering di rete d'Europa tramite AMS-IX. Latenza sotto i 10 ms verso gran parte dell'Europa occidentale, capacità di banda eccellente e un ambiente di hosting storicamente tollerante.
I Paesi Bassi sono membro dell'UE, perciò il GDPR si applica. Senza embargo, ServPrivate non raccoglie dati personali, perciò il conformità del GDPR è integrato in nostra architettura di zero dati. Senza dati personali non ci sono rischio di GDPR.
Estremamente veloci. Il peering AMS-IX offre latenze sotto i 10 ms verso l'Europa occidentale e un'eccellente connettività globale. I nostri server olandesi includono uplink fino a 10 Gbps e banda illimitata.
Leggi rigorose sulla privacy, energia rinnovabile, fuori dall'UE.
Regolamentazione minima, prezzi bassi, cooperatività internazionale minima.
I tribunali hanno annullato le leggi di conservazione di dati. Eccellente connettività con l'UE.
Paga con BTC, XMR, ETH, USDT o altre 5 coin. SSH + JupyterLab in una GPU NVIDIA reale in Paesi Bassi in meno di 60 secondi.