CUDA 12
CUDA 12.4/12.6 + cuDNN önceden yüklü. Başlatın, ssh ile bağlanın, nvidia-smi çalıştırın.
AI eğitimi, çıkarım, görüntü ve video üretimi için NVIDIA RTX 4090, RTX 5090 ve H100 SXM5 GPU sunucuları. CUDA 12 ve cuDNN önceden yüklü; ayrıca ssh ile bağlanmaya hazır PyTorch / ComfyUI / Ollama imaj ön ayarları. H100 kademelerinde tam PCIe Gen 5 hat sayısı için Threadripper Pro ana makineler. 4 offshore yargı alanında mevcut; KYC yok, Monero dahil 8 coin ile yalnızca kripto ödeme.
Her yargı bölgesinde aynı NVIDIA donanımı ve her planda sınırsız bant genişliği. Fiyatlandırma yargı bölgesine göre değişir — İzlanda en düşük karbonlu seçenek, Moldova en ucuzu.
| Paket | GPU | VRAM | CPU | RAM | NVMe | Bant Genişliği | Fiyat | |
|---|---|---|---|---|---|---|---|---|
| IS-S | 1× NVIDIA RTX 4090 | 24 GB GDDR6X | 12 vCPU | 64 GB DDR5 | 1 TB NVMe | Sınırsız | $146.50/mo | Sipariş |
| IS-M Popüler | 1× NVIDIA RTX 5090 | 32 GB GDDR7 | 16 vCPU | 96 GB DDR5 | 1.5 TB NVMe | Sınırsız | $234.50/mo | Sipariş |
| IS-L | 1× NVIDIA H100 SXM5 | 80 GB HBM3 | 24 vCPU | 192 GB DDR5 | 2 TB NVMe | Sınırsız | $906.00/mo | Sipariş |
| IS-XL | 2× NVIDIA H100 SXM5 | 160 GB HBM3 | 32 vCPU | 384 GB DDR5 | 4 TB NVMe | Sınırsız | $1714.50/mo | Sipariş |
| Paket | GPU | VRAM | CPU | RAM | NVMe | Bant Genişliği | Fiyat | |
|---|---|---|---|---|---|---|---|---|
| MD-S | 1× NVIDIA RTX 4090 | 24 GB GDDR6X | 12 vCPU | 64 GB DDR5 | 1 TB NVMe | Sınırsız | $122.00/mo | Sipariş |
| MD-M Popüler | 1× NVIDIA RTX 5090 | 32 GB GDDR7 | 16 vCPU | 96 GB DDR5 | 1.5 TB NVMe | Sınırsız | $195.50/mo | Sipariş |
| MD-L | 1× NVIDIA H100 SXM5 | 80 GB HBM3 | 24 vCPU | 192 GB DDR5 | 2 TB NVMe | Sınırsız | $832.50/mo | Sipariş |
| MD-XL | 2× NVIDIA H100 SXM5 | 160 GB HBM3 | 32 vCPU | 384 GB DDR5 | 4 TB NVMe | Sınırsız | $1567.50/mo | Sipariş |
| Paket | GPU | VRAM | CPU | RAM | NVMe | Bant Genişliği | Fiyat | |
|---|---|---|---|---|---|---|---|---|
| RO-S | 1× NVIDIA RTX 4090 | 24 GB GDDR6X | 12 vCPU | 64 GB DDR5 | 1 TB NVMe | Sınırsız | $132.00/mo | Sipariş |
| RO-M Popüler | 1× NVIDIA RTX 5090 | 32 GB GDDR7 | 16 vCPU | 96 GB DDR5 | 1.5 TB NVMe | Sınırsız | $210.00/mo | Sipariş |
| RO-L | 1× NVIDIA H100 SXM5 | 80 GB HBM3 | 24 vCPU | 192 GB DDR5 | 2 TB NVMe | Sınırsız | $857.00/mo | Sipariş |
| RO-XL | 2× NVIDIA H100 SXM5 | 160 GB HBM3 | 32 vCPU | 384 GB DDR5 | 4 TB NVMe | Sınırsız | $1616.50/mo | Sipariş |
| Paket | GPU | VRAM | CPU | RAM | NVMe | Bant Genişliği | Fiyat | |
|---|---|---|---|---|---|---|---|---|
| NL-S | 1× NVIDIA RTX 4090 | 24 GB GDDR6X | 12 vCPU | 64 GB DDR5 | 1 TB NVMe | Sınırsız | $136.50/mo | Sipariş |
| NL-M Popüler | 1× NVIDIA RTX 5090 | 32 GB GDDR7 | 16 vCPU | 96 GB DDR5 | 1.5 TB NVMe | Sınırsız | $220.00/mo | Sipariş |
| NL-L | 1× NVIDIA H100 SXM5 | 80 GB HBM3 | 24 vCPU | 192 GB DDR5 | 2 TB NVMe | Sınırsız | $881.50/mo | Sipariş |
| NL-XL | 2× NVIDIA H100 SXM5 | 160 GB HBM3 | 32 vCPU | 384 GB DDR5 | 4 TB NVMe | Sınırsız | $1665.50/mo | Sipariş |
GPU barındırma, lansmanda 4 yargı alanında sunuluyor (İzlanda, Hollanda, Romanya, Moldova). Rusya, NVIDIA ihracat yaptırımları nedeniyle hariç; İsviçre ve Panama şimdilik yalnızca Linux olarak kalıyor.
CUDA 12.4/12.6 + cuDNN önceden yüklü. Başlatın, ssh ile bağlanın, nvidia-smi çalıştırın.
Ödenmiş siparişten nvidia-smi çıktısına 60 saniyeden kısa sürede.
Hızlı veri kümesi I/O'su için DDR5 RAM ile eşleştirilmiş, 4 TB'a kadar NVMe SSD.
Tam root SSH, ayrıca 8888 portunda token doğrulamalı, önceden bağlanmış JupyterLab.
H100 üzerinde LoRA / QLoRA / tam FT ile Llama, Mistral, Qwen, DeepSeek ince ayarı. Ya da üretimde model sunumu için vLLM / TGI / Ollama ile kendi barındırdığınız çıkarım.
ComfyUI veya Forge ile Stable Diffusion, FLUX.1, SDXL. Kendi LoRA'nızı eğitin, büyük ölçekte toplu üretim yapın veya kendi çıkarım uç noktanızı barındırın.
OpenSora, CogVideoX, Wan-2.1, AnimateDiff. Video üretimi ciddi VRAM ister — RTX 5090 (32 GB) veya H100 (80 GB) ile başlayın.
İnce ayarlı modelleri kendi API'nizin arkasında yayına alın. Öngörülebilir maliyetler, token başına ücret yok, verileriniz yargı alanınızdan çıkmaz. JupyterLab + FastAPI dahil.
İstediğiniz seçenekleri sipariş sırasında işaretleyin; GPU sunucunuz, yığın kurulmuş, yapılandırılmış ve systemd üzerinden başlatılmış olarak açılır. 30–60 dakikalık HuggingFace indirmesini de atlamak için aşağıdan önceden indirilen modelleri etkinleştirin.
Production-grade LLM serving with continuous batching and paged attention. Exposes an /v1/completions endpoint compatible with the OpenAI SDK.
Self-hosted ChatGPT-style web UI. Pulls Ollama-native quantized weights; easiest path to "talk to my LLM in a browser".
Gradio UI with broad backend support — Transformers, ExLlamaV2, llama.cpp, AWQ, GPTQ. Power-user choice for benchmarking quantizations.
HuggingFace Text Generation Inference — production server with token streaming, tensor parallelism, paged attention.
YAML-config driven finetuning. Supports LoRA, QLoRA, full FT, DPO, ORPO. Pre-cloned to /opt/axolotl with starter configs for Llama / Qwen / Mistral.
2× faster + 70% less VRAM finetuning via custom Triton kernels. Ideal for budget runs on RTX 4090. Pre-installed in /opt/unsloth.
WebUI-driven finetuning platform. SFT / RLHF / DPO / KTO. Good entry point for non-coders who want to finetune on a UI.
Node-graph image-gen interface, ships with FLUX.1-schnell + Kontext workflows. Power-user image generation pipeline.
The mainstream Stable Diffusion WebUI. Stable Diffusion 3.5 + extensions ecosystem. Familiar UI for users coming from civitai.
A1111 fork optimized for FLUX, faster sampling, lower VRAM. Drop-in replacement for users coming from Auto1111.
GUI for training Stable Diffusion / FLUX LoRA, DreamBooth, textual inversion. Trains a custom-style LoRA on RTX 4090 in 30-90 min.
ComfyUI with video-gen workflows preloaded — Wan 2.2 T2V, HunyuanVideo, LTX-Video. Needs 40+ GB VRAM for usable speed at 720p.
Lightweight video workflows — CogVideoX-5B, Wan 2.1 1.3B, LTX-Video. Runs on a single RTX 4090.
OpenAI Whisper Large v3 Turbo with faster-whisper backend behind a /transcribe HTTP API. 8× faster than v3, 99 langs, real-time on any GPU.
Multi-model TTS endpoint serving Kokoro 82M (54 voices, 8 langs) and Sesame CSM-1B (conversational with context). REST + WebSocket streaming.
Always installed. PyTorch 2.5 + CUDA 12.4 + Transformers + diffusers + accelerate + bitsandbytes + xformers + flash-attn. The universal AI dev baseline.
VSCode running in your browser, full Python/IPython/extensions. For users who prefer IDE workflow over notebooks.
Aynı GPU üzerinde birden fazla yığını birleştirin — deploy betiği bağımlılık çakışmalarını çözer ve çakışmayan portlar atar.
İhtiyacınız olan modelleri sipariş sırasında işaretleyin; siz giriş yapmadan önce /root/.cache/huggingface altına önbelleğe alınırlar. 🔒 Gated modeller (Llama, Mistral, Gemma, FLUX-dev, SD 3.5) HuggingFace token'ınızı gerektirir (o da sipariş sırasında istenir).
| Model | HuggingFace | Size | Min VRAM | Min GPU kademesi | Tür |
|---|---|---|---|---|---|
| Llama 3.3 70B Instruct 🔒 Kısıtlı | meta-llama/Llama-3.3-70B-Instruct |
140 GB | 160 GB | GPU-L | LLM |
| Qwen3 32B | Qwen/Qwen3-32B |
64 GB | 80 GB | GPU-L | LLM |
| Qwen3 14B | Qwen/Qwen3-14B |
28 GB | 32 GB | GPU-S | LLM |
| Qwen3 8B | Qwen/Qwen3-8B |
16 GB | 20 GB | GPU-S | LLM |
| DeepSeek-R1 Distill Qwen 32B | deepseek-ai/DeepSeek-R1-Distill-Qwen-32B |
64 GB | 80 GB | GPU-S | LLM |
| DeepSeek-R1 Distill Llama 70B | deepseek-ai/DeepSeek-R1-Distill-Llama-70B |
140 GB | 160 GB | GPU-S | LLM |
| Mistral Small 3.2 24B (multimodal) | mistralai/Mistral-Small-3.2-24B-Instruct-2506 |
48 GB | 60 GB | GPU-S | LLM |
| Gemma 3 27B (multimodal) 🔒 Kısıtlı | google/gemma-3-27b-it |
54 GB | 64 GB | GPU-L | LLM |
| Gemma 3 12B (multimodal) 🔒 Kısıtlı | google/gemma-3-12b-it |
24 GB | 28 GB | GPU-S | LLM |
| Phi-4 (14B) | microsoft/phi-4 |
28 GB | 32 GB | GPU-S | LLM |
| Phi-4 Mini Instruct (3.8B) | microsoft/Phi-4-mini-instruct |
8 GB | 10 GB | GPU-S | LLM |
| FLUX.1 [dev] 🔒 Kısıtlı | black-forest-labs/FLUX.1-dev |
24 GB | 24 GB | GPU-S | Görüntü |
| FLUX.1 [schnell] | black-forest-labs/FLUX.1-schnell |
24 GB | 24 GB | GPU-S | Görüntü |
| FLUX.1 Kontext [dev] (image editing) 🔒 Kısıtlı | black-forest-labs/FLUX.1-Kontext-dev |
24 GB | 24 GB | GPU-S | Görüntü |
| Stable Diffusion 3.5 Large 🔒 Kısıtlı | stabilityai/stable-diffusion-3.5-large |
16 GB | 18 GB | GPU-S | Görüntü |
| Stable Diffusion 3.5 Medium 🔒 Kısıtlı | stabilityai/stable-diffusion-3.5-medium |
5 GB | 10 GB | GPU-S | Görüntü |
| HiDream-I1 Full | HiDream-ai/HiDream-I1-Full |
34 GB | 40 GB | GPU-S | Görüntü |
| Wan 2.2 T2V A14B | Wan-AI/Wan2.2-T2V-A14B |
28 GB | 40 GB | GPU-S | Video |
| Wan 2.1 T2V 1.3B (low VRAM) | Wan-AI/Wan2.1-T2V-1.3B |
3 GB | 8 GB | GPU-S | Video |
| HunyuanVideo 1.5 (8.3B) | tencent/HunyuanVideo-1.5 |
17 GB | 24 GB | GPU-S | Video |
| LTX-Video 0.9.8 13B | Lightricks/LTX-Video |
26 GB | 24 GB | GPU-S | Video |
| CogVideoX-5B | zai-org/CogVideoX-5b |
10 GB | 16 GB | GPU-S | Video |
| Whisper Large v3 Turbo | openai/whisper-large-v3-turbo |
2 GB | 4 GB | GPU-S | Ses |
| Whisper Large v3 | openai/whisper-large-v3 |
3 GB | 6 GB | GPU-S | Ses |
| Kokoro 82M (TTS) | hexgrad/Kokoro-82M |
1 GB | 2 GB | GPU-S | Ses |
| Sesame CSM-1B (conversational TTS) | sesame/csm-1b |
2 GB | 6 GB | GPU-S | Ses |
| Stable Audio Open 1.0 🔒 Kısıtlı | stabilityai/stable-audio-open-1.0 |
3 GB | 8 GB | GPU-S | Ses |
Boyutlar FP16 ağırlıklarıdır. 70B modellerde RTX 4090 (24 GB VRAM) için AWQ nicemlenmiş varyant paralel olarak otomatik indirilir.
Yalnızca kripto ödeme, yerel Monero, yalnızca token ile kayıt, önceden kurulu AI yığınları, önceden indirilmiş HuggingFace modelleri, şifrelenmiş HF token'ları, otomatik Let's Encrypt uç noktaları, kotasız bant genişliği ve İzlanda'da %100 yenilenebilir enerji — ServPrivate satırını okuyun ve kararı kendiniz verin.
| Özellik | ServPrivate | Vast.ai | RunPod | Paperspace | Lambda | TensorDock |
|---|---|---|---|---|---|---|
| Yalnızca kripto ile ödeme | ✅ 8 coins | ⚠️ BTC | ⚠️ Gateway | ❌ | ❌ | ⚠️ BTC/ETH/USDT |
| Yerel Monero (XMR) | ✅ | ❌ | ❌ | ❌ | ❌ | ❌ |
| KYC yok, e-posta ile kayıt yok | ✅ Token-only | ⚠️ Email + ID for trust | ⚠️ Email + payment | ❌ Full KYC | ❌ Enterprise KYC | ⚠️ Email + light KYC |
| Önceden yüklü AI yığınları | ✅ 17 templates | ⚠️ Docker BYO | ✅ 100+ | ⚠️ Notebooks only | ⚠️ Lambda Stack only | ⚠️ Docker BYO |
| Sipariş anında önceden indirilmiş modeller | ✅ 27 models | ❌ | ❌ | ❌ | ❌ | ❌ |
| HuggingFace token konumunda sipariş | ✅ Encrypted, used once | ❌ | ❌ | ❌ | ❌ | ❌ |
| SSH key konumunda sipariş | ✅ | ✅ | ✅ | ⚠️ | ✅ | ⚠️ |
| Otomatik kapanma zamanlayıcısı | ✅ 6h-7d | ✅ | ⚠️ Spot only | ❌ | ❌ | ❌ |
| Genel HTTPS endpoint (Let's Encrypt) | ✅ Auto | ⚠️ Manual | ✅ Pods | ✅ | ❌ | ⚠️ Manual |
| Sınırsız bant genişliği | ✅ | ⚠️ Per host | ⚠️ Capped | ⚠️ Capped | ⚠️ Capped | ⚠️ Per host |
| Yenilenebilir enerjili veri merkezi | ✅ Iceland 100% geo+hydro | ❌ Variable | ⚠️ US grid | ⚠️ US grid | ⚠️ US grid | ⚠️ Variable |
| Offshore yetki alanı | ✅ IS / NL / RO / MD | ❌ Distributed P2P | ❌ US-centric | ❌ US | ❌ US-only | ⚠️ Multi-region |
| Korumalı kuru çalışma modu | ✅ ?dry_run=1 | ⚠️ Trial credit | ⚠️ Limited | ⚠️ Free GPU tier | ❌ | ❌ |
| AI-agent / MCP öncelikli | ✅ MCP + REST + x402 | ⚠️ REST | ⚠️ REST | ⚠️ REST | ⚠️ REST | ⚠️ REST |
| Giriş RTX 4090 / ay | $122.00 | ~$216 spot | ~$396 on-demand | n/a | n/a | ~$252 spot |
Karşılaştırma verileri, 2026-05 itibarıyla rakiplerin herkese açık fiyatlandırma sayfalarından ve kayıt akışlarından derlenmiştir. ServPrivate giriş seviyesi RTX 4090 = $249/mo Moldova; rakiplerin "spot" fiyatları eşdeğer donanım için ortalama değerlerdir.
Tam donanım aktarımı. Fiziksel NVIDIA kartın tamamını doğrudan VRAM erişimiyle alırsınız — vGPU dilimi veya zaman paylaşımlı MIG bölümü değil. VM'inizin içindeki nvidia-smi, bare-metal ana bilgisayarla aynı sayıları gösterir. Tam sürücü erişimi, tam CUDA, tam PyTorch / TensorFlow yığını — SR-IOV rezervasyonu yok.
Default image: Ubuntu 22.04 + CUDA 12.4 + cuDNN 9 + NVIDIA driver 550. Diğer hazır images: Ubuntu 24.04 + CUDA 12.6, Ubuntu 22 + PyTorch 2.5, Ubuntu 22 + ComfyUI + Flux, Ubuntu 22 + Ollama + Open WebUI. Kendi stack’inizi kurmak isterseniz vanilla Ubuntu / Debian / AlmaLinux / Rocky de sunulur.
Evet. GPU müşterilerimizin çoğu vLLM / TGI / FastAPI üzerinde herkese açık çıkarım API'leri çalıştırır. GPU sunucuları tam root, öngörülebilir aylık faturalandırma (token başına sürpriz yok) ve sabit bir yargı bölgesi IP ile gelir. Her GPU planında bant genişliği sınırsızdır; ölçüm veya fazla kullanım ücreti ödemeden yüksek trafikli herkese açık uç noktalar sunabilirsiniz.
NVIDIA H100, A100 ve üst düzey RTX kartları (4090 ve üzeri), Rusya'daki veri merkezlerine sevkiyatı yasaklayan ABD Ticaret Bakanlığı ihracat kontrollerine (15 CFR Part 744) ve AB çift kullanım düzenlemelerine tabidir. Tedarik zincirimize uygulanan kontrollerle uyumlu kalmak için bunları Rusya'da sunmuyoruz. Rusya'da offshore Linux VPS veya Dedicated'a ihtiyacınız varsa, bu ürün hatları etkilenmez.
İzlanda veri merkezleri %100 yenilenebilir jeotermal ve hidroelektrik enerjiyle çalışır; soğuk ortam sıcaklığı, sürekli yük altında her biri 700W çeken H100 makinelerinin soğutma yükünü ciddi ölçüde azaltır. Sonuç, piyasadaki en düşük karbonlu offshore GPU işlem gücüdür. Prim fiyat, İzlanda'daki daha yüksek veri merkezi maliyetini ve daha temiz enerji tedarikini karşılar — ESG bilincine sahip AI ekipleri için tek inandırıcı offshore yanıt budur.
Evet. GPU-XL tier, tek kutu içinde NVLink interconnect’e sahip 2× H100 SXM5’tir; aynı makinede FSDP / DeepSpeed Zero-3 / DDP için idealdir. Multi-node training için aynı datacenter’da birden fazla GPU-XL server kiralayabilir ve 10 Gbps uplink üzerinden bağlayabilirsiniz. Henüz 8× H100 cluster nodes sunmuyoruz; training run daha fazla ölçek gerektiriyorsa bizimle iletişime geçin.
Yargı alanınızı seçin, NVIDIA GPU'nuzu seçin, 8 kripto paradan herhangi biriyle ödeyin. JupyterLab 60 saniyeden kısa sürede kullanıma hazır. KYC yok, e-posta yok, telefon yok — sadece bir token.
GPU Planlarını Görüntüle