Sansürsüz AI Barındırma — Kendi LLM'inizi Kendiniz Barındırın
OpenAI, Anthropic, Google ve xAI, barındırdıkları uç noktalarda içerik politikası uygular — ve her istemi güvenlik sınıflandırması, model iyileştirme ve devlet taleplerine yanıt için kaydeder. Kendi GPU makinenizde self-host bunu tersine çevirir: yasal olarak edinebildiğiniz her açık ağırlıklı model yerelde çalışır, çıkarım trafiği ağ katmanımızdan geçmez, istemler kaydedilmez, çıktılar filtrelenmez. ServPrivate, 4 offshore yargı alanında tek tıkla vLLM, Ollama, ComfyUI, Whisper ve Bark şablonlarıyla RTX 4090 / RTX 5090 / H100 SXM5 GPU sunucuları teslim eder.
Burada 'sansürsüz' gerçekte ne anlama geliyor
- Çıkarım kaydı yok — istemleriniz yakalanmaz
- İçerik politikası yok — getirdiğiniz model ağırlıkları olduğu gibi çalışır
- Açık ağırlıklı modeller sipariş anında önceden indirilir
- Varsayılan olarak üçüncü taraf AI API'lerinden yalıtılmıştır
- CUDA 12 + vLLM / Ollama / ComfyUI tek tıkla hazır
"Sansürsüz yapay zeka" sorusu aslında bir egemenlik sorusudur
OpenAI API'sini çağırdığınızda istemleriniz, en az 30 gün (güvenlik sınıflandırmalarında daha uzun) saklanan, işaretlendiğinde güvenlik ekiplerince incelenen ve ABD hukuki sürecine tabi, ABD yargı alanındaki bir kayda girer. Model ayrıca, güvenlik RLHF'sinin eğitildiği çıktı kategorilerini reddeder. Llama-3.3-70B-Instruct'ı (veya abliterated türevini) kendi GPU'nuzda çalıştırdığınızda istemleriniz makinenizden hiç çıkmaz, ret eğitimi yalnızca ağırlıkların getirdiği kadardır ve yargı alanı, makineyi nerede barındırdıysanız orasıdır. İnsanların "sansürsüz yapay zeka" derken kastettiği bu iki katmandır — kayıt yok ve ağırlık seçimi sizde. ServPrivate ikisini de sağlar: çıkarım ağı yakalaması olmayan offshore GPU, artı ağırlıkları incelemeden herhangi bir HuggingFace modelini yükleyen tek tık şablonlar.
Herhangi bir açık ağırlıklı modeli getirin
Llama-3.3, DeepSeek-R1, Qwen3, Mistral-Small-3, Gemma-3, Phi-4, abliterated fork'lar, özel fine-tune'lar — HuggingFace'teki her şey veya kendi .safetensors dosyalarınız. Repo yolunu verirseniz sipariş sırasında önceden indiririz.
Çıkarım trafiği yakalanmaz
Inference kendi GPU'nuzda, KVM misafir sisteminizin içinde çalışır. Model trafiğinizi proxy'lemez, yansıtmaz veya örneklemeyiz. Prompt'larınız ve ürettikleriniz, siz aksine karar verene kadar yerelde kalır.
Offshore yetki alanı
İzlanda (ifade özgürlüğü cenneti, %100 yenilenebilir enerji), Hollanda (en iyi AB peering'i), Romanya (veri saklamaya karşı yargı içtihadı), Moldova (hafif düzenleme, düşük maliyet). Size uyan yasal çerçeveyi seçin.
Genel HTTPS endpoint isteğe bağlı
Sipariş sırasında etkinleştirin; port 443 üzerinde Let's Encrypt + reverse proxy kuralım — vLLM / Ollama instance'ınız 60 saniyeden kısa sürede TLS'li genel bir URL üzerinden erişilebilir olur.
"Sansürsüz yapay zeka" 2026'da gerçekte ne anlama geliyor
"Sansürsüz yapay zeka" terimi bağlama göre üç ayrı anlam taşır. (1) Reddi kaldırılmış ağırlıklar — temel modellerin abliterated / sansürsüz ince ayarlarında (örn. Llama-3.3-70B-abliterated) güvenlik RLHF'si aktivasyon düzenleme veya yönsel ablasyonla kaldırılmıştır; orijinal instruct modelinin reddettiği çıktıları üretirler. (2) Sunum katmanında içerik denetimi yok — aynı modeli, çıkarımın önünde OpenAI tarzı bir politika sınıflandırıcısı olmadan çalıştırmak. (3) İstem/çıktı kaydı yok — girdileriniz ve çıktılarınız makineden hiç çıkmaz ve yukarı akışta hiçbir yerde saklanmaz. ServPrivate (2) ve (3)'ü varsayılan olarak sağlar; (1) için model ağırlıklarını siz getirirsiniz — donanımınızda ne çalıştığını incelemeyiz, filtrelemeyiz.
Self-host edilebilir LLM'lerde güncel 2026 manzarası
Mayıs 2026 itibarıyla açık ağırlıklı ekosistem, birçok görevde barındırılan GPT-4 / Claude / Gemini ile gerçekten rekabet ediyor. DeepSeek-R1 ve Llama-70B'ye damıtılmış hali, çıkarım maliyetinin çok küçük bir kesriyle akıl yürütme kıyaslamalarında GPT-4'ü yakalıyor. Llama-3.3-70B-Instruct genel amaçlı işlerin varsayılan beygiri olmayı sürdürüyor. Qwen3-32B çok dilli tarafta güçlü ve akıl yürütebiliyor. Gemma-3-27B lisans netliği karşılığında yetenekten feragat ediyor. Mistral-Small-3 kod işlerinde hız/kalite dengesinin tatlı noktası. Phi-4 14B sınıfının üzerinde iş çıkarıyor. FLUX.1-dev görsel üretiminde SDXL'in yerini aldı. Whisper-Large-v3 açık ağırlıklı ASR'de lider olmayı sürdürüyor. Hepsi aşağıdaki GPU kademelerinde çalışır — boyutlandırma için GPU satın alma rehberine bakın.
Sansürsüz bir AI sunucusu için operasyonel hijyen
No-KYC GPU box üzerinde inference logging olmasa bile workload içine kimlik sızdırabilirsiniz. Ciddi self-hosters için pratik hijyen: (1) SSH öncesi box’a Tor veya VPN üzerinden bağlanın; (2) GitHub hesabınıza bağlı olmayan yeni SSH key kullanın; (3) public HTTPS endpoint açıyorsanız IP yerine token bazlı rate-limit ve API key ile gate edin; (4) ağırlıkları deploy sonrası HuggingFace hesabınızla çekmek yerine sipariş sırasında inline pre-download edin; (5) hassas prompts için llama.cpp veya vLLM’i isolated network namespace arkasında çalıştırın. Bu pattern’leri guides hub’da belgeliyoruz.
"Sansürsüz" kapsamına ne girer, ne girmez
Kapsam dahilinde: temel modelin güvenlik RLHF eğitiminin reddedeceği NSFW veya siyaseten hassas çıktılar, şiddet içeren kurgusal içerik, ismen anılan kişileri veya hükümetleri eleştiren çıktılar, çift kullanımlı araştırma çıktıları (örn. ders kitabı düzeyinde siber güvenlik, biyoloji, kimya), adversarial istem mühendisliği tonundaki çıktılar. Kullanım politikamızın dışında: CSAM (modelden bağımsız sıfır tolerans), kitlesel can kaybına yönelik KBRN saldırı talimatları (modelden bağımsız), ismen anılan kişilere yönelik hedefli taciz kampanyaları ve ev sahibi ülkenin yasalarının açıkça yasakladığı çıktılar. Neredeyse her şeye modelin kendisi karar verir; kullanım politikası yalnızca en uç vakaları ayırır.
4 offshore yargı alanında sansürsüz AI barındırma
NVIDIA H100 / RTX 4090+ ihracat yaptırımları nedeniyle Rusya GPU serisine dahil değildir.
İzlanda
İfade özgürlüğü için güvenli bölgeGüçlü gizlilik yasaları, yenilenebilir enerji, AB dışında.
Panama
Veri saklama yokVeri saklama yasası yok, çoğu batılı ülkeyle MLAT yok.
Moldova
Uygun maliyetli offshoreHafif regülasyon, düşük fiyatlar, asgari uluslararası işbirliği.
Romanya
Veri saklama karşıtıMahkemeler veri saklama yasalarını iptal etti. Mükemmel AB bağlantısı.
İsviçre
Premium GizlilikSıkı gizlilik yasaları, siyasi tarafsızlık, üst düzey altyapı.
Hollanda
En iyi peeringMükemmel bağlantı, toleranslı barındırma, AMS-IX peering.
Rusya
Batı hukuki baskısına dayanıklıBatı'nın yasal erişiminin dışında. Rus hukukuna tabi.
Sansürsüz AI Barındırma — sık sorulan sorular
01 İstemleri veya model çıktılarını kaydediyor musunuz?
Hayır. GPU box sizin KVM guest’inizdir. Inference traffic’inizi proxy etmeyiz, mirror etmeyiz, sample etmeyiz ve prompt veya completion content’i hiçbir yere forward etmeyiz. Tuttuğumuz tek loglar network-level bandwidth counters ve hypervisor-level uptime / GPU power draw kayıtlarıdır.
02 Burada Llama-3.3-70B-abliterated veya DeepSeek-R1 çalıştırabilir miyim?
Evet. HuggingFace üzerinde legal olarak edinebileceğiniz herhangi bir open-weight model: Llama-3.3-70B-Instruct, abliterated forks, DeepSeek-R1, DeepSeek-R1-Distill-Llama-70B, Qwen3-32B, Gemma-3-27B, Mistral-Small-3, Phi-4 ve diğerleri. HF repo belirtirseniz order sırasında pre-download ederiz; first SSH sonrası manual pull da yapabilirsiniz.
03 Hangi model boyutu hangi GPU kademesine sığar?
Q4 kuantizasyonunda yaklaşık boyutlandırma: RTX 4090 (24 GB) 7B-13B için rahatça, offload acısıyla 27-32B için uygun. RTX 5090 (32 GB) 27B-32B için rahatça, offload ile 70B için uygun. H100 SXM5 (80 GB) Q4-Q5'te 70B için rahatça uygun. Çift H100 (160 GB) FP16'da 70B, Q4'te 120-180B için uygun. /guides/rtx-4090-vs-h100-for-ai-inference adresindeki satın alma rehberinde ayrıntılı iş hacmi sayıları var.
04 Karşıma çıkacak bir içerik politikası var mı?
Modelinizin ürettiği içerik üzerinde platform tarafında bir içerik politikası yok. Kullanım politikamız yalnızca, nasıl üretildiğine bakılmaksızın ev sahibi ülkede yasa dışı olanı yasaklar (CSAM, kitlesel can kaybına yönelik KBRN saldırı talimatları, ismen belirtilen kişilere yönelik hedefli taciz). Geri kalan her şey — NSFW, siyasi, çift kullanımlı araştırma ve adversarial istemlerle üretilmiş çıktılar dahil — çalışır.
05 LLM'imi herkese açık bir URL üzerinden sunabilir miyim?
Evet. Sipariş sırasında “Public HTTPS” seçeneğini açın; Let's Encrypt sertifikasını ve 443 numaralı porttaki reverse proxy’yi vLLM / Ollama / Open WebUI portunuza otomatik kurarız. Modelinize `https://
06 Bu, OpenAI, Anthropic veya OpenRouter proxy'lerine kıyasla nerede duruyor?
OpenAI / Anthropic: barındırılan hizmet, tam içerik politikası, 30 gün istem kaydı, ABD yargı alanı. OpenRouter / Together / Fireworks: yine barındırılan, satıcının belirlediği içerik politikası, satıcı tarafında kayıt. Offshore GPU'da self-host: platform tarafında politika yok, bizde kayıt yok, ev sahibi ülkenin yargı alanı. Ödünleşim: GPU süresini kullansanız da kullanmasanız da ödersiniz ve yığını kendiniz işletirsiniz. Yüksek hacimde hesap self-host lehinedir; seyrek kullanımda barındırılan API'ler fiyatta kazanır.
Offshore sunucu 5 dakikada nasıl kurulur
Yargı alanını seçin, paketi belirleyin, kripto para ile ödeyin, token'ınızı alın, kurun.
-
1
Yargı alanınızı seçin
Yasal ihtiyaçlarınıza uyan ülkeyi seçin — ifade özgürlüğü (İzlanda), veri saklama yok (Panama), DMCA işlemez (Rusya) vb. Kararsızsanız yargı alanı seçicimizi kullanın.
-
2
Pick a paket
VPS veya dedicated paketlere göz atın. Tümü NVMe SSD, sınırsız bant genişliği, DDoS koruması ve IPv6 içerir.
-
3
Kripto para ile ödeyin
Bitcoin, Monero, Ethereum, Tether veya desteklenen diğer 5 kripto zincirinden herhangi biriyle ödeyin. E-posta, isim, telefon veya kimlik gerekmez. Fiat kabul edilmez.
-
4
Receive sizin erişim token
Ödeme onaylandıktan sonra benzersiz bir token alırsınız. Bu token tüm hesap kimlik bilgilerinin yerine geçer. Güvenli bir şekilde saklayın.
-
5
Connect için sizin sunucu
Sunucu 5 dakikadan kısa sürede otomatik olarak hazırlanır. Verilen kimlik bilgileriyle SSH üzerinden bağlanın. Tam root erişimi, VNC konsolu mevcut.
Kendi yapay zekanızı kendiniz barındırın — log yok, politika yok
Llama, DeepSeek, Qwen, Mistral, Gemma — istediğiniz açık ağırlıklı modeli getirin. $122.00/ay'dan offshore GPU, CUDA 12 + tek tıkla vLLM hazır.