Ana Sayfa / Sansürsüz AI Barındırma — Kendi LLM'inizi Kendiniz Barındırın
DeepSeek-R1, Llama-3.3, Qwen3'ü kendiniz barındırın — çıkarım kaydı yok, içerik politikası yok.

Sansürsüz AI Barındırma — Kendi LLM'inizi Kendiniz Barındırın

OpenAI, Anthropic, Google ve xAI, barındırdıkları uç noktalarda içerik politikası uygular — ve her istemi güvenlik sınıflandırması, model iyileştirme ve devlet taleplerine yanıt için kaydeder. Kendi GPU makinenizde self-host bunu tersine çevirir: yasal olarak edinebildiğiniz her açık ağırlıklı model yerelde çalışır, çıkarım trafiği ağ katmanımızdan geçmez, istemler kaydedilmez, çıktılar filtrelenmez. ServPrivate, 4 offshore yargı alanında tek tıkla vLLM, Ollama, ComfyUI, Whisper ve Bark şablonlarıyla RTX 4090 / RTX 5090 / H100 SXM5 GPU sunucuları teslim eder.

KYC yok
Yalnızca Kripto
Log Yok
DMCA Göz Ardı Edilir
Tam Root
NVMe SSD
Barındırılan endpoint'ler her şeyi kaydeder. Yerel ağırlıklar hiçbir şey kaydetmez.

"Sansürsüz yapay zeka" sorusu aslında bir egemenlik sorusudur

OpenAI API'sini çağırdığınızda istemleriniz, en az 30 gün (güvenlik sınıflandırmalarında daha uzun) saklanan, işaretlendiğinde güvenlik ekiplerince incelenen ve ABD hukuki sürecine tabi, ABD yargı alanındaki bir kayda girer. Model ayrıca, güvenlik RLHF'sinin eğitildiği çıktı kategorilerini reddeder. Llama-3.3-70B-Instruct'ı (veya abliterated türevini) kendi GPU'nuzda çalıştırdığınızda istemleriniz makinenizden hiç çıkmaz, ret eğitimi yalnızca ağırlıkların getirdiği kadardır ve yargı alanı, makineyi nerede barındırdıysanız orasıdır. İnsanların "sansürsüz yapay zeka" derken kastettiği bu iki katmandır — kayıt yok ve ağırlık seçimi sizde. ServPrivate ikisini de sağlar: çıkarım ağı yakalaması olmayan offshore GPU, artı ağırlıkları incelemeden herhangi bir HuggingFace modelini yükleyen tek tık şablonlar.

01

Herhangi bir açık ağırlıklı modeli getirin

Llama-3.3, DeepSeek-R1, Qwen3, Mistral-Small-3, Gemma-3, Phi-4, abliterated fork'lar, özel fine-tune'lar — HuggingFace'teki her şey veya kendi .safetensors dosyalarınız. Repo yolunu verirseniz sipariş sırasında önceden indiririz.

02

Çıkarım trafiği yakalanmaz

Inference kendi GPU'nuzda, KVM misafir sisteminizin içinde çalışır. Model trafiğinizi proxy'lemez, yansıtmaz veya örneklemeyiz. Prompt'larınız ve ürettikleriniz, siz aksine karar verene kadar yerelde kalır.

03

Offshore yetki alanı

İzlanda (ifade özgürlüğü cenneti, %100 yenilenebilir enerji), Hollanda (en iyi AB peering'i), Romanya (veri saklamaya karşı yargı içtihadı), Moldova (hafif düzenleme, düşük maliyet). Size uyan yasal çerçeveyi seçin.

04

Genel HTTPS endpoint isteğe bağlı

Sipariş sırasında etkinleştirin; port 443 üzerinde Let's Encrypt + reverse proxy kuralım — vLLM / Ollama instance'ınız 60 saniyeden kısa sürede TLS'li genel bir URL üzerinden erişilebilir olur.

"Sansürsüz yapay zeka" 2026'da gerçekte ne anlama geliyor

"Sansürsüz yapay zeka" terimi bağlama göre üç ayrı anlam taşır. (1) Reddi kaldırılmış ağırlıklar — temel modellerin abliterated / sansürsüz ince ayarlarında (örn. Llama-3.3-70B-abliterated) güvenlik RLHF'si aktivasyon düzenleme veya yönsel ablasyonla kaldırılmıştır; orijinal instruct modelinin reddettiği çıktıları üretirler. (2) Sunum katmanında içerik denetimi yok — aynı modeli, çıkarımın önünde OpenAI tarzı bir politika sınıflandırıcısı olmadan çalıştırmak. (3) İstem/çıktı kaydı yok — girdileriniz ve çıktılarınız makineden hiç çıkmaz ve yukarı akışta hiçbir yerde saklanmaz. ServPrivate (2) ve (3)'ü varsayılan olarak sağlar; (1) için model ağırlıklarını siz getirirsiniz — donanımınızda ne çalıştığını incelemeyiz, filtrelemeyiz.

Self-host edilebilir LLM'lerde güncel 2026 manzarası

Mayıs 2026 itibarıyla açık ağırlıklı ekosistem, birçok görevde barındırılan GPT-4 / Claude / Gemini ile gerçekten rekabet ediyor. DeepSeek-R1 ve Llama-70B'ye damıtılmış hali, çıkarım maliyetinin çok küçük bir kesriyle akıl yürütme kıyaslamalarında GPT-4'ü yakalıyor. Llama-3.3-70B-Instruct genel amaçlı işlerin varsayılan beygiri olmayı sürdürüyor. Qwen3-32B çok dilli tarafta güçlü ve akıl yürütebiliyor. Gemma-3-27B lisans netliği karşılığında yetenekten feragat ediyor. Mistral-Small-3 kod işlerinde hız/kalite dengesinin tatlı noktası. Phi-4 14B sınıfının üzerinde iş çıkarıyor. FLUX.1-dev görsel üretiminde SDXL'in yerini aldı. Whisper-Large-v3 açık ağırlıklı ASR'de lider olmayı sürdürüyor. Hepsi aşağıdaki GPU kademelerinde çalışır — boyutlandırma için GPU satın alma rehberine bakın.

Sansürsüz bir AI sunucusu için operasyonel hijyen

No-KYC GPU box üzerinde inference logging olmasa bile workload içine kimlik sızdırabilirsiniz. Ciddi self-hosters için pratik hijyen: (1) SSH öncesi box’a Tor veya VPN üzerinden bağlanın; (2) GitHub hesabınıza bağlı olmayan yeni SSH key kullanın; (3) public HTTPS endpoint açıyorsanız IP yerine token bazlı rate-limit ve API key ile gate edin; (4) ağırlıkları deploy sonrası HuggingFace hesabınızla çekmek yerine sipariş sırasında inline pre-download edin; (5) hassas prompts için llama.cpp veya vLLM’i isolated network namespace arkasında çalıştırın. Bu pattern’leri guides hub’da belgeliyoruz.

"Sansürsüz" kapsamına ne girer, ne girmez

Kapsam dahilinde: temel modelin güvenlik RLHF eğitiminin reddedeceği NSFW veya siyaseten hassas çıktılar, şiddet içeren kurgusal içerik, ismen anılan kişileri veya hükümetleri eleştiren çıktılar, çift kullanımlı araştırma çıktıları (örn. ders kitabı düzeyinde siber güvenlik, biyoloji, kimya), adversarial istem mühendisliği tonundaki çıktılar. Kullanım politikamızın dışında: CSAM (modelden bağımsız sıfır tolerans), kitlesel can kaybına yönelik KBRN saldırı talimatları (modelden bağımsız), ismen anılan kişilere yönelik hedefli taciz kampanyaları ve ev sahibi ülkenin yasalarının açıkça yasakladığı çıktılar. Neredeyse her şeye modelin kendisi karar verir; kullanım politikası yalnızca en uç vakaları ayırır.

SSS

Sansürsüz AI Barındırma — sık sorulan sorular

01 İstemleri veya model çıktılarını kaydediyor musunuz?

Hayır. GPU box sizin KVM guest’inizdir. Inference traffic’inizi proxy etmeyiz, mirror etmeyiz, sample etmeyiz ve prompt veya completion content’i hiçbir yere forward etmeyiz. Tuttuğumuz tek loglar network-level bandwidth counters ve hypervisor-level uptime / GPU power draw kayıtlarıdır.

02 Burada Llama-3.3-70B-abliterated veya DeepSeek-R1 çalıştırabilir miyim?

Evet. HuggingFace üzerinde legal olarak edinebileceğiniz herhangi bir open-weight model: Llama-3.3-70B-Instruct, abliterated forks, DeepSeek-R1, DeepSeek-R1-Distill-Llama-70B, Qwen3-32B, Gemma-3-27B, Mistral-Small-3, Phi-4 ve diğerleri. HF repo belirtirseniz order sırasında pre-download ederiz; first SSH sonrası manual pull da yapabilirsiniz.

03 Hangi model boyutu hangi GPU kademesine sığar?

Q4 kuantizasyonunda yaklaşık boyutlandırma: RTX 4090 (24 GB) 7B-13B için rahatça, offload acısıyla 27-32B için uygun. RTX 5090 (32 GB) 27B-32B için rahatça, offload ile 70B için uygun. H100 SXM5 (80 GB) Q4-Q5'te 70B için rahatça uygun. Çift H100 (160 GB) FP16'da 70B, Q4'te 120-180B için uygun. /guides/rtx-4090-vs-h100-for-ai-inference adresindeki satın alma rehberinde ayrıntılı iş hacmi sayıları var.

04 Karşıma çıkacak bir içerik politikası var mı?

Modelinizin ürettiği içerik üzerinde platform tarafında bir içerik politikası yok. Kullanım politikamız yalnızca, nasıl üretildiğine bakılmaksızın ev sahibi ülkede yasa dışı olanı yasaklar (CSAM, kitlesel can kaybına yönelik KBRN saldırı talimatları, ismen belirtilen kişilere yönelik hedefli taciz). Geri kalan her şey — NSFW, siyasi, çift kullanımlı araştırma ve adversarial istemlerle üretilmiş çıktılar dahil — çalışır.

05 LLM'imi herkese açık bir URL üzerinden sunabilir miyim?

Evet. Sipariş sırasında “Public HTTPS” seçeneğini açın; Let's Encrypt sertifikasını ve 443 numaralı porttaki reverse proxy’yi vLLM / Ollama / Open WebUI portunuza otomatik kurarız. Modelinize `https://.servprivate.dev` üzerinden erişilir. Kendi alan adınız için A kaydı yönlendirirseniz TLS yine ek kurulum olmadan çalışır.

06 Bu, OpenAI, Anthropic veya OpenRouter proxy'lerine kıyasla nerede duruyor?

OpenAI / Anthropic: barındırılan hizmet, tam içerik politikası, 30 gün istem kaydı, ABD yargı alanı. OpenRouter / Together / Fireworks: yine barındırılan, satıcının belirlediği içerik politikası, satıcı tarafında kayıt. Offshore GPU'da self-host: platform tarafında politika yok, bizde kayıt yok, ev sahibi ülkenin yargı alanı. Ödünleşim: GPU süresini kullansanız da kullanmasanız da ödersiniz ve yığını kendiniz işletirsiniz. Yüksek hacimde hesap self-host lehinedir; seyrek kullanımda barındırılan API'ler fiyatta kazanır.

Nasıl çalışır

Offshore sunucu 5 dakikada nasıl kurulur

Yargı alanını seçin, paketi belirleyin, kripto para ile ödeyin, token'ınızı alın, kurun.

  1. 1

    Yargı alanınızı seçin

    Yasal ihtiyaçlarınıza uyan ülkeyi seçin — ifade özgürlüğü (İzlanda), veri saklama yok (Panama), DMCA işlemez (Rusya) vb. Kararsızsanız yargı alanı seçicimizi kullanın.

  2. 2

    Pick a paket

    VPS veya dedicated paketlere göz atın. Tümü NVMe SSD, sınırsız bant genişliği, DDoS koruması ve IPv6 içerir.

  3. 3

    Kripto para ile ödeyin

    Bitcoin, Monero, Ethereum, Tether veya desteklenen diğer 5 kripto zincirinden herhangi biriyle ödeyin. E-posta, isim, telefon veya kimlik gerekmez. Fiat kabul edilmez.

  4. 4

    Receive sizin erişim token

    Ödeme onaylandıktan sonra benzersiz bir token alırsınız. Bu token tüm hesap kimlik bilgilerinin yerine geçer. Güvenli bir şekilde saklayın.

  5. 5

    Connect için sizin sunucu

    Sunucu 5 dakikadan kısa sürede otomatik olarak hazırlanır. Verilen kimlik bilgileriyle SSH üzerinden bağlanın. Tam root erişimi, VNC konsolu mevcut.

Kendi yapay zekanızı kendiniz barındırın — log yok, politika yok

Llama, DeepSeek, Qwen, Mistral, Gemma — istediğiniz açık ağırlıklı modeli getirin. $122.00/ay'dan offshore GPU, CUDA 12 + tek tıkla vLLM hazır.

Başlayın En İyi Yargı Alanını Bulun