Alt Yapı · GPU as a Service

Donanım satın almadan,dakikalar içindeGPU gücüne çıkın.

Bulutistan AI Cloud; model training, fine-tuning ve yüksek hacimli inference için L40S ve H200 sınıfı hızlandırıcıları hizmet olarak sunar. Tedarik, kurulum ve bakım yükü olmadan; Türkiye'de konumlanan, OpenStack tabanlı egemen bulut üzerinde kullandığınız kadar ödeyin.

L40S & H200 hızlandırıcılarPaylaşımlı veya dedikeOpenStack tabanlı egemen bulutVeriler Türkiye'de kalır
LLM Hizmetine bak
141 GB
H200 HBM3e bellek
4.8 TB/s
bellek bant genişliği
dk.
içinde provizyon
TR
veri konumu
Neden GPU as a Service?

GPU'yu satın almayın, sonucu kiralayın.

Kendi GPU kümenizi kurmak; uzun tedarik süreleri, yüksek peşin yatırım, güç-soğutma planlaması ve sürekli bakım demektir. Kart geldiğinde ihtiyaç çoktan değişmiş, kapasite ya boşta ya da yetersiz kalır.

GPU as a Service ile hızlandırıcıya bir hizmet olarak erişirsiniz: iş yükü büyüdüğünde saniyeler içinde ölçeklenir, bittiğinde durur. Donanım CapEx'i, öngörülebilir ve kullanımla orantılı bir OpEx'e dönüşür.

Ekibiniz küme yönetimiyle değil; modelle, üründe ve iş değeriyle ilgilenir.

CapEx yerine OpEx

Milyonluk peşin donanım yatırımı yerine, yalnızca kullandığınız GPU-saat kadar öngörülebilir gider.

Dakikalar içinde başlangıç

Tedarik ve kurulum beklemeden; self-service API veya konsol üzerinden kapasiteyi anında ayağa kaldırın.

İhtiyaca göre ölçek

PoC'den yüksek hacimli üretime kadar aynı altyapıda büyüyün; boşta kalan karta para ödemeyin.

Sıfır donanım operasyonu

Sürücü, firmware, güç ve soğutma bizde; siz iş yükünüze odaklanın.

GPU kırılımı

İş yüküne göre doğru hızlandırıcı.

Her iş yükü aynı GPU'yu istemez. Maliyet-etkin inference ve orta ölçek training için L40S; bellek-yoğun büyük model training ve yüksek verimli inference için H200. İkisi de aynı bulut, aynı API arkasında.

NVIDIA L40S

Ada Lovelace · maliyet-etkin inference & orta ölçek training

Fiyat/performans dengesinde güçlü. Production inference, orta ölçek fine-tuning, computer vision ve görsel/video iş yükleri için ideal; paylaşımlı senaryolarda birim maliyeti düşük tutar.

Mimari
Ada Lovelace
GPU belleği
48 GB GDDR6 (ECC)
Bellek bant genişliği
~864 GB/s
Tensor Core
4. nesil · FP8
Tipik iş yükleri
Inference (7B–70B modeller)Orta ölçek fine-tuningComputer vision & multimodalGörsel, video ve render

NVIDIA H200

Tepe performans

Hopper · büyük model training & bellek-yoğun inference

141 GB HBM3e ve 4.8 TB/s bant genişliğiyle bellek duvarını kaldırır. LLM training, uzun bağlam ve büyük batch inference, yüksek verim gerektiren üretim trafiği için tepe performans.

Mimari
Hopper
GPU belleği
141 GB HBM3e
Bellek bant genişliği
4.8 TB/s
Hızlandırma
Transformer Engine · FP8 · NVLink
Tipik iş yükleri
LLM trainingUzun bağlam & büyük batch inferenceBellek-yoğun dev modellerYüksek hacimli üretim trafiği
Dağıtım modeli

Paylaşımlı esneklik ya da dedike izolasyon.

İş yükünüzün ritmine göre seçin: değişken ve deneysel yükler için paylaşımlı havuz, sürekli ve regülasyona tabi üretim için tek kiracılı dedike kapasite.

Paylaşımlı GPU

Çok kiracılı havuz

Optimize edilmiş bir havuzdan anlık kapasite. PoC, değişken trafik ve deneysel iş yükleri için en ekonomik başlangıç.

  • PAYG · $/1M token bazlı fiyatlama
  • Saniyeler içinde ölçeklenen kapasite
  • PoC ve değişken yükler için ideal
  • Düşük giriş maliyeti

Dedike GPU

Tek kiracılı, izole

Size ayrılmış, izole hızlandırıcılar. Sürekli üretim, büyük ölçekli training ve yazılı SLA ihtiyacı olan kurumsal senaryolar için öngörülebilir performans.

  • Tek kiracılı tam izolasyon
  • Yazılı SLA & rezerve kapasite
  • Sürekli üretim ve training için stabil
  • KVKK / regülasyon uyum ekleri
Egemen bulut · OpenStack

Açık standart bir bulutun üzerinde, veri egemenliğiyle.

Bulutistan AI Cloud, açık kaynak OpenStack üzerine kurulur. Bu; belirli bir sağlayıcıya kilitlenmeden (vendor lock-in yok), verinin Türkiye sınırları içinde kaldığı ve kapasitenin uçtan uca sizin denetiminizde olduğu bir altyapı demektir.

GPU passthrough & MIG

Nova compute üzerinde GPU'lar; ister tam kart passthrough ister MIG ile bölümlenmiş olarak, iş yükünüze en verimli biçimde atanır.

Kiracı bazlı izolasyon

Keystone kimlik ve proje modeliyle organizasyon, proje ve ağ düzeyinde tam izolasyon; çok kiracılı ortamda güvenli ayrışma.

Self-service & IaC

Nova, Neutron ve Cinder API'leri üzerinden; Terraform ve Kubernetes ile kod olarak altyapı (IaC) yönetimi.

Veri egemenliği

İşleme ve depolama Türkiye'de konumlanan bölgelerde kalır; açık standart sayesinde taşınabilirlik ve denetlenebilirlik korunur.

Altyapı katmanları
05Uygulama / model iş yükü
04Kubernetes · Terraform (IaC)
03Nova · Neutron · Cinder · Keystone
02GPU passthrough · MIG bölümleme
01L40S / H200 GPU havuzu

Uygulamadan GPU'ya kadar her katman açık standart bileşenlerle kurulur; taşınabilir ve denetlenebilir kalır.

İş yükleri

Hesaplama-yoğun her yük için tek altyapı.

LLM training & fine-tuning

Büyük dil modellerini sıfırdan train edin ya da kurumsal verinizle fine-tune edin; H200 belleğiyle uzun bağlam ve büyük batch mümkün.

Yüksek hacimli inference

Üretim trafiğini düşük gecikmeyle karşılayın; L40S ile birim maliyeti, H200 ile veriyi optimize edin.

Computer vision & multimodal

Görüntü, video ve çok-kipli modellerin training ve inference iş yükleri için hızlandırılmış kapasite.

RAG & vektör iş yükleri

Embedding üretimi ve yüksek hacimli RAG akışları için ölçeklenen GPU gücü.

Araştırma & PoC

Fikirden prototipe; paylaşımlı havuzda hızlı, ucuz ve tekrarlanabilir deney ortamları.

HPC & simülasyon

Bilimsel hesaplama, simülasyon ve render gibi paralel iş yüklerini GPU hızında koşturun.

Neden Bulutistan

GPU'dan modele, tek çatı altında.

Alt Yapı (GPU) ve LLM Hizmeti aynı bulutta konumlanır: donanımdan üretime hazır model çıktısına kadar uçtan uca tek sağlayıcı.

Uçtan uca AI Cloud

Aynı çatı altında GPU as a Service ve LLMaaS; altyapıdan model API'sine geçiş sürtünmesiz.

Türkiye'de veri egemenliği

İşleme ve depolama yerel bölgelerde; KVKK ve kurumsal regülasyon beklentilerine uygun temel.

Kullanım bazlı ekonomi

Peşin donanım yatırımı yerine kullanımla orantılı, öngörülebilir maliyet; boşta kapasiteye ödeme yok.

Kurumsal izolasyon & destek

Proje bazlı izolasyon, dedike kapasite ve çözüm mühendisi desteğiyle üretime güvenle çıkın.

Sizi arayalım

İş yükünüze uygun GPU planını birlikte kuralım.

Kapasite ihtiyacınızı, model boyutunuzu ve bütçenizi paylaşın; çözüm ekibimiz paylaşımlı mı yoksa dedike mi, L40S mı H200 mı olduğunu sizinle birlikte netleştirsin. Fiyat ve kotalar görüşmede yazılı olarak teyit edilir.