VMware Private AI Cloud geldi: Token ve GPU maliyeti tek panelde

Broadcom, 31 Ağustos 2026’da Las Vegas’taki VMware Explore 2026 kapsamında VMware Private AI Cloud’u tanıttı. Broadcom’un 31 Ağustos açıklaması, yapıyı çıkarım iş yükleri, yapay zekâ ajanları ve geleneksel kurumsal uygulamalar için VCF tabanlı ortak bir özel bulut platformu olarak konumlandırıyor; VCF müşterilerinin 150’den fazla açık kaynaklı ve ticari modeli şirket içinde çalıştırabilmesini de bu çerçeveye dahil ediyor.
31 Ağustos’ta duyurulan yapının VCF kullanan ekipler açısından temel vaadi, model tüketimi ile altyapı kullanımını aynı operasyon alanında görünür kılmak. Token izleme, GPU ve vGPU takibi, model paylaşımı ve yönlendirme kontrolleri birlikte sunuluyor; ancak “tek panel”, iki kalemi doğrudan para birimine çeviren hazır bir fatura ekranından ziyade ortak gözlem ve yönetişim katmanını ifade ediyor.
Yeni ad, VCF çevresindeki bileşenleri tek mimaride topluyor

VMware Private AI Cloud, VCF’den bağımsız çalışan tek bir uygulama değil. Broadcom’un VCF üzerindeki altyapı yönetimini, model sunumunu ve erişim kontrollerini özel yapay zekâ iş yükleri için aynı çatı altında topladığı üst mimariyi tanımlıyor.
Bu mimarinin tabanında VMware Cloud Foundation bulunuyor. Hesaplama, ağ, depolama, CPU, GPU ve diğer hızlandırıcı kaynakları burada işletilirken yapay zekâ çıkarımı ile mevcut kurumsal iş yüklerinin ayrı altyapı adalarına bölünmeden çalıştırılması hedefleniyor. Heterojen hızlandırıcı desteği, NVMe bellek katmanlama ve küme çapında depolama tekilleştirme de fiziksel kapasitenin kullanımını iyileştirmeye yönelik altyapı araçları arasında yer alıyor.
Bunlar tek başına daha düşük toplam maliyet garantisi vermiyor. Gerçek sonuç; mevcut donanımın doluluk oranına, enerji ve destek giderlerine, lisans koşullarına ve çalıştırılan modellerin kaynak talebine bağlı olacak.
VCF, AI Factory ve AI Gateway’in rolleri farklı
VCF, özel bulutun kaynak ve yaşam döngüsü katmanı. GPU ile vGPU kullanım görünürlüğü, küme kapasitesi, sanallaştırma ve geleneksel iş yükleri bu zeminde yönetiliyor.
VMware AI Factory, bu zeminin üzerinde altyapıdan çalışan modele uzanan teslimat katmanı olarak konumlanıyor. Yapay zekâya hazır altyapının kurulmasını ve devam eden operasyonlarını otomatikleştirmek, doğrulanmış donanım-model bileşimlerini devreye almak ve aynı model örneğini birden fazla kiracıyla paylaşmak bu katmanın görevleri arasında.
AI Gateway ise uygulamalar ile model uç noktaları arasındaki erişim noktası. ITPro’nun duyuru incelemesi, ağ geçidinin şirket içindeki ve buluttaki modeller için tek arayüzden yönetişim; akıllı istem yönlendirme, token ve kullanım hızı sınırları ile uygulama yetkilendirmesi sunduğunu aktarıyor. Dolayısıyla AI Gateway GPU kümesini işletmiyor; hangi uygulamanın hangi modele, hangi sınırlar ve rota üzerinden erişeceğini denetliyor.
Token ve GPU maliyeti aynı bağlamda nasıl izleniyor?

Yeni çerçeve, iki farklı tüketim düzeyini ilişkilendirmeyi amaçlıyor. Token takibi, model çağrılarının uygulama veya ekip bazındaki kullanımını gösterirken GPU ve vGPU ölçümleri bu çağrıların arkasındaki hızlandırıcı kapasitesinin ne ölçüde kullanıldığını görünür kılıyor. AI metrikleri gözlem paneli de bu verilerin ortak operasyon bağlamında değerlendirilmesini sağlıyor.
Böylece yüksek token tüketen bir uygulama ile düşük dolulukta çalışan pahalı bir GPU havuzu birbirinden ayrılabilir. Çok kiracılı model paylaşımı da aynı modelin her ekip için ayrı ayrı yüklenmesi yerine tek dağıtım üzerinden sunulmasını hedefleyerek gereksiz GPU tahsisini azaltmaya çalışıyor.
Başlıktaki “maliyet” ifadesinin sınırı burada önemli: platform tüketim verisini ölçüyor, fakat her kuruluş için eksiksiz ve kesin bir maliyet hesabı üretildiği doğrulanmış değil. Donanım amortismanı, elektrik, lisans, destek, boş kapasite ve rezerv gereksinimi gibi girdilerin kurumun kendi maliyet modeline eklenmesi gerekiyor. Panelin sağladığı yenilik, token talebiyle altyapı kullanımını aynı inceleme alanına taşıması.
Model kataloğu yalnızca geniş bir seçenek listesi değil

AI Factory’nin diğer görevi, doğrulanmış modelleri şirket içindeki uygulama ekiplerine Model as a Service biçiminde sunmak. Model bir kez devreye alınarak özel ad alanları üzerinden birden fazla kiracıyla paylaşılabiliyor; uygulama ekibi doğrudan GPU istemek yerine yönetilen bir model uç noktasına erişiyor.
Kataloğun yönetişim değeri, model sayısından çok bu erişim biçiminden geliyor. Uygulama yetkisi, token kotası ve kullanım hızı sınırı çağrı sırasında uygulanabiliyor; yönlendirme politikası da isteği yerel veya bulut tabanlı bir modele aktarabiliyor. Bu nedenle katalog, indirilebilir modeller listesinden ziyade ölçülen ve yetkilendirilen bir servis katmanı olarak tasarlanıyor.
Yönlendirme araçları maliyet, kalite veya gecikme hedeflerine göre farklı modellerin seçilmesini mümkün kılabilir. Bunun sağlayacağı ekonomik sonuç ise kurumun politikalarına, model doğrulama süresine ve yerel GPU kapasitesinin ne kadar verimli paylaştırıldığına bağlı.
Mevcut VCF müşterileri için paket ve takvim henüz net değil
VCF kullanan kurumlar açısından avantaj, yapay zekâ iş yüklerini mevcut özel bulut işletim modeline bağlayabilme ihtimali. Bununla birlikte duyurudaki her unsur yeni değil: NVMe bellek katmanlama, depolama tekilleştirme ile bazı GPU ve model ölçümleri daha önceki VCF sürümlerinde bulunuyordu; yeni çerçeve bunları model servisi, token ölçümü ve hibrit ağ geçidiyle bir araya getiriyor.
TechTarget’ın VMware Explore değerlendirmesi, yeni yapay zekâ yeteneklerinin büyük bölümünün VCF üzerinde ayrıca lisanslanan katmanlar olduğunu, paketin önemli parçaları için 2026 sonbaharı takviminin verildiğini ve model servisine ilişkin kesin bir genel kullanıma sunulma tarihinin yayımlanmadığını belirtiyor. Bu nedenle VMware Private AI Cloud’un duyurulmuş olması, bütün bileşenlerin tüm VCF müşterileri için bugün eksiksiz biçimde kullanılabildiği anlamına gelmiyor.
Türkiye’deki kurumsal ekipler için açık kalan başlıklar; bölgesel satış ve destek kapsamı, eklenti fiyatları, kataloğa yeni modellerin hangi hızla alınacağı ve tüketim ölçümlerinin kurum içi maliyet sistemlerine nasıl aktarılacağı. Broadcom’un doğruladığı mimari yön belli, ancak satın alınabilir paketlerin kapsamı ve bileşenlerin kesin kullanılabilirlik tarihleri henüz tamamlanmış değil.
Ayrıca okuyun:
Bültenimize abone olun
En son Web3, yapay zekâ ve kripto haberleri doğrudan gelen kutunuza gelsin.