BOXX Türkiye distribütörü+90 850 303 26 99[email protected]DestekGiriş
BOXX Türkiye
Yapay zekâ uygulamalarını ölçeklendirme
Çözümler · AI ölçekleme

Yapay zekâ uygulamalarını ölçeklendirme

Çalışan bir model ile hizmet veren bir sistem aynı şey değildir. Ölçeklendirme; eş zamanlı istekleri karşılayan, izlenebilen ve büyüdükçe düğüm eklenebilen bir altyapı gerektirir.

Denemeden üretime

AI ölçekleme iş akışları için donanım çözümlerimiz

Üretimdeki yapay zekâ iş yükü iki farklı karaktere ayrılır. Çıkarım (inference) tarafında ölçü, saniyedeki istek sayısı ve ilk çıktıya kadar geçen gecikmedir; eğitim tarafında ise bir çevrimin (epoch) ne kadar sürdüğü. Bu iki hedef farklı yapılandırmalar ister — aynı sunucuyu her ikisi için birden zorlamak genelde ikisini de yavaşlatır.

Çıkarımda ekran kartı belleği, aynı anda kaç isteğe hizmet verebileceğinizi belirler. Model ağırlıkları bir kez yüklenir, kalan bellek eş zamanlı isteklerin bağlam verisine ayrılır; bellek arttıkça toplu işleme (batching) verimliliği ve dolayısıyla sunucu başına düşen kullanıcı sayısı artar. Sekiz GPU taşıyan bir MGX sunucu, tek kullanıcı için hızlı olmaktan çok, çok sayıda kullanıcıya aynı anda yetişmek için vardır.

Çok düğümlü eğitimde darboğaz genellikle hesaplama değil, ağdır. Düğümler her adımda gradyan alışverişi yapar; standart ağ üzerinde bu alışveriş hesaplamadan uzun sürebilir ve kart ekledikçe kazanç düşer. Bu yüzden ölçeklenen kurulumlarda yüksek bant genişlikli düğümler arası bağlantı, kart sayısı kadar önemlidir.

Süreklilik ve yönetilebilirlik de ölçeğin parçasıdır. Uzaktan yönetim (IPMI/BMC) olmadan fiziksel erişim gerektiren her arıza, hizmet kesintisine dönüşür; yedekli güç ve rack’e uygun ısıl tasarım ise sistemin gece boyunca çalışmasını sağlar. HELIXX sunucular bu gereksinimlerle birlikte yapılandırılır.

Bu sayfa BOXX Türkiye tarafından hazırlanmıştır. Donanım gerekçeleri sektörde yerleşik teknik bilgiye dayanır; ürün eşleştirmeleri kataloğumuzdaki gerçek sistem verilerinden alınmıştır. Yapılandırmanızı birlikte netleştirmek için bize yazın.

Sık tercih edilen sistemler

AI ölçekleme iş akışları için sistemler

NVIDIA RTX PRO MGX platformu üzerine kurulu, dört ve sekiz GPU’lu sunucu yapılandırmaları.

HELIXX 4U8G | XEON 6700
RTX PRO Servers · 4U Sunucu

HELIXX 4U8G | XEON 6700

Edge için nihai yüksek yoğunluklu 4U sunucu

Yonga seti
SoC
Soket
Çift (4710-E2)
CPU soğutma
Hava soğutmalı
HELIXX 4U8G | EPYC CX8
RTX PRO Servers · 4U Sunucu

HELIXX 4U8G | EPYC CX8

Hiperölçek AI ve bulut veri merkezleri

Yonga seti
SoC
Soket
Çift (SP5)
CPU soğutma
Hava soğutmalı
HELIXX 2U4G | XEON 6700
RTX PRO Servers · 2U Sunucu

HELIXX 2U4G | XEON 6700

Edge için nihai yüksek yoğunluklu 2U sunucu

Yonga seti
SoC
Soket
Tek (4710-E2)
CPU soğutma
Hava soğutmalı
Sık sorulan sorular

AI ölçekleme iş istasyonları hakkında

Kullanılabilir ama ikisi farklı hedefler optimize eder. Çıkarımda ölçü gecikme ve eş zamanlı istek sayısı, eğitimde ise çevrim süresidir. Üretim hizmeti veren bir sunucuda ağır eğitim işleri çalıştırmak, hizmet gecikmesini öngörülemez hâle getirir; mümkün olduğunda ayırmak önerilir.
Diğer sektörler

Sektöre göre diğer BOXX çözümleri