Şanghay’da düzenlenen HUAWEI CONNECT 2026 kapsamında Huawei Dönüşümlü Yönetim Kurulu Başkanı David Wang, hiper ölçekli veri merkezlerinde yapay zekâ çıkarım (inference) süreçlerini kökten dönüştürmek amacıyla geliştirilen OceanStor M900 Context Memory Storage sistemini duyurdu. Yapay zekânın basit sohbet botlarından çok adımlı ve uzun bağlamlı (ultra-long context) otonom yapay zekâ ajanlarına (Agentic AI) dönüştüğü günümüzde bellek darboğazlarını aşmayı hedefleyen sistem; 64 PB’lık devasa havuzlanmış KV önbelleği (KV cache), doğrudan 60 mikrosaniyeye inen erişim süresi ve SSD ömrünü katlayan akıllı mimarisiyle dikkat çekiyor.
1. 64 PB Havuzlanmış Bellek: NPU Başına Terabaytlarca KV Önbelleği
Geleneksel veri merkezlerinde çip içi bellek (SRAM/HBM) ve sunucu DRAM’leri ile sınırlı kalan KV önbelleği mimarisi, yüksek hızlı UnifiedBus ağı üzerinden SSD katmanına genişletildi:
-
Tek Kümede 64 PB Kapasite: SuperPoD sistemleri için çok katmanlı ve paylaşımlı küresel bir bellek alanı inşa edilerek tek bir kümede 64 PB’a kadar KV önbellek kapasitesi sunuluyor.
-
GB’tan TB Seviyesine Geçiş: NPU başına düşen kullanılabilir KV önbellek kapasitesi gigabayt seviyesinden terabayt seviyesine çıkarıldı. Bu sayede ultra uzun bağlam pencereleri hafızada tutulabiliyor, bağlamın yeniden hesaplanmasına gerek kalmadan önbellek isabet oranı (hit ratio) katlanıyor.
2. CPU, Ağ ve NAND Bütünleşik Mimarisi: 60 Mikrosaniyeye İnen Gecikme
Geleneksel depolama sistemlerindeki protokol dönüştürme ve CPU aktarım gecikmelerini ortadan kaldırmak için sektörde ilk kez üç temel bileşen tek gövdede birleştirildi:
-
Dünyada Bir İlk: Sistem mimarisi; CPU, ağ kontrol ünitesi ve NAND flaş kontrolcüsünü doğrudan tek bir yapıda entegre ediyor.
-
Tek Adımda (One-Hop) Bağlantı: Yerel KV (Key-Value) anlambilim desteği sayesinde SuperPoD bünyesindeki NPU’lar, CPU yönlendirmesine takılmadan doğrudan SSD’lere erişebiliyor.
-
Gecikmede %90 Düşüş: Bu doğrudan yol, veri erişim gecikmesini milisaniyeler düzeyinden 60 mikrosaniyeye indirerek erişim süresinde %90 azalma sağlıyor.
3. 40 TB/s Bant Genişliği ve İki Katına Çıkan Token Verimi
Sistemin sağladığı yüksek aktarım kapasitesi, yapay zekâ modellerinin tepki sürelerini doğrudan etkiliyor:
-
40 TB/s Küme Bant Genişliği: OceanStor M900, tek kümede 40 TB/s toplam erişim bant genişliğine ulaşarak sektördeki rakip çözümlerin 1,5 katı performans sergiliyor.
-
Yarı Yarıya Düşen TTFT: Yazılım geliştirme ve kodlama gibi yoğun çok turlu çıkarım senaryolarında sistem, ilk belirteç üretim süresini (Time to First Token – TTFT) yarı yarıya indirirken, kümenin genel token işleme verimini (throughput) iki katına çıkarıyor.
4. SSD Ömrünü 16 Kat Artıran “KV-Aware” Teknolojisi ve Düşük Token Maliyeti
Yoğun yapay zekâ çıkarımlarının flaş depolama hücrelerinde yarattığı yıpranma sorunu, akıllı yaşam döngüsü algoritmalarıyla çözüldü:
-
Yaşam Döngüsü Tahmini: Sektörün ilk KV-aware adaptif depolama teknolojisi, verilerin değerine göre önbellek döngüsünü tahmin ederek veriyi en uygun depolama katmanına akıllıca dağıtıyor.
-
24 DWPD ve 16 Kat Dayanıklılık: Günlük 24 tam sürücü yazımına (24 DWPD) olanak tanıyan bu optimizasyon, kurumsal SSD’lerin dayanıklılığını 16 kat artırıyor ve en az 3 yıl boyunca kesintisiz stabilite vadediyor.
-
İşletme Giderlerinde (OPEX) Düşüş: Disk değişim ihtiyacını ve bakım maliyetlerini en aza indirerek büyük ölçekli yapay zekâ altyapılarında token başına düşen genel maliyeti belirgin şekilde aşağı çekiyor.
5. Huawei OceanStor M900 Teknik Özellikleri
| Özellik | OceanStor M900 |
| Kullanım Amacı | Büyük ölçekli yapay zekâ çıkarımı (AI Inference) ve KV Cache hızlandırma |
| Toplam Küme Kapasitesi | 64 PB’a kadar havuzlanmış paylaşımlı bellek |
| Toplam Erişim Bant Genişliği | 40 TB/s (Rakiplerinden 1,5 kat daha yüksek) |
| Erişim Mimarisi | Entegre CPU + Ağ Kontrolcüsü + NAND Kontrolcüsü (Tek adımda bağlantı) |
| Erişim Gecikmesi | 60 mikrosaniye (%90 gecikme düşüşü) |
| NPU Başına Bellek | Gigabayt seviyesinden Terabayt seviyesine yükseltilmiş KV Cache |
| Performans Etkisi | 2 kat token işleme verimi, TTFT süresinde %50 azalma |
| Dayanıklılık Teknolojisi | KV-aware adaptif depolama / 24 DWPD |
| SSD Ömrü Artışı | Standart SSD kullanımına göre 16 kat daha uzun dayanıklılık |
| Hedef Altyapı | SuperPoD / Hiper ölçekli yapay zekâ veri merkezleri |
Source link
