SHANGHAI, 18 september 2026 /PRNewswire/ -- Tijdens HUAWEI CONNECT 2026 introduceerde David Wang, vicevoorzitter van de raad van bestuur en roulerend voorzitter van Huawei, officieel OceanStor M900 Context Memory Storage tijdens zijn keynote. Het product is ontworpen voor AI-inferentie in hyperscale-datacenters en biedt SuperPoD's een volledig gedeelde geheugenruimte met een capaciteit op PB-schaal en prestaties op TB/s-niveau. Dit markeert een verschuiving in de AI-infrastructuur van een rekenkrachtgericht model naar nauwe samenwerking tussen rekenkracht, netwerk en opslag. Dit helpt de rekenkracht van SuperPoD's te benutten.
In 2026 is de overgang van AI van technologische doorbraken naar grootschalige implementatie in een stroomversnelling geraakt. AI-toepassingen zijn geëvolueerd van chatbots naar agents die zelfstandig complexe taken kunnen uitvoeren. Deze agents worden op grote schaal toegepast in kritieke sectoren, wat het begin markeert van het tijdperk van agentische AI.
Nu grote modellen groeien naar een schaal van 10 biljoen parameters, worden SuperPoD's de optimale keuze voor AI-infrastructuur. Veelgebruikte grote modellen ondersteunen inmiddels contextvensters van meer dan één miljoen tokens. Multi-turn-inferentie en complexe taken zijn de norm geworden en de hoeveelheid KV-cachegegevens die tijdens inferentie wordt gegenereerd, blijft toenemen. Deze trends hebben het on-chipgeheugen en DRAM qua capaciteit en kosteneffectiviteit tot hun grenzen gebracht. Het is inmiddels een breed gedragen consensus in de sector om een opslagarchitectuur met meerdere lagen te bouwen die on-chipgeheugen, DRAM en SSD's op elkaar afstemt om een volledig gedeelde geheugenruimte met een enorme capaciteit te creëren.
Huawei introduceerde OceanStor M900 Context Memory Storage om de knelpunten op het gebied van geheugencapaciteit bij contextvensters van uitzonderlijke lengte en multi-turn-inferentie weg te nemen. OceanStor M900 maakt gebruik van het UnifiedBus-netwerk om een wereldwijde KV-cache met opslag in meerdere lagen en een capaciteit op PB-schaal op te bouwen via verbindingen met één hop. Hiermee wordt het potentieel van de rekenkracht van SuperPoD's volledig benut en wordt AI-inferentie in hyperscale-datacenters versneld. OceanStor M900 Context Memory Storage beschikt over drie belangrijke mogelijkheden:
Capaciteitsgrenzen doorbreken om grootschalige AI te ondersteunen met enorme geheugencapaciteit
Dankzij het snelle UnifiedBus-interconnectienetwerk wordt de KV-cache wereldwijd gebundeld en gedeeld via opslag in meerdere lagen. De KV-cache van SuperPoD's wordt uitgebreid van on-chipgeheugen en DRAM naar SSD's, waardoor één cluster een capaciteit van 64 PB kan leveren. De beschikbare KV-cachecapaciteit per NPU wordt verhoogd van gigabytes naar terabytes, waardoor meer context kan worden opgeslagen, gedeeld en hergebruikt. Dit verhoogt de hitratio van de KV-cache aanzienlijk.
Inferentieprestaties verbeteren om de rekenkracht volledig te benutten
OceanStor M900 is de eerste architectuur in de sector waarin de CPU, netwerkcontrollerunit en NAND-controllerunit zijn geïntegreerd. Het biedt native KV-semantiek, waardoor een one-hop-verbinding van de NPU van de SuperPoD naar SSD's mogelijk wordt. Hierdoor zijn protocolconversie en CPU-doorsturing niet langer nodig en wordt de toegangsvertraging teruggebracht van milliseconden naar 60 microseconden, een vermindering van 90%. Eén cluster levert een totale toegangsbandbreedte van 40 TB/s, 1,5 keer hoger dan die van vergelijkbare oplossingen. In typische AI-programmeeromgevingen verdubbelt deze architectuur de tokendoorvoer van het inferentiecluster en halveert deze de time-to-first-token, waardoor rekenkracht wordt omgezet in productiviteit.
Tokenkosten verlagen voor een kostenefficiënte grootschalige toepassing van AI
OceanStor M900 maakt gebruik van de eerste KV-aware adaptieve opslagtechnologie in de sector. Deze voorspelt de levenscyclus van de KV-cache op basis van de waarde van de gegevens en verdeelt gegevens op intelligente wijze over verschillende opslagmedia. Deze technologie maakt tot 24 schijfschrijvingen per dag (DWPD) mogelijk, verlengt de levensduur van SSD's met een factor 16 en waarborgt drie jaar lang stabiliteit. Door de kosten voor mediavervanging en exploitatie en onderhoud (O&M) te verlagen, verlaagt deze technologie de langetermijnkosten van grootschalige AI-inferentie-infrastructuur en maakt zij een snellere toepassing van AI mogelijk.
Naarmate AI wordt uitgebreid naar belangrijke productiesystemen in uiteenlopende sectoren, ontwikkelt AI-infrastructuur zich van een rekenkrachtgericht model naar nauwere samenwerking tussen rekenkracht, netwerk en opslag. Context Memory Storage zal essentieel zijn om de capaciteit en efficiëntie van de toegang tot KV-caches voor inferentie op hyperscale-niveau voortdurend te verbeteren.
View original content:https://www.prnewswire.com/nl/persberichten/huawei-introduceert-oceanstor-m900-context-memory-storage-om-ai-inferentie-in-hyperscale-datacenters-te-versnellen-302883157.html