VAST Data heeft haar partnerschap met AMD uitgebreid om de AI-infrastructuur voor cloud- en enterpriseplatforms te verbeteren met modeltraining, inferentie, retrieval-augmented generation (RAG),en agentische AI-werkbelastingenDe geïntegreerde stack verenigt het VAST AI-besturingssysteem met 6e generatie AMD EPYC-processors, AMD Instinct GPU's, AMD-netwerkhardware en ROCm-software.
Deze samenwerking sluit aan bij een grote verschuiving in de industrie: de AI-infrastructuur ontwikkelt zich verder dan alleen opleidingsclusters om aanhoudende context, hoge concurentie inferentie,en werkstromen voor meerdere beurtenModerne AI-implementaties geven prioriteit aan efficiënte gegevensbeweging, geoptimaliseerd KV-cachebeheer, hoger GPU-gebruik en lage latentie toegang tot grote modellen en contextuele datasets.
VAST's Disaggregated Shared Everything (DASE) -architectuur dient als de verenigde gedeelde gegevenslaag voor deze moderne AI-omgevingen.evenementenstreaming, en kerngegevensdiensten onder één wereldwijde naamruimte, terwijl multi-tenancy en workload isolatie worden geleverd voor AI-clouds die verschillende gelijktijdige klant- en applicatietaken uitvoeren.
AMD EPYC 9006 Powers Next-Gen VAST Hardware
VAST neemt 6th Gen AMD EPYC 9006-serie (Venice) processors aan voor zijn komende 6th-gen CBox en 3rd-gen EBox systemen, die de hardwarebasis vormen van het VAST AI-besturingssysteem.Het EPYC 9006-platform introduceert PCIe Gen6-connectiviteit voor de hardwarelijn van VAST, waarbij de bandbreedte per generatie verdubbeld wordt.
De upgrade verhoogt de bestands- en objectopslag doorvoer en verlaagt de latentie voor database, data warehouse en event streaming workloads ondersteund door VAST DataBase en DataEngine.Verbeterde I/O-bandbreedte verlicht knelpunten in de computing, netwerken en NVMe-opslag, ten gunste van het laden van modellen, ophaalpijplijnen, toegang tot checkpoints en externe KV-cache-workflows die de limieten van het native GPU-geheugen overschrijden.
Tri-Player Referentie Architectuur met AMD en DriveNets
VAST, AMD en DriveNets bouwen gezamenlijk aan een unified AI-infrastructuurreferentiearchitectuur, waarbij AMD's Helios AI-infrastructuur op rackschaal, VAST AI OS en DriveNets AI Fabric-netwerken worden gecombineerd.Het kader biedt gestandaardiseerde inzetrichtlijnen voor AI-opleiding, inferentie, versterkingsleer en KV-cache-werklasten,het verstrekken van best practices op het gebied van dimensionering en beschikbaarheid voor ondernemingen die AI-fabrieken bouwen met een gedeelde data-infrastructuur en een netwerk met hoge prestaties.
VAST heeft ook zijn ecosysteembanden uitgebreid met inferentie leveranciers TensorMesh en EmbeddedLLM, met de nadruk op productie-grade inferentie architecturen voor agentic AI use cases,met specifieke integratie en lanceringsdetails die nog moeten worden bekendgemaakt.
Geoptimaliseerde KV Cache Offload voor High-Concurrency Inference
Een middelpunt van de bijgewerkte samenwerking is verbeterde KV-cache-offloading, met behulp van AMD Instinct GPU's, AMD Infinity Context, ROCm-software en het VAST AI-besturingssysteem.KV-cache slaat inferentie-gegenereerde aandachtsstatusgegevens op om interacties met meerdere beurten en AI-werkbelastingen in lange context te versnellen, maar grote cache-groottes verbruiken snel beperkt GPU-geheugen.
Het afladen of tieren van KV-cache naar high-performance gedeelde opslag bevrijdt GPU-geheugen voor actieve taken en behoudt tegelijkertijd contextuele gegevens voor latere inferentieverzoeken.Vroege tests op AMD Instinct MI355X GPU's leverden een 9x snellere time-to-first-token en 9.7x hogere token doorvoer voor hoge concurrent agentische AI-workloads via VAST-aangedreven KV-cache-offload, waarbij de prestaties variëren afhankelijk van de basislijn van de hardware, de werklast en de opslagconfiguratie.
Bovendien zijn de geautomatiseerde levenscyclusbeleid van VAST ¢ van toepassing op KV-cachedata, waardoor geplande vervaldatum en verwijdering van ingedeelde inhoud mogelijk zijn ¢ een cruciale functie voor het verwerken van gevoelige,Persoonlijke of gereguleerde inferentiegegevens.
High-Speed GPU-Storage Interconnect via Pensando Pollara 400
De architectuur gebruikt AMD Pensando Pollara 400 AI NIC's om AMD Instinct GPU's te verbinden met VAST-opslagclusters.de NIC maakt efficiënte gegevensoverdrachten van GPU naar opslag mogelijk, waarbij toegang met lage latentie wordt verleend tot NVMe-gebaseerde VAST-opslag voor KV-cache en algemene inferentie-workloads.
Dit ontwerp ontkoppelt contextbeheer schaalbaarheid van fysieke GPU geheugen limieten.VAST positioneert zijn platform als een verenigde gegevens- en uitvoeringslaag voor gedistribueerd modelbeheerVoor AI-cloudproviders verhoogt de architectuur het gebruik van de GPU en de operationele efficiëntie.ondersteuning van de overstap van de industrie van batchtraining en GPU-verhuur naar permanente inferentie- en agentische AI-diensten.
Beijing Qianxing Jietong Technology Co., Ltd.
Sandy Yang, directeur Global Strategy
WhatsApp / WeChat: +86 13426366826
Email: yangyd@qianxingdata.com
Website: www.qianxingdata.com/www.storagesserver.com
Zaken:
Distributie van ICT-producten/Systeemintegratie en diensten/Infrastructuuroplossingen
Met meer dan 20 jaar IT-distributie-ervaring werken we samen met toonaangevende wereldwijde merken om betrouwbare producten en professionele diensten te leveren.
Technologie gebruiken om een intelligente wereld te bouwenUw betrouwbare ICT-productdienstverlener!
Sandy Yang, directeur Global Strategy
WhatsApp / WeChat: +86 13426366826
Email: yangyd@qianxingdata.com
Website: www.qianxingdata.com/www.storagesserver.com
Zaken:
Distributie van ICT-producten/Systeemintegratie en diensten/Infrastructuuroplossingen
Met meer dan 20 jaar IT-distributie-ervaring werken we samen met toonaangevende wereldwijde merken om betrouwbare producten en professionele diensten te leveren.
Technologie gebruiken om een intelligente wereld te bouwenUw betrouwbare ICT-productdienstverlener!



