logo
Thuis Gevallen

VAST Data en AMD beweren 9x snellere tijd tot eerste token met KV Cache Offload op Instinct

Certificaat
China Beijing Qianxing Jietong Technology Co., Ltd. certificaten
China Beijing Qianxing Jietong Technology Co., Ltd. certificaten
Klantenoverzichten
De verkoopdeskundigen van de Technologieco. van Peking Qianxing Jietong, Ltd zijn zeer en geduldig. Zij kunnen citaten snel verstrekken. De kwaliteit en de verpakking van de producten zijn ook zeer goed. Onze samenwerking is zeer vlot.

—— 《Festfing DV》 LLC

Toen ik Intel cpu en Toshiba SSD dringend zocht, Zandig van Peking Qianxing Jietong gaf Technologieco., Ltd me heel wat hulp en kreeg me de producten die ik snel heb gewenst. Ik waardeer haar werkelijk.

—— Kitty Yen

Zandig van Peking Qianxing Jietong is Technologieco., Ltd een zeer zorgvuldige verkoper, die me aan configuratiefouten kan op tijd herinneren wanneer ik een server koop. De ingenieurs zijn ook zeer professioneel en kunnen het testende proces snel voltooien.

—— Strelkin Mikhail Vladimirovich

We zijn erg blij met onze ervaring met Beijing Qianxing Jietong. De productkwaliteit is uitstekend en de levering is altijd op tijd. Hun verkoopteam is professioneel, geduldig en zeer behulpzaam met al onze vragen. We waarderen hun steun enorm en kijken uit naar een langdurige samenwerking. Sterk aanbevolen!

—— Ahmad Navid

Kwaliteit: “Grote ervaring met mijn leverancier. De MikroTik RB3011 was al gebruikt, maar het was in zeer goede staat en alles werkte perfect.en al mijn zorgen werden snel aangepakt.- Zeer betrouwbare leverancier.

—— Geran Colesio

Ik ben online Chatten Nu

VAST Data en AMD beweren 9x snellere tijd tot eerste token met KV Cache Offload op Instinct

July 28, 2026
VAST Data heeft haar partnerschap met AMD uitgebreid om de AI-infrastructuur voor cloud- en enterpriseplatforms te verbeteren met modeltraining, inferentie, retrieval-augmented generation (RAG),en agentische AI-werkbelastingenDe geïntegreerde stack verenigt het VAST AI-besturingssysteem met 6e generatie AMD EPYC-processors, AMD Instinct GPU's, AMD-netwerkhardware en ROCm-software.

Deze samenwerking sluit aan bij een grote verschuiving in de industrie: de AI-infrastructuur ontwikkelt zich verder dan alleen opleidingsclusters om aanhoudende context, hoge concurentie inferentie,en werkstromen voor meerdere beurtenModerne AI-implementaties geven prioriteit aan efficiënte gegevensbeweging, geoptimaliseerd KV-cachebeheer, hoger GPU-gebruik en lage latentie toegang tot grote modellen en contextuele datasets.

VAST's Disaggregated Shared Everything (DASE) -architectuur dient als de verenigde gedeelde gegevenslaag voor deze moderne AI-omgevingen.evenementenstreaming, en kerngegevensdiensten onder één wereldwijde naamruimte, terwijl multi-tenancy en workload isolatie worden geleverd voor AI-clouds die verschillende gelijktijdige klant- en applicatietaken uitvoeren.

AMD EPYC 9006 Powers Next-Gen VAST Hardware

VAST neemt 6th Gen AMD EPYC 9006-serie (Venice) processors aan voor zijn komende 6th-gen CBox en 3rd-gen EBox systemen, die de hardwarebasis vormen van het VAST AI-besturingssysteem.Het EPYC 9006-platform introduceert PCIe Gen6-connectiviteit voor de hardwarelijn van VAST, waarbij de bandbreedte per generatie verdubbeld wordt.

laatste bedrijfscasus over VAST Data en AMD beweren 9x snellere tijd tot eerste token met KV Cache Offload op Instinct  0

De upgrade verhoogt de bestands- en objectopslag doorvoer en verlaagt de latentie voor database, data warehouse en event streaming workloads ondersteund door VAST DataBase en DataEngine.Verbeterde I/O-bandbreedte verlicht knelpunten in de computing, netwerken en NVMe-opslag, ten gunste van het laden van modellen, ophaalpijplijnen, toegang tot checkpoints en externe KV-cache-workflows die de limieten van het native GPU-geheugen overschrijden.

Tri-Player Referentie Architectuur met AMD en DriveNets

VAST, AMD en DriveNets bouwen gezamenlijk aan een unified AI-infrastructuurreferentiearchitectuur, waarbij AMD's Helios AI-infrastructuur op rackschaal, VAST AI OS en DriveNets AI Fabric-netwerken worden gecombineerd.Het kader biedt gestandaardiseerde inzetrichtlijnen voor AI-opleiding, inferentie, versterkingsleer en KV-cache-werklasten,het verstrekken van best practices op het gebied van dimensionering en beschikbaarheid voor ondernemingen die AI-fabrieken bouwen met een gedeelde data-infrastructuur en een netwerk met hoge prestaties.

VAST heeft ook zijn ecosysteembanden uitgebreid met inferentie leveranciers TensorMesh en EmbeddedLLM, met de nadruk op productie-grade inferentie architecturen voor agentic AI use cases,met specifieke integratie en lanceringsdetails die nog moeten worden bekendgemaakt.

Geoptimaliseerde KV Cache Offload voor High-Concurrency Inference

Een middelpunt van de bijgewerkte samenwerking is verbeterde KV-cache-offloading, met behulp van AMD Instinct GPU's, AMD Infinity Context, ROCm-software en het VAST AI-besturingssysteem.KV-cache slaat inferentie-gegenereerde aandachtsstatusgegevens op om interacties met meerdere beurten en AI-werkbelastingen in lange context te versnellen, maar grote cache-groottes verbruiken snel beperkt GPU-geheugen.

laatste bedrijfscasus over VAST Data en AMD beweren 9x snellere tijd tot eerste token met KV Cache Offload op Instinct  1

Het afladen of tieren van KV-cache naar high-performance gedeelde opslag bevrijdt GPU-geheugen voor actieve taken en behoudt tegelijkertijd contextuele gegevens voor latere inferentieverzoeken.Vroege tests op AMD Instinct MI355X GPU's leverden een 9x snellere time-to-first-token en 9.7x hogere token doorvoer voor hoge concurrent agentische AI-workloads via VAST-aangedreven KV-cache-offload, waarbij de prestaties variëren afhankelijk van de basislijn van de hardware, de werklast en de opslagconfiguratie.

Bovendien zijn de geautomatiseerde levenscyclusbeleid van VAST ¢ van toepassing op KV-cachedata, waardoor geplande vervaldatum en verwijdering van ingedeelde inhoud mogelijk zijn ¢ een cruciale functie voor het verwerken van gevoelige,Persoonlijke of gereguleerde inferentiegegevens.

High-Speed GPU-Storage Interconnect via Pensando Pollara 400

De architectuur gebruikt AMD Pensando Pollara 400 AI NIC's om AMD Instinct GPU's te verbinden met VAST-opslagclusters.de NIC maakt efficiënte gegevensoverdrachten van GPU naar opslag mogelijk, waarbij toegang met lage latentie wordt verleend tot NVMe-gebaseerde VAST-opslag voor KV-cache en algemene inferentie-workloads.

Dit ontwerp ontkoppelt contextbeheer schaalbaarheid van fysieke GPU geheugen limieten.VAST positioneert zijn platform als een verenigde gegevens- en uitvoeringslaag voor gedistribueerd modelbeheerVoor AI-cloudproviders verhoogt de architectuur het gebruik van de GPU en de operationele efficiëntie.ondersteuning van de overstap van de industrie van batchtraining en GPU-verhuur naar permanente inferentie- en agentische AI-diensten.

Beijing Qianxing Jietong Technology Co., Ltd.
Sandy Yang, directeur Global Strategy
WhatsApp / WeChat: +86 13426366826
Email: yangyd@qianxingdata.com
Website: www.qianxingdata.com/www.storagesserver.com
Zaken:
Distributie van ICT-producten/Systeemintegratie en diensten/Infrastructuuroplossingen
Met meer dan 20 jaar IT-distributie-ervaring werken we samen met toonaangevende wereldwijde merken om betrouwbare producten en professionele diensten te leveren.
“Technologie gebruiken om een intelligente wereld te bouwen”Uw betrouwbare ICT-productdienstverlener!
Contactgegevens
Beijing Qianxing Jietong Technology Co., Ltd.

Contactpersoon: Ms. Sandy Yang

Tel.: 13426366826

Direct Stuur uw aanvraag naar ons (0 / 3000)