VAST Undivided Attention – lagring för AI och HPC

Nyhet: VAST revolutionerar AI-prestanda – och Aixia levererar lösningen

 

VAST Data har precis lanserat VUA (VAST Undivided Attention) – en ny öppen mjukvaruteknik som kraftigt förbättrar hastigheten och effektiviteten vid AI-bearbetning. Aixia är stolta över att som VAST-partner kunna erbjuda denna banbrytande lösning till våra kunder.

 

Vad handlar det om?

När AI-modeller, som exempelvis stora språkmodeller (LLM), genererar text och analyser, skapas enorma mängder data (så kallade tokens) i realtid. Dessa tokens måste normalt lagras i serverns GPU-minne för att undvika tidskrävande omräkningar. Problemet är att GPU-minnet snabbt blir fullt – och då bromsas hela processen.

VASTs VUA löser detta genom att smart lagra dessa tokens på blixtsnabba NVMe-anslutna SSD-diskar. På så vis får GPU-servrarna tillgång till betydligt mer ”virtuellt” minne, utan att prestandan drabbas. Detta betyder att AI-tjänster kan skala upp snabbare, hantera mer komplexa frågor och samtidigt minska både svarstider och hårdvarukostnader.

Vad betyder det för en CFO?

  • Kortare svarstider = bättre användarupplevelse och konkurrensfördelar.

  • Mindre behov av att köpa fler dyra GPU:er.

  • Ökad effektivitet och lägre TCO (Total Cost of Ownership) för AI-infrastruktur.

Vad betyder det För en tekniker:

  • VUA skapar ett nytt cache-lager mellan GPU, CPU och NVMe, integrerat med GPUDirect.

  • Global, delad cache som kan hantera miljarder tokens och minimera ”cache misses”.

  • 292 % snabbare token-generering vid tester – och stöd för framtidens allt större AI-modeller.

 

Med VUA från VAST kan företag ta sina AI-satsningar till nästa nivå, samtidigt som de optimerar investeringarna i sin infrastruktur. Aixia hjälper er att implementera och anpassa lösningen efter era behov – från rådgivning till färdig drift.
Vill du veta mer om hur VUA kan accelerera din AI-strategi? Kontakta oss på Aixia!

Latest News

Skärmdump av AI-agentens råa fyrraders-output i terminalstil

När kunderna slutar googla

SEO handlar om att ranka. AEO handlar om att bli en del av AI-svaret. Så använder vi AI-agenter i egen…
Läs mer
Datacenter-tekniker övervakar kritiska GPU-system i företagsinfrastruktur

Kan Europa konkurrera med Kinas superdatorer?

Kinas LineShine toppar TOP500 med 2,198 exaflops. Men Europas svar är JUPITER, LUMI och Arrhenius. Här är vad nordiska företag…
Läs mer

AiQu och MLOps: Så stoppar du slöseriet med dyra GPU:er

AiQu is Aixia’s MLOps platform that helps organizations manage, schedule, and optimize AI workloads efficiently….
Läs mer

Ni har byggt en RAG. Grattis. Nu börjar det svåra.

Att bygga en RAG-applikation är enkelt. Att få den att producera pålitliga resultat i skala – det är det svåra….
Läs mer