Europeiskt AI-styrningslager vill förändra hur företag bygger AI genom att stoppa onödiga modellanrop innan de når GPU:n. Nya benchmarkresultat visar enligt bolaget att upp till 89 procent av AI-anropen kan undvikas redan före exekvering.
Den dyraste AI:n är den som aldrig borde ha körts. Det är utgångspunkten för de benchmarkresultat som VORTIQ-X Consilium nu offentliggör. Enligt bolaget visar resultaten att dess AI-styrningsplattform kan stoppa, hålla tillbaka eller helt undvika onödiga AI-exekveringar innan de når produktionsmiljö. Därmed minskar både antalet modellanrop, tokenförbrukningen och GPU-energiförbrukningen, samtidigt som legitima arbetsflöden kan fortsätta utan onödiga förseningar.

Publiceringen väcker samtidigt en större fråga om AI-marknadens utveckling. Om den största kostnaden, energiförbrukningen och säkerhetsrisken ligger i AI-processer som aldrig borde ha startats, varför fortsätter branschen att fokusera på snabbare beräkningskraft i stället för att styra vilka AI-beslut som över huvud taget ska få genomföras?
Från AI-acceleration till AI-styrning
Under de senaste åren har AI-industrin dominerats av investeringar i kraftfullare GPU:er, större språkmodeller och högre prestanda. NVIDIA har blivit världens högst värderade teknikbolag genom att leverera infrastrukturen bakom denna utveckling, samtidigt som lösningar som NeMo Guardrails fokuserar på säkerheten kring modellernas svar.
VORTIQ-X menar däremot att den verkliga utmaningen i reglerade verksamheter inte längre handlar om hur snabbt AI kan arbeta.
Den avgörande frågan är i stället om AI över huvud taget ska få agera innan den flyttar pengar, öppnar känslig information, förändrar affärssystem eller påverkar kritiska verksamheter. Enligt bolaget fattas det beslutet i ett separat styrningslager som ligger ovanpå modeller, molnplattformar och hårdvara och som inte ägs av någon enskild leverantör.

“Acceleration driver AI. Auktoritet styr AI. Den strategiskt viktiga frågan för varje organisation är inte längre vilken GPU som används, utan vem som kontrollerar själva beslutet ovanpå infrastrukturen. Det lagret fungerar ovanpå både NVIDIA och andra acceleratorplattformar.”
Benchmark visar omfattande minskning av AI-anrop
I ett två timmar långt benchmarktest omfattande 19 676 AI-händelser och 18 682 skyddade AI-åtgärder rapporterar VORTIQ-X följande resultat:
- 1 890 modellintegritetsrelaterade händelser stoppades eller hölls tillbaka innan någon AI-modell exekverades, motsvarande en stopprate på 38,78 procent.
- 0 otillåtna godkännanden.
- 0 felaktiga routningsbeslut.
- 0 oväntade endpoint-fel.
- 0 överträdelser av lagringspolicy.
- Replay-verifiering genomfördes utan avvikelser och simulerade manipulationsförsök identifierades korrekt.
- Falska positiva resultat uppges ligga under en procent. I bolagets interna tester över åtta olika språkmodeller rapporteras inga falska positiva utfall.
Benchmarken visar dessutom att:
- 6 480 av 7 200 modellanrop kunde undvikas, motsvarande 90 procent.
- Cirka 604 080 tokens aldrig behövde genereras, en minskning på 90,1 procent.
Separat benchmark visar minskad GPU-energiförbrukning
I ett fristående benchmark med fokus på energiförbrukning rapporterar VORTIQ-X:
- 23 930 undvikna modellanrop
- Cirka 4,1 miljoner undvikna tokens
- 14,42 procents minskning av total uppmätt GPU-energiförbrukning.
- 65,27 procents minskning av dynamisk inferensenergi när tomgångsförbrukning exkluderats.
Bolaget framhåller att resultaten varierar beroende på arbetsbelastning, modeller och policykonfigurationer men beskriver benchmarken som ett bevis på att mellan cirka 38 och 90 procent av onödig AI-exekvering kan undvikas beroende på användningsområde.
Stoppar AI innan kostnaderna uppstår
Enligt VORTIQ-X handlar den stora vinsten inte om att göra varje enskilt AI-anrop billigare.
I moderna agentbaserade AI-miljöer kan ett enda felaktigt eller obekräftat svar leda till nya modellanrop, fler AI-agenter, fler verktygsanrop och ökade kostnader genom hela infrastrukturen.
Bolagets strategi är därför att stoppa dessa kedjereaktioner redan innan de startar.
Den billigaste, mest energieffektiva och säkraste AI-exekveringen är enligt VORTIQ-X den som aldrig behöver köras.
Styrning i realtid utan märkbar fördröjning
En vanlig invändning mot styrning före exekvering är risken för högre svarstider. Benchmarkresultaten visar enligt VORTIQ-X följande p95-latenser under full belastning:
| Kontrollpunkt | p95-latens |
|---|---|
| Styrd modellservering | 215 ms |
| Kubernetes/vLLM-routning | 190 ms |
| Cyber- och kontinuitetsroutning | 13 ms |
| Suverän inlärning | 7 ms |
| PRIVENTRA-arbetsflöde | 0,6 ms |
| Bevisloggning | 0,6 ms |
| Authority Endpoint Sidecar (27 steg) | 10 ms |
| Authority Decision (27 steg) | 10 ms |
Enligt bolaget innebär detta att AI-styrning kan ske i realtid utan att bli en märkbar belastning för prestandan.
Minskade kostnader och lägre risk
För organisationer som använder AI innebär varje undviket modellanrop:
- lägre kostnader för tokens,
- mindre GPU-användning,
- lägre energiförbrukning,
- minskat koldioxidavtryck,
- minskad regulatorisk och juridisk risk.
VORTIQ-X menar därför att AI-styrning utvecklas från att vara en säkerhetsfunktion till att bli ett verktyg för både kostnadskontroll och effektivare AI-infrastruktur.
Byggd för flera modeller och plattformar
Bolaget beskriver sin lösning som ett kompletterande styrningslager snarare än en ersättning för befintliga AI-plattformar.
VORTIQ-X är utvecklad för att fungera ovanpå olika språkmodeller, molnplattformar och acceleratorer och kan användas i privata AI-miljöer, lokala installationer, air gappade system, bare metal-infrastruktur, suveräna moln, fleragentssystem, RAG-arkitekturer, robotik och automatiserade arbetsflöden.
Företaget uppger dessutom att tekniken bygger på svensk immaterialrätt med patentansökningar inlämnade via Patent- och registreringsverket (PRV). Plattformen är utvecklad för att kunder själva ska kunna välja var data lagras och vilken jurisdiktion som ska gälla, utan beroende av en enskild molnleverantör.
Benchmarken är öppen för granskning
VORTIQ-X betonar att benchmarkresultaten inte ska accepteras okritiskt.
Metodik, testupplägg och resultat finns tillgängliga för granskning och bolaget uppmanar kunder, forskare och branschaktörer att själva utvärdera lösningen i sina egna AI-miljöer.
“Vi är inte rädda för att bli granskade. Tvärtom vill vi bli testade. Den enda AI som hör hemma i banker, sjukhus, myndigheter eller kritisk infrastruktur är AI vars beslut går att bevisa har styrts innan den agerade. Alla som säljer AI-acceleration borde fråga sig vem som faktiskt äger det beviset. Svaret är inte chiptillverkaren.”
Raymond Steen, CTO och medgrundare, VORTIQ-X Consilium
Om VORTIQ-X Consilium
VORTIQ-X Consilium är ett AI-teknikföretag med svensk immaterialrätt som utvecklar deterministisk AI-styrning i realtid för reglerade och verksamhetskritiska miljöer. Företaget fokuserar på verifierbar styrning, granskningsbarhet, cybersäkerhet och suveräna AI-distributioner för organisationer i Europa, Mellanöstern och Afrika.








