Eurooppalainen tekoälyn hallintotaso haluaa muuttaa yritysten tekoälyn rakentamista pysäyttämällä tarpeettomat mallikutsut ennen kuin ne saavuttavat grafiikkasuorittimen. Yrityksen mukaan uudet vertailutulokset osoittavat, että jopa 89 prosenttia tekoälykutsuista voidaan välttää jo ennen niiden suorittamista.
Kallein tekoäly on se, jota ei olisi koskaan pitänyt ajaa. Se on lähtökohta vertailutuloksille, jotka VORTIQ-X-konsuli Yrityksen mukaan tulokset osoittavat, että sen tekoälyn hallinta-alusta voi pysäyttää, hidastaa tai kokonaan välttää tarpeettomia tekoälyn suorituksia ennen kuin ne pääsevät tuotantoon, mikä vähentää mallikutsuja, tokenin kulutusta ja näytönohjaimen virrankulutusta ja sallii samalla laillisten työnkulkujen jatkua ilman tarpeettomia viiveitä.

Julkaisu herättää myös laajemman kysymyksen tekoälymarkkinoiden kehityksestä. Jos suurin kustannus-, energiankulutus- ja tietoturvariski piilee tekoälyprosesseissa, joita ei olisi koskaan pitänyt käynnistää, miksi toimiala keskittyy edelleen nopeampaan laskentatehoon sen sijaan, että se valvoisi, mitkä tekoälypäätökset saavat alun perin toteuttaa?
Tekoälykiihdytyksestä tekoälyohjaukseen
Viime vuosina tekoälyteollisuutta ovat hallinneet investoinnit tehokkaampiin näytönohjaimiin, suurempiin kielimalleihin ja parempaan suorituskykyyn. NVIDIA on noussut maailman arvokkaimmaksi teknologiayritykseksi toimittamalla tämän kehityksen taustalla olevan infrastruktuurin ratkaisut, kuten NeMo-kaiteet keskittyy mallien vastauksiin liittyvään varmuuteen.
VORTIQ-X uskoo kuitenkin, että säänneltyjen yritysten todellinen haaste ei ole enää tekoälyn nopeus.
Ratkaiseva kysymys on sen sijaan, pitäisikö tekoälyn antaa toimia lainkaan ennen kuin se siirtää rahaa, avaa arkaluonteisia tietoja, muuttaa liiketoimintajärjestelmiä tai vaikuttaa kriittisiin toimintoihin. Yrityksen mukaan tämä päätös tehdään erillisessä hallintotasossa, joka sijaitsee mallien, pilvialustojen ja laitteiston päällä eikä ole minkään yksittäisen toimittajan omistuksessa.

“Kiihtyvyys ohjaa tekoälyä. Auktoriteetti hallitsee tekoälyä. Jokaisen organisaation strategisesti tärkeä kysymys ei ole enää se, mitä näytönohjainta käytetään, vaan kuka hallitsee itse päätöksiä infrastruktuurin päällä. Tämä kerros toimii sekä NVIDIAn että muiden kiihdytysalustojen päällä.”
Vertailuarvo osoittaa tekoälypuheluiden määrän valtavan vähenemisen
Kahden tunnin vertailutestissä, johon sisältyi 19 676 tekoälytapahtumaa ja 18 682 suojattua tekoälytoimintoa VORTIQ-X raportoi seuraavat tulokset:
- 1 890 mallin eheyteen liittyvää tapahtumaa pysäytettiin tai pidätettiin ennen minkään tekoälymallin suorittamista, mikä vastaa pysäytysnopeutta 38,78 prosenttia.
- 0 luvatonta hyväksyntää.
- 0 virheellistä reitityspäätöstä.
- 0 odottamatonta päätepistevirhettä.
- 0 säilytyskäytäntörikkomusta.
- Toiston varmennus suoritettiin ilman poikkeamia ja simuloidut manipulointiyritykset tunnistettiin oikein.
- Väärien positiivisten tulosten on raportoitu olevan alle yksi prosentti. Yrityksen sisäiset testit kahdeksalla eri kielimallilla eivät osoita vääriä positiivisia tuloksia.
Vertailuarvo osoittaa myös, että:
- 6 480/7 200 mallipuhelua voitaisiin välttää, mikä vastaa 90 prosenttia.
- Noin 604 080 tokenia ei koskaan tarvinnut luoda, vähennys 90,1 prosenttia.
Erillinen vertailuarvo osoittaa näytönohjaimen virrankulutuksen pienenemistä
Itsenäisessä energiankulutukseen keskittyvässä vertailuarvossa VORTIQ-X raportoi:
- 23 930 vältettyä mallipuhelua
- Noin 4,1 miljoonaa tokenia vältetty
- 14,42 prosenttia GPU:n mitatun kokonaisvirrankulutuksen väheneminen.
- 65,27 prosenttia dynaamisen päättelyenergian väheneminen, kun tyhjäkäyntikulutus on jätetty pois.
Yritys korostaa, että tulokset vaihtelevat työmäärän, mallien ja käytäntömääritysten mukaan, mutta kuvailee vertailuarvoa todisteena siitä, että noin 38 ja 90 prosenttia tarpeetonta tekoälyn suorittamista voidaan välttää sovelluksesta riippuen.
Tekoälyn pysäyttäminen ennen kuin kustannuksia syntyy
Mukaan VORTIQ-X Suurin voitto ei ole siinä, että jokaisesta tekoälypuhelusta tulisi halvempi.
Nykyaikaisissa agenttipohjaisissa tekoälyympäristöissä yksi virheellinen tai vahvistamaton vastaus voi johtaa uusiin mallikutsuihin, useampiin tekoälyagentteihin, useampiin työkalukutsuihin ja kustannusten nousuun koko infrastruktuurissa.
Yrityksen strategiana on siis pysäyttää nämä ketjureaktiot ennen kuin ne edes alkavat.
VORTIQ-X:n mukaan halvin, energiatehokkain ja turvallisin tekoälyn toteutus on sellainen, jota ei koskaan tarvitse suorittaa.
Reaaliaikainen ohjaus ilman havaittavaa viivettä
Yleinen vastalause suoritusta edeltävälle ohjaukselle on pidempien vasteaikojen riski. VORTIQ-X:n mukaan vertailutulokset osoittavat seuraavat p95-latenssit täydellä kuormalla:
| Tarkastuspiste | p95-latenssi |
|---|---|
| Kontrolloitu mallin käyttö | 215 ms |
| Kubernetes/vLLM-reititys | 190 ms |
| Kyber- ja jatkuvuusreititys | 13 ms |
| Ylivertainen oppiminen | 7 ms |
| PRIVENTRA-työnkulku | 0,6 ms |
| Todisteiden kirjaaminen | 0,6 ms |
| Viranomaisen päätepisteen sivuvaunu (27 vaihetta) | 10 ms |
| Viranomaisen päätös (27 vaihetta) | 10 ms |
Yrityksen mukaan tämä tarkoittaa, että tekoälyn ohjaus voi tapahtua reaaliajassa ilman, että siitä tulee havaittavaa suorituskyvyn rasitusta.
Pienemmät kustannukset ja pienempi riski
Tekoälyä käyttäville organisaatioille jokainen vältetty mallikutsu tarkoittaa:
- alhaisemmat tokenien kustannukset,
- vähemmän näytönohjaimen käyttöä,
- pienempi energiankulutus,
- pienempi hiilijalanjälki,
- pienempi sääntelyyn ja lakiin liittyvä riski.
VORTIQ-X uskoo siksi, että tekoälyn hallinta on kehittymässä turvallisuustoiminnosta työkaluksi sekä kustannusten hallintaan että tehokkaampaan tekoälyinfrastruktuuriin.
Rakennettu useille malleille ja alustoille
Yritys kuvailee ratkaisuaan täydentäväksi hallintokerrokseksi pikemminkin kuin korvaavaksi olemassa oleville tekoälyalustoille.
VORTIQ-X on suunniteltu toimimaan useiden eri kielimallien, pilvialustojen ja kiihdyttimien päällä, ja sitä voidaan käyttää yksityisissä tekoälyympäristöissä, paikallisissa asennuksissa, ilmarakojärjestelmissä, paljaassa metalli-infrastruktuurissa, itsenäisissä pilvipalveluissa, moniagenttijärjestelmissä, RAG-arkkitehtuureissa, robotiikassa ja automatisoiduissa työnkuluissa.
Yritys toteaa myös, että teknologia perustuu Ruotsin immateriaalioikeuslakiin ja että patenttihakemukset on jätetty Ruotsin patentti- ja rekisterihallituksen (PRV) kautta. Alusta on suunniteltu siten, että asiakkaat voivat valita, mihin tiedot tallennetaan ja mitä lainkäyttöaluetta sovelletaan, ilman riippuvuutta yhdestä pilvipalveluntarjoajasta.
Vertailuarvo on avoinna arvioitavaksi
VORTIQ-X korostaa, että vertailuarvojen tuloksia ei tule hyväksyä kritiikittä.
Menetelmät, testiasetukset ja tulokset ovat saatavilla tarkasteltavaksi, ja yritys kannustaa asiakkaita, tutkijoita ja alan toimijoita arvioimaan ratkaisua itse omissa tekoälyympäristöissään.
“Emme pelkää tarkkailua. Päinvastoin, haluamme tulla testatuiksi. Ainoa tekoäly, jonka kuuluu olla pankeissa, sairaaloissa, valtion virastoissa tai kriittisessä infrastruktuurissa, on tekoäly, jonka päätöksiä voidaan todistaa ohjanneen ennen niiden toimintaa. Jokaisen, joka myy tekoälyn kiihdytystä, tulisi kysyä itseltään, kuka oikeasti omistaa nämä todisteet. Vastaus ei ole sirun valmistaja.”
Raymond Steen, teknologiajohtaja ja yksi VORTIQ-X Consiliumin perustajista
Tietoja VORTIQ-X Consiliumista
VORTIQ-X-konsuli on tekoälyteknologiayritys, jolla on ruotsalaiset immateriaalioikeudet ja joka kehittää reaaliaikaista determinististä tekoälyn hallintaa säännellyille ja kriittisille ympäristöille. Yritys keskittyy todennettavissa olevaan hallintaan, auditoitavuuteen, kyberturvallisuuteen ja itsenäisiin tekoälyn käyttöönottoihin organisaatioille Euroopassa, Lähi-idässä ja Afrikassa.








