Cortex AI Gatewayn uusi toiminto valitsee automaattisesti oikean tekoälymallin kullekin tehtävälle. Snowflaken omissa testeissä token-tehokkuus kasvoi jopa kolminkertaiseksi laatua säilyttäen.
Lumihiutale, tekoälytietopilven takana oleva yritys, lanseeraa dynaamisen mallin reitityksen, uuden ominaisuuden Cortex AI Gatewayn ja Snowflaken tekoälytuotteiden lippulaivatuotteissa. Se valitsee automaattisesti tekoälymallin, joka tarjoaa parhaan tasapainon laadun, nopeuden ja kustannusten välillä tietyssä tehtävässä. Tavoitteena on auttaa yrityksiä vähentämään tarpeettomia tekoälykustannuksia tekoälysovellusten ja -agenttien käytön lisääntyessä.
Sen sijaan, että käytettäisiin samaa ja usein edistyneintä ja kalleinta tekoälymallia kaikkiin tehtäviin, dynaaminen mallinhallinta Cortex AI -yhdyskäytävä Ohjaa yksinkertaisemmat ja toistuvat tehtävät tehokkaampiin malleihin. Tehtävät, jotka vaativat edistyneempää analyysiä ja päättelyä, voidaan osoittaa kehittyneemmille ja tehokkaammille malleille.
Snowflaken sisäisissä testeissä lähestymistapa on tuottanut selkeitä tehokkuushyötyjä. Dynaamista mallinhallintaa Cortex AI Gatewayn kanssa käyttävät tekoälyagentit rakensivat DBT-putken, jonka token-tehokkuus oli jopa kolme kertaa korkeampi laatua säilyttäen verrattuna pelkän rajamallin käyttöön. Erillisessä testissä kehitystiimit suorittivat saman määrän pull-pyyntöjä 25 prosenttia korkeammalla token-tehokkuudella. *
–Yritykset ovat yhä tarkempia tekoälyn taloudellisista vaikutuksista. Kysymys ei ole enää siitä, kuinka paljon tekoälyä ne käyttävät, vaan siitä, muunnetaanko tekoäly merkitykselliseksi liiketoiminta-arvoksi., sanoo Sridhar Ramaswamy, Snowflaken toimitusjohtaja. Tehokkuuden saavuttaminen tekoälyn avulla edellyttää joustavuutta käyttää kuhunkin yksittäiseen tehtävään parhaiten sopivaa mallia tilanteen kehittyessä. Snowflaken rooli on hallita tätä monimutkaisuutta, jotta asiakkaat voivat keskittyä tuloksiin, kun me optimoimme mallin valinnan taustalla.
Lumihiutale samanaikaisesti laajentaen avoimen tekoälymallien valikoimaa Snowflake Cortex AI:ssa. DeepSeek-V4-Flash 0731 tulee saataville vuonna yksityinen esikatselu ja GLM-5.3 tulee saataville vuonna yksityinen esikatselu pian. Ne täydentävät mallit muun muassa Anthropicilta, OpenAI:lta, Googlelta, SpaceXAI:lta ja Mistralin.
Lisäksi lanseerataan uusia toimintoja tekoälyn käytön ja kustannusten seurantaan ja hallintaan, kulutusrajojen ja -kiintiöiden asettamiseen sekä tekoälykustannusten jakamiseen esimerkiksi eri osastojen ja kustannuspaikkojen kesken.
Dynaaminen mallin reititys integroituu Snowflaken tekoälytuotteisiin Lumihiutale Coco ja Lumihiutale-työryhmä ja sitä voivat käyttää myös kolmannen osapuolen tekoälyagentit Cortex AI Gatewayn kautta.
Lyhyesti uutisesta:
- Automaattinen mallinohjaus, joka perustuu muun muassa laatuun, nopeuteen ja kustannuksiin
- Jopa 3 kertaa suurempi token-tehokkuus Snowflaken sisäisissä testeissä*
- Uusia avoimia malleja, mukaan lukien DeepSeek-V4-Flash 0731 ja GLM-5.3
- Uusia työkaluja yritysten tekoälykustannusten seurantaan, kohdistamiseen ja rajoittamiseen
- Datan ja tekoälyn käyttöä hallitaan Snowflaken tietoturva- ja hallintokehyksen sisällä.
Tietoja Snowflakesta
Snowflake on tekoälyaikakauden alusta, jonka avulla yritykset voivat helposti innovoida nopeammin ja saada enemmän irti datasta. Yli 13 900 asiakasta maailmanlaajuisesti, mukaan lukien satoja maailman suurimpia yrityksiä, käyttää Snowflaken tekoälytietopilveä datan, sovellusten ja tekoälyn turvalliseen rakentamiseen, kuluttamiseen ja jakamiseen. Snowflaken avulla data ja tekoäly mullistavat kaikkien elämän.
