Nieuwe functionaliteit in Cortex AI Gateway selecteert automatisch het juiste AI-model voor elke taak. In eigen tests van Snowflake is de tokenefficiëntie tot wel drie keer zo hoog geworden, met behoud van kwaliteit.
Sneeuwvlok, Snowflake, het bedrijf achter de AI Data Cloud, introduceert dynamische modelroutering, een nieuwe functie in Cortex AI Gateway en de vlaggenschip AI-producten van Snowflake. Deze functie selecteert automatisch het AI-model dat de beste balans biedt tussen kwaliteit, snelheid en kosten voor een bepaalde taak. Het doel is om bedrijven te helpen onnodige AI-kosten te verlagen naarmate het gebruik van AI-toepassingen en -agents toeneemt.
In plaats van voor alle taken hetzelfde, vaak het meest geavanceerde en duurste AI-model te gebruiken, maakt dynamische modelbesturing in Cortex AI Gateway Wijs eenvoudigere en repetitieve taken toe aan efficiëntere modellen. Taken die een meer geavanceerde analyse en redenering vereisen, kunnen worden toegewezen aan geavanceerdere en krachtigere modellen.
Uit interne tests van Snowflake is gebleken dat de aanpak duidelijke efficiëntievoordelen oplevert. AI-agenten die gebruikmaken van dynamische modelbesturing met Cortex AI Gateway bouwden een DBT-pipeline met tot wel drie keer hogere token-efficiëntie, terwijl de kwaliteit behouden bleef, vergeleken met het gebruik van een frontier-model alleen. In een aparte test voerden ontwikkelteams hetzelfde aantal pull requests uit met 25 procent hogere token-efficiëntie.
Bedrijven worden steeds voorzichtiger met de economische aspecten van AI. De vraag is niet langer hoeveel AI ze gebruiken, maar of die AI zich vertaalt in betekenisvolle zakelijke waarde., zegt Sridhar Ramaswamy, CEO van Snowflake. Om efficiëntie te bereiken met AI is de flexibiliteit nodig om voor elke individuele taak het meest geschikte model te gebruiken naarmate het landschap verandert. De rol van Snowflake is om die complexiteit te beheren, zodat klanten zich kunnen concentreren op resultaten, terwijl wij op de achtergrond de modelselectie optimaliseren.
Sneeuwvlok Tegelijkertijd wordt het aanbod van open AI-modellen in Snowflake Cortex AI uitgebreid. DeepSeek-V4-Flash 0731 wordt beschikbaar in privévoorvertoning En GLM-5.3 wordt beschikbaar in privévoorvertoning binnenkort. Ze vullen elkaar aan. modellen van onder meer Anthropic, OpenAI, Google, SpaceXAI en Mistral..
Daarnaast worden er ook nieuwe functies geïntroduceerd om het gebruik en de kosten van AI te volgen en te controleren, bestedingslimieten en quota in te stellen en AI-kosten te verdelen over bijvoorbeeld verschillende afdelingen en kostenplaatsen.
Dynamische modelroutering integreert in de AI-producten van Snowflake Sneeuwvlok Coco En Snowflake CoWork en kan ook worden gebruikt door AI-agenten van derden via de Cortex AI Gateway.
Het nieuws in het kort:
- Automatische modelbesturing op basis van onder meer kwaliteit, snelheid en kosten.
- Tot wel 3x hogere token-efficiëntie in interne Snowflake-tests*
- Nieuwe open modellen, waaronder DeepSeek-V4-Flash 0731 en GLM-5.3
- Nieuwe tools om de AI-kosten van bedrijven te volgen, toe te wijzen en te beperken.
- Het gebruik van data en AI wordt beheerd binnen het beveiligings- en governancekader van Snowflake.
Over Snowflake
Snowflake is hét platform voor het AI-tijdperk, waarmee bedrijven sneller kunnen innoveren en meer waarde uit data kunnen halen. Wereldwijd gebruiken meer dan 13.900 klanten, waaronder honderden van 's werelds grootste bedrijven, Snowflake's AI Data Cloud om data, apps en AI veilig te bouwen, te gebruiken en te delen. Met Snowflake worden data en AI voor iedereen een transformatie.
