Avec Cortex AI Gateway, Snowflake veut permettre aux applications et aux agents de changer de modèle à mesure que les performances, les tarifs ou la disponibilité régionale évoluent. Les entreprises peuvent ainsi adapter leur architecture sans reconstruire leurs développements.
Le marché des modèles d’intelligence artificielle évolue rapidement. Les performances progressent, les prix changent et de nouvelles offres apparaissent régulièrement. Pour les entreprises, cette évolution peut imposer de revoir les connexions intégrées aux applications et aux agents. Snowflake cherche à réduire cette dépendance avec le routage dynamique de Cortex AI Gateway. La passerelle peut mettre à jour les décisions d’acheminement dans Snowflake CoCo, Snowflake CoWork et les agents tiers selon les modèles disponibles. Les clients n’ont donc pas à modifier leurs applications chaque fois qu’une nouvelle option devient plus adaptée à leurs besoins.
Une couche commune entre les applications et les modèles
Cortex AI Gateway sélectionne le modèle selon plusieurs critères comme la qualité attendue, la vitesse, le coût et les préférences définies par l’entreprise. Les tâches répétitives peuvent être confiées à des modèles moins consommateurs de ressources, tandis que les demandes nécessitant davantage de raisonnement sont orientées vers des modèles plus avancés. Cette couche d’intermédiation doit également faciliter l’adoption de nouveaux modèles. Snowflake prévoit notamment d’ajouter DeepSeek-V4-Flash 0731 et GLM-5.3 à Cortex AI, ainsi qu’à ses applications CoCo et CoWork.
Les entreprises peuvent ainsi faire évoluer la combinaison de modèles utilisée sans modifier chaque connexion ni redéployer leurs agents.
Des règles adaptées aux contraintes des entreprises
La sélection automatique ne supprime pas le contrôle des administrateurs. Ceux-ci peuvent déterminer les modèles et les fournisseurs auxquels les utilisateurs ont accès. Ces règles peuvent tenir compte de la disponibilité des services selon les régions ou des exigences propres aux secteurs réglementés. Cortex AI Gateway centralise également le suivi des tokens, des coûts et des limites de dépenses. Les choix de modèles peuvent ainsi évoluer tout en restant soumis aux politiques de gouvernance définies dans Snowflake.
Cette approche vise à dissocier le fonctionnement des applications du cycle d’évolution des modèles. Elle réduit les opérations de maintenance lorsque les performances ou les conditions tarifaires du marché changent.






