Snowflake will AI-Kosten mit Model Routing statt Maximalmodell senken
TL;DR
Snowflake-CEO Sridhar Ramaswamy erklärt bei Bloomberg Open Interest, warum die nächste Phase von Enterprise AI vor allem eine Kostenfrage ist. Statt immer das größte verfügbare Modell zu nutzen, schickt Model Routing jede Anfrage an das Modell, das wirklich passt. Er warnt zudem davor, sich auf einen einzigen Anbieter zu verlassen, weil das ein klares Klumpenrisiko schafft. AI-Agents könnten Mitarbeitende außerdem von Routineaufgaben hin zu wertvolleren Tätigkeiten verschieben.
Nauti's Take
Die Chance ist konkret: Model Routing senkt Kosten sofort, weil einfache Anfragen nicht mehr auf dem teuersten Modell landen. Das Risiko steckt in der Komplexität, denn jede Routing-Schicht braucht Evaluation, Monitoring und klare Fallbacks.
Für kleine Teams lohnt sich der Einstieg mit zwei Modellen und einer messbaren Aufgabe, für große Setups zählt vor allem die Vermeidung von Anbieterabhängigkeit.