Poolside AI Launches 118B Laguna S2.1 with a 1M Context Window
TL;DR
Poolside AI hat mit Laguna S2.1 ein Open-Source-Modell mit 118 Milliarden Parametern vorgestellt, das lokal laufen soll und ein Kontextfenster von 1 Million Token mitbringt. Die Mixture-of-Experts-Architektur soll hohe Leistung liefern, ohne zwingend Rechenzentren vorauszusetzen, laut Bericht sogar auf Hardware wie einer RTX 3090. Relevant ist das für Teams, die lange Codebasen, Dokumentationen oder Agent-Workflows lokal auswerten wollen.
Nauti's Take
Bevor du das als lokalen Durchbruch einplanst, prüfe drei Dinge zuerst: echte Token-Leistung unter Dauerlast, VRAM- und RAM-Bedarf mit deinem Setup und die Qualität bei sehr langen Kontexten. Die Meldung stützt sich hier nur auf eine Quelle, deshalb sind vor allem die Hardware-Versprechen und die nutzbare Praxis bei 1 Million Token noch nicht sauber verifiziert.