Laguna S 2.1: 118B-Modell schlägt sich gegen 1,6T-Riesen

poolside hat Laguna S 2.1 veröffentlicht, ein Mixture-of-Experts-Modell mit 118B Gesamtparametern und 8B aktiven Parametern pro Token. Trotz seiner kompakten Größe erreicht es auf Terminal-Bench 2.1 70,2% und übertrifft damit Modelle wie DeepSeek-V4-Pro-Max (1,6T Parameter) und Nemotron 3 Ultra (550B). Auf DeepSWE erzielt es 40,4% und liegt damit über vielen größeren Modellen. Das Modell wurde in weniger als neun Wochen trainiert und unterstützt einen Kontext von bis zu 1M Tokens. poolside veröffentlicht alle Trajektorien der finalen Evaluierung, um Transparenz zu schaffen.
Laguna S 2.1 ist nach unserer Messung das fähigste agentische Codierungsmodell seiner Gewichtsklasse – mit großem Abstand.