Upstage Solar Open 2 (Solar-Open2-250B): ein 250B‑Modell, das nur 15B pro Token ausführt.

24. Juli 2026, 06:08

Koreas Upstage hat gerade Solar Open 2 veröffentlicht, ein Open-Weight-LLM, das von Grund auf neu für agentische Arbeit neu gebaut wurde – die mehrstufigen, tool-calling, dokument‑intensiven Aufgaben, die Kontext verschlingen. Es ist ein Mixture-of-Experts: 250 B Gesamtparameter, aber pro Token werden nur 15 B aktiviert. Sie haben nur 2,3 % der vorherigen Generation wiederverwendet. Dies ist ein von Grund auf neu gebautes Modell mit einem alten Namen.

Der Trick liegt im Attention-Stack. Drei Linear-Attention-Schichten pro Softmax-Schicht, sodass ein 1 M-Token-Kontext mit etwa einem Viertel des VRAMs auskommt, das ein Full-Softmax-Design benötigen würde. Quantisiert passt es auf zwei H200s. Upstage behauptet, dass es DeepSeek V4 Flash und Mistral Medium 3.5 bei Agent-Benchmarks übertrifft – Spitzenwerte mit einem aktiven Budget von 15 B.

Wo Sie es ausführen können

Die Gewichte sind live auf Hugging Face unter einer Apache-2.0-basierten Lizenz verfügbar, kommerzielle Nutzung ist erlaubt. Selbst hosten Sie sie oder holen Sie sich die NVFP4-Quantisierung, wenn Sie knapp bei GPU sind. Richten Sie Ihr Agent-Framework darauf aus und los.

Warum es wichtig ist

Dies ist ein nationales Projekt. Unterstützt von Koreas souveräner KI-Initiative plant Upstage, es in Daum – 10 M wöchentliche Nutzer – zu integrieren und lokale NPU-Infrastruktur für Finanz, Recht, Medizin und Regierung aufzubauen. Ein neuer Open-Weights-Player, und er ist staatlich finanziert.