JetBrains hat diese Woche Mellum2.1 veröffentlicht, das Update seines offenen 12-Milliarden-Parameter-Modells, optimiert für Code-Agenten. Die Architektur bleibt gleich wie Version 2 — Mixture-of-Experts mit 2,5 Milliarden aktiven Parametern pro Token — aber das Post-Training mit Reinforcement Learning in realen Repositories brachte einen deutlichen Sprung bei agentischen Aufgaben.
Was sich geändert hat
Laut der offiziellen Ankündigung im JetBrains-Blog wurde Mellum2.1 mit Reinforcement Learning in sandboxed Umgebungen trainiert, die reale Repositories simulieren. Das Modell kann nun Codebases erkunden, Dateien bearbeiten und eigene Änderungen verifizieren — Fähigkeiten, die die vorherige Version nicht konsistent erreichte.
Bei SWE-bench Verified (echte GitHub-Bugfixes) stieg die Punktzahl von 2,0% bei Mellum2 auf 47,0%. Bei SWE-bench Pro von 0% auf 28%. Bei Terminal-Bench 2.1 von 0,6% auf 17,4%. Bei LiveCodeBench v6 erreichte es 82,0, vor Qwen3.5-9B (75,4).
Im Vergleich zu Qwen3.5-9B in den eigenen Tests von JetBrains führt Mellum2.1 bei kurzen Aufgaben und Tool-Calling, während das chinesische Modell bei längeren und komplexeren Repositories besser abschneidet. Die Zahlen stammen aus der internen Bewertung des Unternehmens; großflächige unabhängige Bewertungen sind noch nicht veröffentlicht.
Warum es wichtig ist
Für Entwickler und Game-Studios, die Code-Agenten auf eigener Hardware ausführen wollen (ohne Cloud-APIs), bietet Mellum2.1 eine effiziente Option unter der Apache-2.0-Lizenz. JetBrains hebt den Durchsatz hervor: unter hoher Last auf einer H200 bedient das Modell fast doppelt so viele Tokens wie Qwen3.5-9B. Ein Multi-Token-Prediction-Head, noch in Vorbereitung, verspricht individuelle Anfragen weiter zu beschleunigen.
Das Modell ist auf Hugging Face als JetBrains/Mellum2.1-12B-A2.5B-Thinking verfügbar, mit 131.072-Token-Kontext. vLLM-Support existiert bereits; Ollama und LM Studio wurden angekündigt. Es gibt keine offizielle gehostete API — der Fokus liegt auf Self-Hosting.
Quellen
Transparenz: Dieser Inhalt wurde mit Hilfe von künstlicher Intelligenz erstellt, bearbeitet oder überprüft. Die Informationen wurden mit öffentlichen Beiträgen auf X und im Internet verfügbaren Quellen abgeglichen. Konsultieren Sie die Originalquellen, um den vollständigen Kontext zu überprüfen.
Von GeekikiBot