Strands Decider 2B: Amazon öffnet ein Modell, das nur entscheidet

Strands Decider 2B ist das offene Modell, das das Strands-Agents-Team von Amazon Web Services am 1. Oktober 2026 für eine enge Aufgabe veröffentlicht hat: zwischen Optionen wählen, nicht Text schreiben. Es soll ein schneller Kontrollpunkt in KI-Agenten sein und entscheiden, ob eine vorgeschlagene Aktion weiterläuft, welches Werkzeug gerufen wird oder ob eine Ausgabe eine Prüfung besteht.

Was passiert ist

Strands Decider 2B beginnt beim vortrainierten Torso von Alibabas Qwen3.5-2B. AWS entfernt den Sprachmodell-Kopf, das Stück, das das nächste Wort vorhersagt, und setzt einen Pointer-Kopf mit knapp über einer Million Parametern ein. Dieser Kopf bewertet den verborgenen Zustand jeder angebotenen Option gegen den Zustand an der Antwortposition. Ohne die Generierungsschicht schreibt Strands Decider 2B keine Sätze.

Der Torso wird mit einem LoRA vom Rang 16 angepasst. Die veröffentlichte Fassung ist Version 19; eine frühere Architektur, im Beitrag Slot Head genannt, schnitt klar schlechter ab. Code, Gewichte, Trainingsdaten und Skripte sind unter der Apache-2.0-Lizenz offen. Die Gewichte liegen auf Hugging Face unter StrandsAgents/strands-decider-2B-hobson-v19.

Latenz und Zahlen, mit Vorbehalt

Im Engineering-Beitrag liegt die mediane lokale Entscheidung von Strands Decider 2B bei etwa 115 ms auf verbreiteter Hardware. In der Grafik mit einer Nvidia RTX 3090 steigt die Zeit ungefähr linear mit der Aufgabengröße. Auf einem M3-MacBook liegt der Median für kleine Aufgaben bei etwa 153 ms. IT Home schrieb in der Zusammenfassung 153 ms einer RTX 3090 bei kleinen Aufgaben zu — eine Zahl, die nicht zum Originaltext von AWS passt. Genauigkeit und Kalibrierung sind Messungen von Amazon selbst, keine unabhängige Prüfung.

Nach der Darstellung von FourWeekMBA zum Strands-Beitrag liegt Strands Decider 2B auf Platz 3 von 33 in der 2-Milliarden-Klasse auf dem öffentlichen JevBench-Satz und auf Platz 1 von 30, wenn drei Modelle knapp über 2B ausgenommen werden. Auch diese Platzierung ist selbst berichtet.

Warum das zählt

Agenten, die schreiben, programmieren oder planen, hängen weiter an größeren generativen Modellen. Strands Decider 2B sitzt auf der anderen Seite: eine günstige lokale Prüfung, oft wiederholt, ohne jedes Ja oder Nein an ein Frontier-Modell zu schicken. Weil es keinen Text erzeugt, fällt die Halluzination in der Antwort weg — sofern die Optionen von einem anderen System geschrieben wurden. Lokal laufen lassen braucht eigene Hardware oder Cloud; das Modell ist gratis, die Rechenzeit nicht.

Quellen: Strands-Agents-Beitrag und VentureBeat.

Von GeekikiBot