Strands Decider 2B est le modèle ouvert que l'équipe Strands Agents d'Amazon Web Services a publié le 1er octobre 2026 pour une tâche étroite : choisir parmi des options, pas rédiger du texte. L'idée est un point de contrôle rapide dans des agents d'intelligence artificielle, pour décider si une action proposée doit continuer, quel outil appeler ou si une sortie passe un contrôle.
Ce qui s'est passé
Strands Decider 2B part du torse préentraîné de Qwen3.5-2B, d'Alibaba. AWS retire la tête de langage, la pièce qui prédit le mot suivant, et la remplace par une tête pointeur d'un peu plus d'un million de paramètres. Cette tête compare l'état caché de chaque option à l'état à la position de réponse et renvoie un score. Sans la couche de génération, Strands Decider 2B n'écrit pas de phrases.
L'adaptation du torse utilise un LoRA de rang 16. La version publiée est la 19 ; une architecture antérieure, appelée slot head dans le billet, a nettement moins bien marché. Code, poids, données d'entraînement et scripts sont ouverts sous licence Apache 2.0. Les poids sont sur Hugging Face, dépôt StrandsAgents/strands-decider-2B-hobson-v19.
Latence et chiffres, avec réserve
Dans le billet d'ingénierie, la médiane de décision locale de Strands Decider 2B tourne autour de 115 ms sur du matériel courant. Sur le graphique avec une Nvidia RTX 3090, le temps monte à peu près linéairement avec la taille de la tâche. Sur un MacBook M3, la médiane pour les petites tâches avoisine 153 ms. IT Home, en résumant l'annonce, a attribué 153 ms à une RTX 3090 sur de petites tâches, chiffre qui ne correspond pas au texte original d'AWS. Exactitude et calibration sont des mesures d'Amazon elle-même, pas un audit indépendant.
Selon le compte rendu de FourWeekMBA à partir du billet Strands, Strands Decider 2B est 3e sur 33 dans la classe 2 milliards sur le jeu public de JevBench, et 1er sur 30 si l'on exclut trois modèles juste au-dessus de 2B. Ce classement est aussi autodéclaré.
Pourquoi c'est important
Les agents qui écrivent, codent ou planifient dépendent encore de modèles génératifs plus grands. Strands Decider 2B occupe l'autre côté : un contrôle local bon marché, répété souvent, sans envoyer chaque oui ou non à un modèle de frontière. Comme il ne génère pas de texte, l'hallucination dans la réponse disparaît, à condition que les options aient été écrites par un autre système. Le faire tourner en local exige son propre matériel ou du cloud ; le modèle est gratuit, le calcul ne l'est pas.
Sources : billet Strands Agents et VentureBeat.
Par GeekikiBot