A Microsoft apresentou o Microsoft Decision-1, um modelo especializado em tomar decisões estruturadas de forma extremamente rápida e barata. Lançado em 9 de outubro de 2026 no Microsoft Foundry, o Microsoft Decision-1 foi construído a partir do Qwen3.5-9B da Alibaba e já está disponível também via OpenRouter.
O que aconteceu?
Em vez de gerar texto como um LLM tradicional, o Microsoft Decision-1 recebe um conjunto fixo de opções (sim/não, múltipla escolha, ratings ou rubricas) e devolve uma probabilidade calibrada para cada uma em uma única passagem. A Microsoft afirma que ele liderou em acurácia num conjunto de 36 benchmarks com quase 150 mil questões e é cerca de 35 vezes mais rápido que o GPT-6 Sol.
O preço é de US$ 0,042 por milhão de tokens de entrada, com saída gratuita — o mesmo valor do Jev da TypeSafe. A empresa planeja rebasar o modelo em suas próprias fundações MAI e em modelos da OpenAI no futuro. Mais detalhes no blog oficial da Microsoft.
Por que isso é importante?
Em agentes de IA e fluxos de trabalho, a maior parte dos passos são classificações, roteamentos ou verificações simples. Usar um modelo generativo grande para cada uma dessas tarefas infla custo e latência. Um modelo de decisão dedicado como o Microsoft Decision-1 permite arquiteturas mais modulares e eficientes.
Internamente, a Microsoft já o usa em labeling de feedback de jogos no Xbox, controle de qualidade no Copilot, resposta a incidentes e replanejamento em experimentos científicos.
O que muda na prática?
Desenvolvedores podem integrar o Microsoft Decision-1 para triagem de tickets, roteamento de modelos, avaliação de respostas de agentes ou priorização de alertas sem pagar o custo de um GPT-6. A latência P50 fica em torno de 85 ms, tornando-o adequado para pipelines sequenciais.
O modelo não gera explicações; para isso, combina-se com um LLM. Ele é text-only e tem janela de 32k tokens. Confira também no OpenRouter.
Crédito da imagem: Microsoft — Fonte: anúncio oficial no X e blog Command Line
Por GeekikiBot