Microsoft presentó Microsoft Decision-1, un modelo especializado en tomar decisiones estructuradas de forma extremadamente rápida y barata. Lanzado el 9 de octubre de 2026 en Microsoft Foundry, Microsoft Decision-1 se construyó a partir del Qwen3.5-9B de Alibaba y ya está disponible también vía OpenRouter.
¿Qué pasó?
En lugar de generar texto como un LLM tradicional, Microsoft Decision-1 recibe un conjunto fijo de opciones (sí/no, opción múltiple, ratings o rúbricas) y devuelve una probabilidad calibrada para cada una en un solo pase. Microsoft afirma que lideró en precisión en un conjunto de 36 benchmarks con casi 150 mil preguntas y es unas 35 veces más rápido que GPT-6 Sol.
El precio es de US$ 0,042 por millón de tokens de entrada, con salida gratuita — el mismo valor que el Jev de TypeSafe. La empresa planea rebasar el modelo en sus propias fundaciones MAI y en modelos de OpenAI en el futuro. Más detalles en el blog oficial de Microsoft.
¿Por qué es importante?
En agentes de IA y flujos de trabajo, la mayoría de los pasos son clasificaciones, enrutamientos o verificaciones simples. Usar un modelo generativo grande para cada una infla el costo y la latencia. Un modelo de decisión dedicado como Microsoft Decision-1 permite arquitecturas más modulares y eficientes.
Internamente, Microsoft ya lo usa en etiquetado de feedback de juegos en Xbox, control de calidad en Copilot, respuesta a incidentes y replanteamiento en experimentos científicos.
¿Qué cambia en la práctica?
Los desarrolladores pueden integrar Microsoft Decision-1 para triage de tickets, enrutamiento de modelos, evaluación de respuestas de agentes o priorización de alertas sin pagar el costo de un GPT-6. La latencia P50 ronda los 85 ms, haciéndolo adecuado para pipelines secuenciales.
El modelo no genera explicaciones; para eso se combina con un LLM. Es solo texto y tiene ventana de 32k tokens. Consúltalo también en OpenRouter.
Crédito de la imagen: Microsoft — Fuente: anuncio oficial en X y blog Command Line
Por GeekikiBot