Microsoft представила Microsoft-Decision-1 — специализированную модель искусственного интеллекта, которая оценивает заранее заданные варианты ответа или действия. По данным компании, в тестах на принятие структурированных решений её задержка ответа оказалась в 35 раз меньше, чем у OpenAI GPT-6 Sol. Модель предназначена для классификации информации, проверки результатов и управления рабочими процессами.
Источник изображений: microsoft.com
Microsoft-Decision-1 не предназначена для свободной генерации текста, как обычный чат-бот. Получив вопрос и набор вариантов, она присваивает каждому вероятностную оценку. Дальнейшие действия определяет приложение: например, оно может разрешить ИИ-агенту выполнить предложенный шаг, потребовать повторной попытки или передать задачу на рассмотрение человеку.
Работа с моделью обходится недорого: $0,042 за 1 млн входных токенов, а выходные данные не тарифицируются. Такая схема особенно выгодна для приложений, которым приходится часто классифицировать запросы или выбирать дальнейшие действия. Microsoft-Decision-1 также можно использовать для направления запросов подходящим моделям, расстановки приоритетов задач и оценки качества ответов других ИИ-систем.
По заявлению Microsoft, новинка показала наибольшую точность среди сравниваемых моделей по совокупности 36 бенчмарков, охватывающих почти 150 000 вопросов. Задания этих тестов не использовались при обучении. Медианная задержка ответа оказалась в 35 раз меньше, чем у GPT-6 Sol, и в 2,5 раза меньше, чем у занявшей второе место по этому показателю H2O-Lightning-4B v1.1. Эти результаты получены в тестах самой Microsoft и относятся к задачам выбора из заданных вариантов.
Компания уже проверила модель в нескольких практических сценариях. Инженеры Xbox Research с её помощью распределили более 10 000 отзывов игроков по заранее определённым темам. По качеству классификации Microsoft-Decision-1 оказалась сопоставима с GPT-6 Sol, но работала более чем в 14 раз быстрее при затратах примерно в 200 раз ниже. В тестах команды Microsoft Copilot на оценку качества ответов она показала результат, сопоставимый с GPT-5.6 Luna, при стократном преимуществе в скорости.
Microsoft-Decision-1 построена на базе Alibaba Qwen3.5-9B, которая прошла дополнительное обучение для оценки вариантов за один проход. В дальнейшем Microsoft намерена создавать версии на базе других моделей, включая собственные MAI и системы OpenAI. Компания также проверяла устойчивость решений к изменениям формулировок и оформления запросов: в этих тестах модель меняла ответ в среднем в 1,3 % случаев, а при перефразировании вариантов или перестановке их порядка изменений не было.
Для оценки безопасности Microsoft использовала 11 бенчмарков с 5250 запросами, включая вредоносный контент, попытки обхода защитных ограничений и внедрения посторонних инструкций. По данным компании, модель отклоняла вредоносные запросы, сохраняя высокую полезность при выполнении допустимых задач. Microsoft-Decision-1 уже доступна на платформе Microsoft Foundry и через OpenRouter.
Источник:


MWC 2018
2018
Computex
IFA 2018






