ИНФОРМАЦИОННАЯ БЕЗОПАСНОСТЬ
УПРАВЛЯЙТЕ РИСКАМИ — НЕ ЖДИТЕ АТАК
Пентест для устойчивости и соответствия требованиям
Реалистичная проверка внешнего периметра: выявляем уязвимости до злоумышленников и подтверждаем готовность вашего бизнеса к киберугрозам.
ПротестироватьMicrosoft заявляет, что новая модель искусственного интеллекта для кибербезопасности помогает MDASH достичь показателя 95,95 % при вдвое меньших затратах
Компания Microsoft запустила свою первую модель, специализированную на кибербезопасности, в рамках MDASH — своей мультимодельной платформы для выявления уязвимостей и их устранения.
По заявлению компании, MDASH, использующий модели MAI-Cyber-1-Flash и GPT-5.4, набрал 95,95% в тесте CyberGym. Кроме того, компания утверждает, что стоимость этой конфигурации на 50% ниже, чем у ее текущей лучшей комбинации MDASH, состоящей из GPT-5.4, GPT-5.4 mini и GPT-5.3 Codex. Доступ к ней ограничен утвержденными клиентами MDASH в рамках закрытой предварительной версии Azure AI Foundry.
MAI-Cyber-1-Flash предназначен для обработки до 90 % задач MDASH, при этом GPT-5.4 зарезервирован для самых сложных 10 %. Он доступен только в рамках MDASH, а не в качестве автономной общедоступной модели или универсального интерфейса прикладного программирования.
Рекордный результат принадлежит MDASH, работающему с MAI-Cyber-1-Flash в сочетании с GPT-5.4, а не самой новой модели. CyberGym Level 1 — это тест на воспроизведение известных уязвимостей. Он предоставляет агенту описание уязвимости и соответствующий исходный код без исправлений, а затем проверяет, может ли агент создать рабочий доказательный пример. Тест не оценивает обнаружение уязвимостей «вслепую» и не проверяет правильность сгенерированного исправления.
В публичной таблице лидеров CyberGym результат Microsoft в 95,95 % не фигурировал при проверке 28 июля 2026 года. В ней по-прежнему был указан результат Microsoft по MDASH от 12 мая — 88,4 %. В публичных материалах Microsoft не указано, был ли этот результат представлен для включения в таблицу.
Более ранний результат Microsoft в MDASH (96,55 %) не позволяет разрешить спор. В этом июньском показателе учитывались любые сбои, включая уязвимости, не относящиеся к целевым. В июльских материалах не указано, используется ли в результате 95,95 % тот же критерий, поэтому эти два показателя нельзя с уверенностью интерпретировать как тенденцию изменения производительности «до и после».
Согласно описанию модели Microsoft, MAI-Cyber-1-Flash представляет собой трансформер с разреженной смесью экспертов, имеющий в общей сложности 137 миллиардов параметров, 5 миллиардов активных параметров и контекстное окно размером 256 000 токенов. Это модель MAI-Code-1-Flash, прошедшая тонкую настройку для задач кибербезопасности, которая была разработана на основе контрольной точки в середине обучения модели MAI-Thinking-1.
Анализ реальных атак, техники APT-групп, новые уязвимости, практические рекомендации по детекту и доля иронии — всё, как вы любите.
CRATU — ваш инсайдерский источник по кибербезопасности. Подписывайтесь на наш Telegram-канал
КОНТРОЛИРУЙ РИСКИ:
Пентест для защиты бизнеса
Реалистичная проверка устойчивости ваших систем.
Протестировать

