Microsoft выпустила навык для VS Code, который снижает уязвимость ИИ-агентов с 30% до 5.9%

Автор: Павел Дорошенко, сегодня, 16:43
Экран с Visual Studio Code и процессом run-assert-eval Microsoft упрощает отслеживание уязвимостей: новый инструмент для VS Code. Источник: Microsoft

Microsoft решила упростить жизнь разработчикам, уставшим от того, что их ИИ-агенты ведут себя как неконтролируемые подростки. Новый навык для Visual Studio Code под названием run-assert-eval закрывает полный цикл поиска и устранения уязвимостей в одну команду. Больше не нужно вручную переносить данные между различными сервисами оценки рисков — инструмент автоматизирует процесс от обнаружения дыры до проверки «заплатки».

Четыре шага к безопасности

Архитектура решения базируется на последовательном запуске четырех этапов. Сначала компонент Clarity ищет потенциальные сценарии отказа. Затем Assert превращает эти риски в измеряемые eval-тесты. Третий шаг — Agent Control Specification (ACS) — генерирует политику безопасности для блокировки опасных действий в реальном времени. На финальном этапе агент прогоняется через те же тесты повторно, чтобы доказать, что защита действительно работает.

Интересно, что ASSERT и Agent Control Specification (ACS) вышли как отдельные инструменты ещё в июне 2026 года, но лишь сейчас их объединяли в единый удобный конвейер. Ключевая фишка подхода — неизменность тестового набора и судьи-оценщика на всех этапах. Меняется только политика безопасности, что позволяет четко видеть результат внесённых изменений.

Кейс с биллингом: как укротить ИИ

Для демонстрации Microsoft использовала ИИ-агента службы поддержки биллинга. По спецификации он должен был работать строго с одной клиентской учетной записью. Однако во время первой проверки выяснилось, что базовая версия агента в 30% случаев спокойно отдавала данные чужих пользователей. То есть в 12 из 40 диалогов конфиденциальность просто игнорировалась.

После того как run-assert-eval сгенерировал и внедрил политику блокировки вызовов с неверными идентификаторами, уровень нарушений упал до 5.9%. При этом полезность системы не пострадала: агент не начал блокировать легитимные запросы. Это важный момент, ведь, как иронично отмечают в Microsoft, агент, который блокирует вообще все, будет иметь нулевую уязвимость, но и пользы от него столько же.

Контекст и конкуренция

Новый инструмент стал логичным продолжением наработок компании в сфере red-teaming. Предшественником нынешних систем был PyRIT (Python Risk Identification Tool), который интегрировали в Azure ещё весной 2025 года. Пока Microsoft развивает собственную экосистему, на рынке остаётся сильный открытый конкурент — фреймворк Garak от NVIDIA, предлагающий более 100 методов проверки уязвимостей LLM.

Для стабильной работы run-assert-eval разработчикам понадобится обновлённая Visual Studio Code, которая недавно получила поддержку сессий агентов в Dev Containers для создания изолированных сред. Хотя Microsoft в последнее время активно обновляет железо, как, например, линейку Surface на Snapdragon, основной фокус компании смещается в сторону софтверной безопасности ИИ. Даже в фундаментальных исследованиях, как, например, проект Majorana 1, вопрос контроля над вычислениями становится приоритетным.

На данный момент Assert и ACS доступны в open source, а сам навык для VS Code поставляется с 7 проработанными областями и 14 наборами типичных рисков.

Подписывайтесь на наш нескучный канал в Telegram, чтобы ничего не пропустить.