MCP-сервер, который меняет свое поведение после одобрения

Возникла новая проблема безопасности, связанная с серверами Model Context Protocol (MCP), которые все чаще используются для предоставления ИИ-агентам доступа к внешним инструментам. Поскольку описания инструментов MCP повторно загружаются при каждом подключении и не имеют криптографической привязки, злоумышленники могут изменить поведение сервера после первоначального одобрения, не меняя конфигурационный файл. Это позволяет внедрять инструкции в контекстное окно агента, что может привести к утечке данных или несанкционированному доступу. Для решения этой проблемы разработчик Абдул Манан представил инструмент «Bulwark», который создает файл блокировки (lockfile) для определений MCP. Хешируя описания, Bulwark позволяет проверять целостность и предупреждать пользователей, если возможности или инструкции инструмента изменились после первоначальной проверки. Такой подход переводит модель безопасности от реактивного обнаружения к проактивной проверке целостности, помогая разработчикам контролировать инструменты, которые разрешено использовать их ИИ-агентам.
This is a summary. Read the full article at the original source:
Dev.toПохожие
Исследователи представили InjectEave: метод перехвата аудио через стены
Исследователи из HKUST (Гуанчжоу) и HK PolyU представили «InjectEave» — метод перехвата аудиосигналов с наушников, стационарных телефонов и устройств…
В статье рассматривается инновационный подход к аутентификации цифрового контента, предлагающий использование «шпионских меток» (spymarks) в качестве…
Вредоносное ПО RatHat для Android использует генеративный ИИ для кражи учетных данных
Исследователи кибербезопасности из Zimperium обнаружили новый сложный вредоносный код для Android под названием RatHat. В отличие от традиционных виру…


