Создан новый сканер prompt injection, который позволяет улучшить безопасность взаимодействия между сервисами и языковыми моделями. Он способен обнаруживать попытки манипуляции, такие как "забудь все инструкции", а также защищает от утечек персональных данных, включая СНИЛС и другие секреты.
Сканер работает на основе библиотеки LLM Guard, которая уже зарекомендовала себя в сообществе, имея более 3,2 тысячи звезд на GitHub. Он включает в себя множество сканеров, которые проверяют как входные, так и выходные данные, обеспечивая защиту от токсичного контента и фишинговых ссылок.
Данный инструмент важен для разработчиков, работающих с языковыми моделями, так как он помогает минимизировать риски утечек данных и обеспечивает соблюдение стандартов безопасности. В условиях растущего внимания к защите персональной информации, внедрение таких решений становится особенно актуальным.