Уязвимость LLM-агентов: как защитить автоматизированные HR-системы от gradient-based атак
Исследователи описали gradient-based атаку на открытые языковые модели, которые используются в корпоративных ботах для обработки резюме, отправки документов и управления задачами. Комбинация VRF и LoRA снижает успешность атаки с 20%...
Читать материал