Описание
Spikee, разработанный Reversec, представляет собой простой набор для инъекций команд для оценки и эксплуатации. Он предназначен для оценки уязвимости больших языковых моделей (LLM) и их приложений к целевым атакам инъекций команд. В отличие от существующих инструментов, которые сосредоточены на общих сценариях jailbreak, Spikee придает приоритет угрозам кибербезопасности, таким как эксфильтрация данных, межсайтовый скриптинг (XSS) и исчерпание ресурсов. Эти сценарии основаны на реальных результатах и практиках пентестинга.
Spikee предоставляет практический инструмент для тестировщиков, позволяя генерировать настраиваемые наборы данных, применять статические плагины уклонения или динамические стратегии атак и тестировать цели, включая LLM, защитные механизмы и целые приложения. Он интегрируется с такими инструментами, как Burp Suite, позволяя пользователям анализировать результаты и уровень ложных срабатываний для защитных механизмов.
Инструмент может быть применен на всем протяжении цепочки безопасности приложений LLM для оценки и повышения устойчивости к атакам инъекций команд. Ключевые случаи использования включают тестирование LLM в изоляции, использование настраиваемых наборов данных, оценку отдельных защитных механизмов и оценку всей цепочки приложений, управляемых LLM.
Версия Spikee 0.2 добавляет поддержку динамических стратегий атак и гибкую систему оценки для оценки успеха атак. Она также предлагает подробные инструкции по настройке и использованию, включая генерацию наборов данных, тестирование целей и анализ результатов. Пользователи могут генерировать наборы данных из семян, настраивать их с помощью плагинов и фильтров и проводить тесты против таких целей, как GPT-4o, используя динамические атаки.
Будущие разработки Spikee включают интеграцию с инструментами пентестеров, возможность атак на основе зрения, улучшение системы оценки и расширение библиотек новыми jailbreak и техниками атак. Вклад сообщества приветствуется для помощи в развитии инструмента на основе новых исследований и отзывов.
Основные функции Spikee
Генерация настраиваемых наборов данных
Статические плагины уклонения
Динамические стратегии атак
Интеграция с Burp Suite
Анализ ложных срабатываний защитных механизмов
Гибкая система оценки
Сценарии, ориентированные на кибербезопасность
Тестирование на основе реальных результатов
Оценка цепочки безопасности приложений LLM
Поддержка динамических стратегий атак
Как использовать Spikee?
Инициализация: Установите Spikee через PyPI и настройте рабочее пространство
Генерация набора данных: Настройте с помощью семян, плагинов и фильтров
Тестирование цели: Запустите тесты против LLM или защитных механизмов
Анализ результатов: Рассчитайте метрики и создайте отчеты
Варианты использования Spikee
- Тестирование LLM в изоляции
- Тестирование настраиваемых наборов данных
- Оценка защитных механизмов
- Оценка цепочки
- Анализ угроз кибербезопасности








