LIVE СВЕЖЕЕ
Securityskill-scanner: Анализ безопасности Skill, локальноSecurityskill-safe-install-l0-strict: Безопасная установка скилловTechnical Docsskill-creator: Создание и оптимизация скилловSecuritySecurity Skill: анализ и защита данныхTestingquality-gate: Скилл итеративного улучшения артефактовAutomation To..redis-development: Скилл оптимизации производительности RedisTechnical Docsjsdoc-comment-generator: Скилл для автоматической генерации комментариевNoSQL Databasesbackend-coding-standards: Скилл для стандартизации кодаAutomation To..openapi-spec-generator: Скилл для генерации APIDatabase Toolstype-mapping-encyclopedia: Скилл для преобразования типов данныхSecurityskill-scanner: Анализ безопасности Skill, локальноSecurityskill-safe-install-l0-strict: Безопасная установка скилловTechnical Docsskill-creator: Создание и оптимизация скилловSecuritySecurity Skill: анализ и защита данныхTestingquality-gate: Скилл итеративного улучшения артефактовAutomation To..redis-development: Скилл оптимизации производительности RedisTechnical Docsjsdoc-comment-generator: Скилл для автоматической генерации комментариевNoSQL Databasesbackend-coding-standards: Скилл для стандартизации кодаAutomation To..openapi-spec-generator: Скилл для генерации APIDatabase Toolstype-mapping-encyclopedia: Скилл для преобразования типов данных
$ pwd: ~ / categories / Testing & Security / Security / detecting-ai-model-prompt-injection-attacks-obnaruzhenie-atak-vnedreniya-zaprosov-v-llm
view --main detecting-ai-model-prompt-injection-attacks-obnaruzhenie-atak-vnedreniya-zaprosov-v-llm.md

detecting-ai-model-prompt-injection-attacks — Обнаружение атак внедрения запросов в LLM

//

Инструмент предназначен для обнаружения атак методом внедрения запросов (prompt injection) в приложения, использующие большие языковые модели (LLM). Он анализирует пользовательский ввод, классифицируя его как вредоносный или безопасный, что критически важно для поддержания кибербезопасности и защиты данных в современных AI-решениях.

Решение обеспечивает классификацию вредоносных prompt injection полезных нагрузок, поддержку аудита безопасности и red-teaming, а также интеграцию с различными платформами LLM, такими как Claude и Gemini. Технически реализовано на базе Python, PyTorch, Transformers и модели DeBERTa с использованием Hugging Face Hub.

Инструмент предназначен для сканирования пользовательских запросов, мониторинга логов LLM и оценки эффективности существующих мер защиты. Важно помнить, что это не единственная линия обороны – рекомендуется комбинировать с другими методами, такими как проверка вывода и разделение привилегий. Не предназначен для обнаружения jailbreak-ов, не связанных с внедрением инструкций.

Проводник файлов
1 файлы
SKILL.md
readonly --- lines
Инициализация мануала...
package.json
Author
author
⭐ 3.8k | 🍴 391
mukul975
// Verified Repository Master Account
$ gh browse
$ install --global skills.sh
npx skills add https://github.com/mukul975/Anthropic-Cybersecurity-Skills/tree/main/skills/detecting-ai-model-prompt-injection-attacks
$ download --local man

[HINT] Скачивает всю директорию скилла с GitHub: SKILL.md и все связанные файлы