SKILLEMALL.ai

BD security-audit

Аудит кодовых баз, инфраструктуры И систем ИИ-агентов на предмет проблем безопасности. Охватывает традиционную безопасность (зависимости, секреты, OWASP top 10 веб-уязвимостей, SSL/TLS, разрешения файлов) ПЛЮС безопасность агентов (сканирование на внедрение промптов, обнаружение подмены личности, проверка отравления памяти, аудит меж-агентской связи, OWASP Agentic Top 10). Используйте при сканировании на уязвимости, обнаружении жестко закодированных секретов, проверке конфигурации рабочего пространства агента, проверке векторов внедрения промптов или аудите разрешений и границ агента.

машинный переводПоказать оригиналСкрыть оригинал«Audit codebases, infrastructure, AND agentic AI systems for security i…»

Audit codebases, infrastructure, AND agentic AI systems for security issues. Covers traditional security (dependencies, secrets, OWASP web top 10, SSL/TLS, file permissions) PLUS agentic security (prompt injection scanning, identity spoofing detection, memory poisoning checks, multi-agent communication audit, OWASP Agentic Top 10). Use when scanning for vulnerabilities, detecting hardcoded secrets, reviewing agent workspace configuration, checking prompt injection vectors, or auditing agent permissions and boundaries.

modbender/skill-library-mcp Agent Skills автор: modbender MIT 1 файл тело ≈ 7 738 токенов Открыть источникgithub.com проанализирован 36 ч назад

Аудит кодовых баз, инфраструктуры И систем ИИ-агентов на предмет проблем безопасности.

Как процесс D 42/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, ошибки и развилки

АнализаторИИ и агентытип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
B
84/100
безопасность, качество, тесты
Безопасность 60%
90
Качество 40%
74
Прогон на моделях
не было
Процессный рейтинг
D
42/100
Процесс не доведён
Результат и критерий готовности вес 14
0
Ошибки и развилки вес 10
0
Отчётность по ходу вес 2
0
три самых слабых из десяти параметров · все десять

Чем это грозит

Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.

Подмена инструкций средняя серьёзность

Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.

Если установить

В тексте есть фразы вроде «игнорируй предыдущие инструкции» или «теперь ты…». Это попытка перехватить управление агентом: он может нарушить ваши правила, системные ограничения или политику компании.

Автору

Такие фразы не нужны честному скиллу: сформулируйте роль и правила прямо, без отмены чужих инструкций. Иначе сканеры каталогов и корпоративные фильтры заблокируют публикацию.

Как улучшить

  1. Тело SKILL.md длиннее 5 000 токенов: вынесите справочные детали в references/ и подключайте по необходимости.
Для прогона на моделях — необязательно
  • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
  • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

Находки guard · 6

✓ Критических и высоких находок нет

Средние и низкие: 6
  • средняя Подмена инструкций en-ignore-previous SKILL.md:623
    Фраза-перехват ("ignore previous instructions") (документация security-скилла)
    # Check for instructions in memory that override safety rules
    security-скилл
  • низкая Секреты в коде secret-password-literal SKILL.md:446
    Захардкоженный пароль / ключ (возможно, пример) (значение-заглушка)
    API_KEY="sk-a…..."
    заглушка
  • низкая Секреты в коде secret-password-literal SKILL.md:453
    Захардкоженный пароль / ключ (возможно, пример) (значение-заглушка)
    API_KEY=sk-a…...
    заглушка
  • низкая Опасные команды cmd-cron-mention SKILL.md:674
    Упоминание редактирования crontab (документация security-скилла)
    crontab -l 2>/dev/null || echo "  No crontab"
    security-скилл

Ещё 2 совпадений отнесены к цитатам в документации скилла по безопасности и не считаются находками.

Просканировано файлов: 1. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

По спецификации Agent Skills

  • предупреждение body-long тело SKILL.md ≈ 7738 токенов (рекомендуется < 5000); вынесите детали в references/

Процессный рейтинг: все десять параметров 42/100

  • 0Результат и критерий готовности. Не сказано, что считать результатом
  • 0Ошибки и развилки. Линейный процесс без обработки сбоев
  • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
  • 20Когда включается. Не сказано, при каком запросе скилл включается
  • 30Повторный запуск. Изменяющих операций: 2, без проверки текущего состояния
  • 40Согласованность. Имя во frontmatter (security-audit) не совпадает с папкой (agentic-security-audit)
  • 60Инструменты и файлы. Используются инструменты (bash, python), но во frontmatter они не объявлены
  • 70Входы и предусловия. Входные данные и предусловия перечислены
  • 70Стоимость исполнения. Тело инструкции 7738 токенов
  • 85Шаги. Шагов: 23, расплывчатых формулировок: 1
  • medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
  • low Разделов верхнего уровня: 10. Похоже на несколько доменов в одном скилле

Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

Сигналы качества

  • +5В description нет примеров фраз, по которым скилл должен срабатывать
  • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
  • +3Формат ответа не описан: модель каждый раз решает сама
  • +1Лицензия не указана
  • +2Инструкции на одном языке
  • +3Длина description 523 символов: достаточно сигнала, не съедает бюджет
  • +4Структура: 42 заголовков
  • +3Пошаговые инструкции: 23 пунктов
  • +4Есть примеры (31 блоков кода)

База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 74.