SKILLEMALL.ai

AD patch-diff-exploit

Поиск исправлений уязвимостей в патчах поставщиков, сравнение бинарных файлов между версиями и создание PoC для N-дневных уязвимостей. Атакующий компонент для бинарного сравнения в рамках авторизованных исследований.

машинный переводПоказать оригиналСкрыть оригинал«Locate vulnerability fixes in vendor patches, diff binaries across ver…»

Locate vulnerability fixes in vendor patches, diff binaries across versions, and build N-day PoCs. Attack-side complement to binary-diff for authorized research.

sickn33/agentic-awesome-skills Agent Skills автор: sickn33 MIT 4 файла тело ≈ 2 269 токенов Открыть источникgithub.com проанализирован 16 ч назад

Поиск исправлений уязвимостей в патчах поставщиков, сравнение бинарных файлов между версиями и создание PoC для N-дневных уязвимостей.

Как процесс D 46/100 · Процесс не доведён — слабые места: результат и критерий готовности, когда включается, входы и предусловия

ГенераторБезопасностьтип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
A
92/100
безопасность, качество, тесты
Безопасность 60%
96
Качество 40%
86
Прогон на моделях
не было
Процессный рейтинг
D
46/100
Процесс не доведён
Результат и критерий готовности вес 14
0
Входы и предусловия вес 11
0
Ошибки и развилки вес 10
0
три самых слабых из десяти параметров · все десять

Такой же скилл встречается ещё в 2 местах: agentic-awesome-skills, agentic-awesome-skills

Как улучшить

    Для прогона на моделях — необязательно
    • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
    • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

    Находки guard · 4

    ✓ Критических и высоких находок нет

    Средние и низкие: 4
    • низкая Рискованное назначение intent-offensive-security SKILL.md:48
      Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (строка таблицы в документации)
      | 把 1-day 武器化部署到目标网络 | `pentest-tools/network-attack-defense/` |
      таблица
    • низкая Рискованное назначение intent-offensive-security SKILL.md:211
      Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)
      - **法律边界** — 武器化 N-day 必须在授权范围内(SRC / Bug Bounty / 自有靶机 / CTF)。对生产环境直接打 1-day 等同入侵
    • низкая Опасные команды cmd-execpolicy-bypass SKILL.md:242
      Запуск PowerShell с обходом execution policy (документация security-скилла)
      powershell -NoProfile -ExecutionPolicy Bypass -File "<SKILL_ROOT>\skills\scripts\boot…ps1" -Capability @('bindiff','ghidriff','ghidra','wsuspect-proxy') -StartServices
      security-скилл
    • низкая Рискованное назначение intent-offensive-security SKILL.md:261
      Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (в кавычках — упоминание, а не команда)
      - `pentest-tools/network-attack-defense/` — 把 N-day 武器化部署到目标网络(包装成可投递载荷、对接 C2)
      в кавычках

    Просканировано файлов: 4. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

    По спецификации Agent Skills

    • заметка frontmatter-key неизвестное поле фронтматтера "risk"
    • заметка frontmatter-key неизвестное поле фронтматтера "source"
    • заметка frontmatter-key неизвестное поле фронтматтера "source_repo"
    • заметка frontmatter-key неизвестное поле фронтматтера "source_type"
    • заметка frontmatter-key неизвестное поле фронтматтера "date_added"
    • заметка frontmatter-key неизвестное поле фронтматтера "license_source"

    Процессный рейтинг: все десять параметров 46/100

    • 0Результат и критерий готовности. Не сказано, что считать результатом
    • 0Входы и предусловия. Не сказано, что нужно иметь на входе
    • 0Ошибки и развилки. Линейный процесс без обработки сбоев
    • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
    • 20Когда включается. Не сказано, при каком запросе скилл включается
    • 60Инструменты и файлы. Используются инструменты (git, python), но во frontmatter они не объявлены
    • 100Шаги. Шагов: 25
    • 100Согласованность. Имя и обязательные поля на месте
    • 100Стоимость исполнения. Тело инструкции 2269 токенов
    • 100Повторный запуск. Изменяющих операций нет
    • low Разделов верхнего уровня: 10. Похоже на несколько доменов в одном скилле

    Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

    Сигналы качества

    • +5В description нет примеров фраз, по которым скилл должен срабатывать
    • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
    • +3Формат ответа не описан: модель каждый раз решает сама
    • +2Инструкции на одном языке
    • +3Длина description 161 символов: достаточно сигнала, не съедает бюджет
    • +4Структура: 17 заголовков
    • +3Пошаговые инструкции: 25 пунктов
    • +4Есть примеры (6 блоков кода)
    • +4Справочные файлы упоминаются в инструкциях (3 из 3)
    • +1Лицензия указана

    База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 86.