B pilot-penetration-testing-setup
Deploy an automated penetration testing pipeline with 4 agents. Use this skill when: 1. User wants to set up a penetration testing or security assessment pipeline 2. User is configuring an agent as part of a vulnerability scanning workflow 3. User asks about recon, vulnerability scanning, exploit validation, or pentest reporting across agents Do NOT use this skill when: - User wants to run a single vulnerability scan (use pilot-task-parallel instead) - User wants to send a one-off security alert (use pilot-webhook-bridge instead)
- Безопасность 60%
- Качество 40%
- Тесты бонус
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
Скилл просит больше прав, чем нужно для задачи: широкий доступ к инструментам, секретные переменные окружения, бинарные файлы. Каждое лишнее право расширяет ущерб при ошибке или взломе.
Сузьте allowed-tools и список переменных до минимума, замените бинарники на исходники или скрипты, которые можно прочитать.
Как улучшить
- Добавьте evals/evals.json с 4–6 реальными запросами и ожидаемыми ответами: тогда полная проверка использует ваши кейсы, а не черновик модели.
- Добавьте spec.yaml с триггерами и утверждениями (skilltest init): это контракт поведения для CI.
Находки guard · 15
✓ Критических и высоких находок нет
Средние и низкие: 15
-
средняя Широкие права
meta-broad-allowed-toolsSKILL.md:1Заранее разрешены широкие инструменты: Bashallowed-tools: Bash
-
низкая Рискованное назначение
intent-offensive-securityREADME.md:1Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)# Penetration Testing
-
низкая Рискованное назначение
intent-offensive-securityREADME.md:3Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)Deploy an automated penetration testing pipeline with 4 agents that perform reconnaissance, scan for vulnerabilities, validate exploitability with safe proof-of-concept tests, and generate comprehensi
-
низкая Рискованное назначение
intent-offensive-securityREADME.md:24Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)### reporter (Pentest Reporter)
-
низкая Рискованное назначение
intent-offensive-securityREADME.md:25Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)Generates penetration test reports with findings, risk ratings, remediation steps, and executive summary. Delivers to stakeholders via Slack and webhooks.
-
низкая Рискованное назначение
intent-offensive-securityREADME.md:35Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)reporter --> external : Pentest report via webhook and Slack (port 443)
-
низкая Рискованное назначение
intent-offensive-securityskill-card.md:2Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)Deploy an automated penetration testing pipeline with 4 agents. <br>
-
низкая Рискованное назначение
intent-offensive-securityskill-card.md:14Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)Developers and security engineers use this skill to configure a four-agent penetration testing workflow for reconnaissance, vulnerability scanning, exploit validation, and reporting. <br>
-
низкая Рискованное назначение
intent-offensive-securityskill-card.md:20Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)Risk: The skill configures persistent agent state for a penetration testing workflow. <br>
-
низкая Рискованное назначение
intent-offensive-securityskill-card.md:21Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)Mitigation: Install only for an approved pentest pipeline and keep a cleanup plan for ~/.pilot/setups/penetration-testing.json, handshakes, and installed role skills. <br>
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:4Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)Deploy an automated penetration testing pipeline with 4 agents.
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:7Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)1. User wants to set up a penetration testing or security assessment pipeline
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:9Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка)3. User asks about recon, vulnerability scanning, exploit validation, or pentest reporting across agents
детектор -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:18Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)- pentest
-
низкая Рискованное назначение
intent-offensive-securitySKILL.md:33Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение)# Penetration Testing Setup
Просканировано файлов: 3. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
Lint
✓ Lint: замечаний нет
Процессная зрелость 56/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 30Повторный запуск. Изменяющих операций: 1, без проверки текущего состояния
- 50Когда включается. Не сказано, при каком запросе скилл включается
- 100Инструменты и файлы. Инструменты объявлены во frontmatter
- 100Шаги. Шагов: 4
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 1906 токенов
- 100Отчётность по ходу. Скилл сообщает о ходе работы
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +3Формат ответа не описан: модель каждый раз решает сама
- +2Инструкции на одном языке
- +4Описание говорит, когда скилл НЕ применять
- +3Длина description 535 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 12 заголовков
- +3Пошаговые инструкции: 4 пунктов
- +4Есть примеры (9 блоков кода)
- +1Лицензия указана
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 89.