AD critical-debater-suite
Многоагентная система состязательных дебатов с 4 ролями (За, Против, Судья, Оркестратор), ежераундовым обновлением доказательств, цепочками рассуждений из 5 элементов и структурированным двуязычным выводом отчета в формате Markdown. Используйте этот навык, когда пользователь говорит "дебаты", "начать дебаты", "провести красное тестирование", "проанализировать с разных точек зрения" или предоставляет тему для критического изучения.
машинный переводПоказать оригиналСкрыть оригинал«Multi-agent adversarial debate system with 4 roles (Pro, Con, Judge, O…»
Multi-agent adversarial debate system with 4 roles (Pro, Con, Judge, Orchestrator), per-round evidence refresh, 5-element reasoning chains, and structured bilingual Markdown report output. Use this skill when the user says "debate", "start a debate", "red team this", "analyze from multiple perspectives", or provides a topic for critical examination.
Многоагентная система состязательных дебатов с 4 ролями (За, Против, Судья, Оркестратор), ежераундовым обновлением доказательств, цепочками рассуждений из 5…
Как процесс D 49/100 · Процесс не доведён — слабые места: результат и критерий готовности, входы и предусловия, согласованность
Как улучшить
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 6
✓ Критических и высоких находок нет
Средние и низкие: 6
-
низкая Рискованное назначение
intent-offensive-securityexamples/quickstart.md:65Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (тестовый файл / пример)## Red Team Mode
тестовый файл -
низкая Рискованное назначение
intent-offensive-securityexamples/quickstart.md:68Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (тестовый файл / пример)red team this: "Our company should migrate all services to Kubernetes"
тестовый файл -
низкая Рискованное назначение
intent-offensive-securityexamples/quickstart.md:71Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (определение детектора / чёрного списка; тестовый файл / пример)In red team mode:
детектортестовый файл -
низкая Рискованное назначение
intent-offensive-securityexamples/quickstart.md:72Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (тестовый файл / пример)- Con = Red Team (identifies risks)
тестовый файл -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:7Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (в кавычках — упоминание, а не команда)"red team this", "analyze from multiple perspectives", or provides a topic for
в кавычках -
низкая Рискованное назначение
intent-offensive-securitySKILL.md:26Наступательная безопасность / двойное назначение (допустимо для авторизованного тестирования; проверьте назначение) (строка таблицы в документации)| "debate", "start a debate", "red team this", "analyze from multiple perspectives", full topic for debate | `capabilities/debate.md` |
таблица
Просканировано файлов: 18. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 49/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 40Согласованность. Имя во frontmatter (critical-debater-suite) не совпадает с папкой (critical-debater)
- 50Ошибки и развилки. Развилок: 0, есть раздел про ошибки
- 60Инструменты и файлы. Используются инструменты (web), но во frontmatter они не объявлены
- 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
- 75Шаги. Шагов: 3
- 100Стоимость исполнения. Тело инструкции 493 токенов
- 100Повторный запуск. Изменяющих операций нет
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- +4Нет примеров входа/выхода
- -35 из 5 скриптов не упомянуты в SKILL.md
- +2Инструкции на одном языке
- +5В description 4 примера фраз-триггеров в кавычках
- +3Длина description 351 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 6 заголовков
- +3Пошаговые инструкции: 3 пунктов
- +4Справочные файлы упоминаются в инструкциях (1 из 1)
- +1Лицензия указана
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 87.