B multi-agent-workshop
七阶段(含阶段0任务澄清)多角色工作坊;角色种类与人数均由任务决定。触发词:"多角色研讨"、"需求工作坊"、"需求评审"、"圆桌"、"定方案再执行"。
B
86/100
Общая оценка
- Безопасность 60%
- Качество 40%
- Тесты бонус
Как улучшить
- Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для срабатывания.
- В тексте есть ссылки на отсутствующие файлы: добавьте файлы или уберите ссылки.
- Добавьте evals/evals.json с 4–6 реальными запросами и ожидаемыми ответами: тогда полная проверка использует ваши кейсы, а не черновик модели.
- Добавьте spec.yaml с триггерами и утверждениями (skilltest init): это контракт поведения для CI.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 29. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
Lint
- предупреждение
description-no-whendescription не говорит, КОГДА применять скилл (нет "use when / используй когда") - предупреждение
missing-refссылка на отсутствующий файл: scripts/phases/00-…06-*.md - предупреждение
missing-refссылка на отсутствующий файл: references/sample-roles/*.md - предупреждение
missing-refссылка на отсутствующий файл: scripts/run_*.py
Процессная зрелость 37/100
Не запустится. Скилл ссылается на файлы, которых нет в архиве: scripts/phases/00-…06-*.md, references/sample-roles/*.md, scripts/run_*.py
- 0Инструменты и файлы. Не хватает 3 файла(ов): scripts/phases/00-…06-*.md, references/sample-roles/*.md, scripts/run_*.py
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 100Шаги. Шагов: 44
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 3787 токенов
- 100Повторный запуск. Изменяющих операций нет
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- low Разделов верхнего уровня: 15. Похоже на несколько доменов в одном скилле
- low Ответ описан самодельной разметкой (52 тегов): типизированный вызов надёжнее
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Длина description 75: рекомендуется 120–800 символов
- +3Формат ответа не описан: модель каждый раз решает сама
- +1Лицензия не указана
- +2Инструкции на одном языке
- +4Структура: 21 заголовков
- +3Пошаговые инструкции: 44 пунктов
- +4Есть примеры (3 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (8 из 8)
- +3Все 3 скриптов описаны в инструкциях
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 64.
Внешние проверки
ClawHub: suspicious
The skill is mostly a disclosed local workshop workflow, but it includes under-scoped maintenance commands and unsafe network handling that users should review before installing.
LLM: suspicious (high) · VirusTotal: · 29 мая 2026 г.