B 创意策源引擎
多Agent并行辩论式创意决策引擎。输入模糊创意→三独立视角(建构/解构/数据锚定)并行分析→Critic+Defender交叉验证→20分制量化评分→可执行策划案+Skill双格式输出。
多Agent并行辩论式创意决策引擎。输入模糊创意→三独立视角(建构/解构/数据锚定)并行分析→Critic+Defender交叉验证→20分制量化评分→可执行策划案+Skill双格式输出。
B
84/100
Общая оценка
- Безопасность 60%
- Качество 40%
- Тесты бонус
Как улучшить
- Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для срабатывания.
- Добавьте evals/evals.json с 4–6 реальными запросами и ожидаемыми ответами: тогда полная проверка использует ваши кейсы, а не черновик модели.
- Добавьте spec.yaml с триггерами и утверждениями (skilltest init): это контракт поведения для CI.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 6. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
Lint
- предупреждение
name-formatname должен быть в kebab-case (строчные буквы, цифры, дефисы) - предупреждение
description-no-whendescription не говорит, КОГДА применять скилл (нет "use when / используй когда") - заметка
frontmatter-keyнеизвестное поле фронтматтера "triggers" - заметка
frontmatter-keyнеизвестное поле фронтматтера "keywords" - заметка
frontmatter-keyнеизвестное поле фронтматтера "homepage" - заметка
frontmatter-keyнеизвестное поле фронтматтера "agent_created"
Процессная зрелость 49/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 40Согласованность. Имя во frontmatter (创意策源引擎) не совпадает с папкой (creative-origin-engine)
- 100Инструменты и файлы. Внешние инструменты не нужны
- 100Шаги. Шагов: 16
- 100Стоимость исполнения. Тело инструкции 2358 токенов
- 100Повторный запуск. Изменяющих операций нет
- low Разделов верхнего уровня: 14. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Длина description 94: рекомендуется 120–800 символов
- +3Формат ответа не описан: модель каждый раз решает сама
- -222 эмодзи в инструкциях: шум для модели
- +2Инструкции на одном языке
- +4Структура: 28 заголовков
- +3Пошаговые инструкции: 16 пунктов
- +4Есть примеры (14 блоков кода)
- +1Лицензия указана
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 60.
Внешние проверки
ClawHub: suspicious
The skill is a coherent creative-planning workflow, but it can auto-trigger broadly, search the web, and persist task-derived ideas across projects without clear opt-in or deletion controls.
LLM: suspicious (high) · 4 авг. 2026 г.