AC write-tests
Создавайте тесты, которые действительно ловят регрессии — выбирайте ЧТО тестировать по риску (точки ветвления, границы, пути ошибок, денежные/авторизационные/параллельные операции), доказывайте, что каждый новый тест может завершиться ошибкой (тест, который никогда не был красным, — это украшение), мокируйте только границы, которыми вы не владеете, и закрепляйте непротестированный устаревший код помеченными тестами-характеристиками, прежде чем что-либо еще к нему прикоснется. Используйте этот навык всякий раз, когда пользователь говорит «написать тесты», «добавить тесты», «протестировать это», «добавить покрытие», «модульно протестировать эту функцию», «увеличить покрытие», «добавить регрессионный тест», «тесты-характеристики», «TDD это» или «/write-tests» — даже если они явно не говорят «протестировать навык». Не используйте для диагностики сбоящего теста (используйте diagnose) или для проверки существующих тестов в рамках diff (используйте code-review).
машинный переводПоказать оригиналСкрыть оригинал«Author tests that actually catch regressions — picks WHAT to test by r…»
Author tests that actually catch regressions — picks WHAT to test by risk (branch points, boundaries, error paths, money/auth/concurrency), proves every new test can fail (a test never seen red is decoration), mocks only boundaries you don't own, and pins untested legacy code with labeled characterization tests before anything else touches it. Use this skill whenever the user says "write tests", "add tests", "test this", "add coverage", "unit test this function", "increase coverage", "add a regression test", "characterization tests", "TDD this", or "/write-tests" — even if they don't explicitly say "test skill". Do not use for diagnosing a failing test (use diagnose) or reviewing existing tests as part of a diff (use code-review).
Создавайте тесты, которые действительно ловят регрессии — выбирайте ЧТО тестировать по риску (точки ветвления, границы, пути ошибок…
Как процесс C 56/100 · Есть пробелы — слабые места: результат и критерий готовности, входы и предусловия, повторный запуск
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 2. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 56/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 30Повторный запуск. Изменяющих операций: 4, без проверки текущего состояния
- 50Ошибки и развилки. Развилок: 0, есть раздел про ошибки
- 60Инструменты и файлы. Используются инструменты (bash), но во frontmatter они не объявлены
- 85Шаги. Шагов: 42, расплывчатых формулировок: 1
- 100Когда включается. Сказано, когда применять и когда не применять
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 2918 токенов
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +3Формат ответа не описан: модель каждый раз решает сама
- -220 эмодзи в инструкциях: шум для модели
- +1Лицензия не указана
- +2Инструкции на одном языке
- +5В description 11 примера фраз-триггеров в кавычках
- +4Описание говорит, когда скилл НЕ применять
- +3Длина description 740 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 8 заголовков
- +3Пошаговые инструкции: 42 пунктов
- +4Есть примеры (0 блоков кода)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 91.