AB prfaq-beagle
Используйте, когда пользователь хочет протестировать продукт, внутренний инструмент или концепцию OSS на соответствие требованиям Amazon Working Backwards PRFAQ перед утверждением спецификации. Активируется по запросам: «work backwards», «write a PRFAQ», «press release first», «is this idea worth building», «pressure-test this concept», «filter this before brainstorm», «is this a real product». Также обрабатывает предложения, начинающиеся с решения («Я хочу создать X, которое делает Y») и технологии («использовать ИИ для...»), которые нуждаются в фильтрации с точки зрения клиента. Выдает бинарный результат «пройдено/не пройдено», а не отполированный документ. Жесткий коучинг — прямой, скептический, конкретный. При прохождении передает управление brainstorm-beagle с кратким описанием концепции. НЕ пишет код, НЕ планирует реализацию, НЕ создает каркасы проектов и НЕ составляет спецификации.
машинный переводПоказать оригиналСкрыть оригинал«Use when the user wants to pressure-test a product, internal-tool, or…»
Use when the user wants to pressure-test a product, internal-tool, or OSS concept against Amazon's Working Backwards PRFAQ gauntlet before committing to a spec. Triggers on: "work backwards", "write a PRFAQ", "press release first", "is this idea worth building", "pressure-test this concept", "filter this before brainstorm", "is this a real product". Also catches solution-first pitches ("I want to build X that does Y") and technology-first pitches ("use AI to...") that need customer-first filtering. Produces a binary pass/fail verdict, not a polished doc. Hardcore coaching — direct, skeptical, concrete. On pass, hands off to brainstorm-beagle with a concept brief. Does NOT write code, plan implementation, scaffold projects, or draft specs.
Используйте, когда пользователь хочет протестировать продукт, внутренний инструмент или концепцию OSS на соответствие требованиям Amazon Working Backwards…
Как процесс B 70/100 · Почти готов — слабые места: входы и предусловия, повторный запуск
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 8. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 70/100
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 30Повторный запуск. Изменяющих операций: 2, без проверки текущего состояния
- 60Инструменты и файлы. Используются инструменты (bash), но во frontmatter они не объявлены
- 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
- 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
- 100Шаги. Шагов: 47
- 100Ошибки и развилки. Развилок: 3, есть раздел про ошибки
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 3921 токенов
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- low Разделов верхнего уровня: 14. Похоже на несколько доменов в одном скилле
- low Ответ описан самодельной разметкой (15 тегов): типизированный вызов надёжнее
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +1Лицензия не указана
- +2Инструкции на одном языке
- +5В description 9 примера фраз-триггеров в кавычках
- +3Длина description 748 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 21 заголовков
- +3Пошаговые инструкции: 47 пунктов
- +3Формат ответа описан явно
- +4Есть примеры (4 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (6 из 6)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 96.