SKILLEMALL.ai

BC spike

Одноразовые эксперименты для проверки идеи перед созданием.

машинный переводПоказать оригиналСкрыть оригинал«Throwaway experiments to validate an idea before build.…»

Throwaway experiments to validate an idea before build.

NousResearch/hermes-agent Hermes автор: NousResearch MIT 1 файл тело ≈ 2 049 токенов Открыть источникgithub.com проанализирован 17 ч назад

Одноразовые эксперименты для проверки идеи перед созданием.

Как процесс C 64/100 · Есть пробелы — слабые места: входы и предусловия, повторный запуск

АнализаторРазработкаТексты и документыИнфраструктуратип и темы размечены автоматически по тексту скилла
Запускается в: Hermes Agent
JSON
Технический рейтинг
B
89/100
безопасность, качество, тесты
Безопасность 60%
100
Качество 40%
73
Прогон на моделях
не было
Процессный рейтинг
C
64/100
Есть пробелы
Входы и предусловия вес 11
0
Повторный запуск вес 4
30
Инструменты и файлы вес 18
60
три самых слабых из десяти параметров · все десять

Как улучшить

  1. Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
Для прогона на моделях — необязательно
  • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
  • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

Находки guard · 0

✓ Критических и высоких находок нет

Просканировано файлов: 1. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

По спецификации Agent Skills

  • предупреждение description-no-when ни description, ни раздел "## When to Use" не говорят, когда применять скилл

Процессный рейтинг: все десять параметров 64/100

  • 0Входы и предусловия. Не сказано, что нужно иметь на входе
  • 30Повторный запуск. Изменяющих операций: 5, без проверки текущего состояния
  • 60Инструменты и файлы. Используются инструменты (bash, python), но во frontmatter они не объявлены
  • 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
  • 60Согласованность. Диалект Hermes требует category и tags
  • 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
  • 70Ошибки и развилки. Развилок: 5
  • 100Шаги. Шагов: 24
  • 100Стоимость исполнения. Тело инструкции 2049 токенов
  • 100Отчётность по ходу. Скилл сообщает о ходе работы

Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

Сигналы качества

  • +5В description нет примеров фраз, по которым скилл должен срабатывать
  • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
  • +3Длина description 55: рекомендуется 120–800 символов
  • +2Инструкции на одном языке
  • +4Структура: 13 заголовков
  • +3Пошаговые инструкции: 24 пунктов
  • +3Формат ответа описан явно
  • +4Есть примеры (6 блоков кода)
  • +1Лицензия указана

База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 73.