SKILLEMALL.ai

BB sketch

Одноразовые HTML-макеты: 2-3 варианта дизайна для сравнения.

машинный переводПоказать оригиналСкрыть оригинал«Throwaway HTML mockups: 2-3 design variants to compare.…»

Throwaway HTML mockups: 2-3 design variants to compare.

NousResearch/hermes-agent Hermes автор: NousResearch MIT 1 файл тело ≈ 2 313 токенов Открыть источникgithub.com проанализирован 19 ч назад

Одноразовые HTML-макеты: 2-3 варианта дизайна для сравнения.

Как процесс B 74/100 · Почти готов — слабые места: входы и предусловия

ПроцедураGitHubТексты и документыДизайнтип и темы размечены автоматически по тексту скилла
Запускается в: Hermes Agent
JSON
Технический рейтинг
B
87/100
безопасность, качество, тесты
Безопасность 60%
100
Качество 40%
68
Прогон на моделях
не было
Процессный рейтинг
B
74/100
Почти готов
Входы и предусловия вес 11
0
Результат и критерий готовности вес 14
60
Согласованность вес 8
60
три самых слабых из десяти параметров · все десять

Как улучшить

  1. Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
Для прогона на моделях — необязательно
  • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
  • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

Находки guard · 0

✓ Критических и высоких находок нет

Просканировано файлов: 1. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

По спецификации Agent Skills

  • предупреждение description-no-when ни description, ни раздел "## When to Use" не говорят, когда применять скилл

Процессный рейтинг: все десять параметров 74/100

  • 0Входы и предусловия. Не сказано, что нужно иметь на входе
  • 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
  • 60Согласованность. Диалект Hermes требует category и tags
  • 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
  • 70Ошибки и развилки. Развилок: 5
  • 100Инструменты и файлы. Внешние инструменты не нужны
  • 100Шаги. Шагов: 29
  • 100Стоимость исполнения. Тело инструкции 2313 токенов
  • 100Повторный запуск. Изменяющие операции проверяют текущее состояние
  • 100Отчётность по ходу. Скилл сообщает о ходе работы
  • low Ответ описан самодельной разметкой (3 тегов): типизированный вызов надёжнее

Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

Сигналы качества

  • +5В description нет примеров фраз, по которым скилл должен срабатывать
  • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
  • +3Длина description 55: рекомендуется 120–800 символов
  • -5В тексте остались TODO / заглушки
  • +2Инструкции на одном языке
  • +4Структура: 14 заголовков
  • +3Пошаговые инструкции: 29 пунктов
  • +3Формат ответа описан явно
  • +4Есть примеры (8 блоков кода)
  • +1Лицензия указана

База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 68.