SKILLEMALL.ai

AB context-surfing

Отслеживает состояние контекстного окна в течение сеанса и использует пиковое качество контекста для максимальной точности вывода. Активируется автоматически после plan-interview и intent-framed-agent. Остается активным во время выполнения и чисто передает управление simplify-and-harden и self-improvement, когда волна завершается естественным образом или выходит через передачу управления. Используйте этот навык всякий раз, когда выполняется многошаговая задача агента и возникает беспокойство по поводу непрерывности сеанса или дрейфа контекста. Особенно важно для длительных задач, сложных рефакторингов или любой работы, где ухудшение контекста может незаметно исказить результат. Активируйте, даже если пользователь не говорит "context surfing" — если задача агента выполняется в несколько шагов с уже установленным намерением и планом, этот навык активен.

машинный переводПоказать оригиналСкрыть оригинал«Monitors context window health throughout a session and rides peak con…»

Monitors context window health throughout a session and rides peak context quality for maximum output fidelity. Activates automatically after plan-interview and intent-framed-agent. Stays active through execution and hands off cleanly to simplify-and-harden and self-improvement when the wave completes naturally or exits via handoff. Use this skill whenever a multi-step agent task is underway and session continuity or context drift is a concern. Especially important for long-running tasks, complex refactors, or any work where degraded context would silently corrupt the output. Trigger even if the user doesn't say "context surfing" — if an agent task is running across multiple steps with intent and a plan already established, this skill is live.

ClawHub Agent Skills автор: pskoett v1.0.0 MIT-0 3 файла · 1 скрипт тело ≈ 5 354 токенов Открыть источникclawhub.ai проанализирован 2 дн назад

Отслеживает состояние контекстного окна в течение сеанса и использует пиковое качество контекста для максимальной точности вывода.

Как процесс B 67/100 · Почти готов — слабые места: результат и критерий готовности, входы и предусловия

СправочникИИ и агентытип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
A
91/100
безопасность, качество, тесты
Безопасность 60%
100
Качество 40%
77
Прогон на моделях
не было
Процессный рейтинг
B
67/100
Почти готов
Результат и критерий готовности вес 14
0
Входы и предусловия вес 11
0
Когда включается вес 12
70
три самых слабых из десяти параметров · все десять

Как улучшить

  1. Тело SKILL.md длиннее 5 000 токенов: вынесите справочные детали в references/ и подключайте по необходимости.
Для прогона на моделях — необязательно
  • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
  • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

Находки guard · 0

✓ Критических и высоких находок нет

Просканировано файлов: 3. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

По спецификации Agent Skills

  • предупреждение body-long тело SKILL.md ≈ 5354 токенов (рекомендуется < 5000); вынесите детали в references/

Процессный рейтинг: все десять параметров 67/100

  • 0Результат и критерий готовности. Не сказано, что считать результатом
  • 0Входы и предусловия. Не сказано, что нужно иметь на входе
  • 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
  • 70Стоимость исполнения. Тело инструкции 5354 токенов
  • 85Шаги. Шагов: 82, расплывчатых формулировок: 1
  • 100Инструменты и файлы. Внешние инструменты не нужны
  • 100Ошибки и развилки. Развилок: 21, есть раздел про ошибки
  • 100Согласованность. Имя и обязательные поля на месте
  • 100Повторный запуск. Изменяющие операции проверяют текущее состояние
  • 100Отчётность по ходу. Скилл сообщает о ходе работы
  • medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
  • low Разделов верхнего уровня: 13. Похоже на несколько доменов в одном скилле
  • low Ответ описан самодельной разметкой (3 тегов): типизированный вызов надёжнее

Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

Сигналы качества

  • +5В description нет примеров фраз, по которым скилл должен срабатывать
  • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
  • +3Формат ответа не описан: модель каждый раз решает сама
  • +1Лицензия не указана
  • +2Инструкции на одном языке
  • +3Длина description 753 символов: достаточно сигнала, не съедает бюджет
  • +4Структура: 37 заголовков
  • +3Пошаговые инструкции: 82 пунктов
  • +4Есть примеры (6 блоков кода)
  • +3Все 1 скриптов описаны в инструкциях

База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 77.

Внешние проверки

ClawHub: suspicious
This skill is not clearly malicious, but it should be reviewed because it can automatically run during broad multi-step work and persist detailed session content in local handoff files without explicit redaction or consent requirements.
LLM: suspicious (high) · VirusTotal: · 29 мая 2026 г.