BB observability-aiops
Используйте этот навык, когда пользователю требуется управлять локальным стеком наблюдаемости на базе Prometheus (HTTP API + PromQL), Alertmanager, Grafana или Grafana Loki (логи) — краткий обзор, запросы PromQL (мгновенные/диапазонные), метаданные меток + серий, состояние целей сбора (активна/неактивна + причина) и отброшенные цели, состояние правил записи/оповещения, активные/ожидающие оповещения, оповещения Alertmanager + безмолвия, дашборды Grafana/источники данных/папки, ограниченное чтение логов Loki (LogQL) (метки, запрос, ошибки), пять флагманских анализов (RCA активного оповещения, состояние целей сбора, шум/мерцание оповещения, RCA всплеска ошибок в логах, объем/кардинальность логов) плюс перекрестный сигнал оповещение->лог, и управляемые записи (создание/истечение безмолвия, создание аннотации, обновление/удаление дашборда, перезагрузка конфигурации Prometheus). Всегда используйте этот навык для "Prometheus", "PromQL", "Alertmanager", "Grafana", "Loki", "LogQL", "logs", "which targets are down", "scrape failing", "why is this alert firing", "root cause this alert", "firing alerts", "silence this alert", "noisy alerts", "alert flapping", "recording rule", "alerting rule", "dashboard", "datasource health", "reload prometheus config", "TSDB cardinality", "error burst", "log volume", "log cardinality", "tail errors", когда контекст — локальный стек метрик/логов/наблюдаемости. НЕ используйте, когда целью является что-то, кроме стека наблюдаемости Prometheus/Grafana (гипервизор, система хранения данных, резервное копирование, плоскость управления оркестратора контейнеров, конфигурация сетевого устройства или OT/промышленное оборудование) — направляйте их к соответствующему другому навыку AIops-tools. Хостинговые/SaaS-платформы мониторинга (Datadog, New Relic, корпоративные NMS) не входят в область применения. Управляемые операции наблюдаемости со встроенным механизмом управления (аудит, политика, бюджет токенов, отмена, уровни риска). Помимо демонстрационного набора, интерфейсы Prometheus/Alertmanager/Grafana были протестированы на реальном стеке Prometheus 3.x + Alertmanager + Grafana 13 (RCA, управляемые записи, отмена); поверхность Loki не тестировалась (см. docs/VERIFICATIO).
машинный переводПоказать оригиналСкрыть оригинал«Use this skill whenever the user needs to operate a self-hosted observ…»
Use this skill whenever the user needs to operate a self-hosted observability stack on Prometheus (HTTP API + PromQL), Alertmanager, Grafana, or Grafana Loki (logs) — a one-shot overview, PromQL instant/range queries, label + series metadata, scrape-target health (up/down + why) and dropped targets, recording/alerting rule health, firing/pending alerts, Alertmanager alerts + silences, Grafana dashboards/datasources/folders, bounded Loki LogQL log reads (labels, query, error-tail), five flagship analyses (firing-alert RCA, target-scrape-health, alert-noise/flap, log-error-burst RCA, log-volume/cardinality) plus an alert->log cross-signal, and guarded writes (create/expire silence, create annotation, update/delete dashboard, reload Prometheus config). Always use this skill for "Prometheus", "PromQL", "Alertmanager", "Grafana", "Loki", "LogQL", "logs", "which targets are down", "scrape failing", "why is this alert firing", "root cause this alert", "firing alerts", "silence this alert", "noisy alerts", "alert flapping", "recording rule", "alerting rule", "dashboard", "datasource health", "reload prometheus config", "TSDB cardinality", "error burst", "log volume", "log cardinality", "tail errors" when the context is a self-hosted metrics/logs/observability stack. Do NOT use when the target is something other than a Prometheus/Grafana observability stack (a hypervisor, storage appliance, backup product, container-orchestrator control plane, network device config, or OT/industrial equipment) — route those to the appropriate other AIops-tools skill. Hosted/SaaS monitoring suites (Datadog, New Relic, enterprise NMS) are out of scope. Governed observability operations with a built-in governance harness (audit, policy, token budget, undo, risk-tiers). Beyond the mock suite, the Prometheus/Alertmanager/Grafana surfaces have been exercised against a live Prometheus 3.x + Alertmanager + Grafana 13 stack (RCAs, governed writes, undo); the Loki surface has not (see docs/VERIFICATIO
Используйте этот навык, когда пользователю требуется управлять локальным стеком наблюдаемости на базе Prometheus (HTTP API + PromQL), Alertmanager, Grafana…
Как процесс B 68/100 · Почти готов — слабые места: результат и критерий готовности, входы и предусловия, повторный запуск
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
Скилл просит больше прав, чем нужно для задачи: широкий доступ к инструментам, секретные переменные окружения, бинарные файлы. Каждое лишнее право расширяет ущерб при ошибке или взломе.
Сузьте allowed-tools и список переменных до минимума, замените бинарники на исходники или скрипты, которые можно прочитать.
Как улучшить
- Сократите description до 1024 символов.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 1
✓ Критических и высоких находок нет
Средние и низкие: 1
-
средняя Широкие права
meta-broad-allowed-toolsSKILL.md:1Заранее разрешены широкие инструменты: Bashallowed-tools: Bash
Просканировано файлов: 6. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- ошибка
description-longdescription 2007 символов, лимит 1024 - заметка
description-budgetdescription занимает 2007 из общего бюджета ~15000 символов на все скиллы - заметка
frontmatter-keyнеизвестное поле фронтматтера "slug" - заметка
frontmatter-keyнеизвестное поле фронтматтера "displayName" - заметка
frontmatter-keyнеизвестное поле фронтматтера "summary" - заметка
frontmatter-keyнеизвестное поле фронтматтера "homepage" - заметка
frontmatter-keyнеизвестное поле фронтматтера "installer"
Процессный рейтинг: все десять параметров 68/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 30Повторный запуск. Изменяющих операций: 20, без проверки текущего состояния
- 55Ошибки и развилки. Развилок: 1
- 100Инструменты и файлы. Инструменты объявлены во frontmatter
- 100Шаги. Шагов: 49
- 100Когда включается. Сказано, когда применять и когда не применять
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 3487 токенов
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- low Ответ описан самодельной разметкой (11 тегов): типизированный вызов надёжнее
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +3Длина description 2006: рекомендуется 120–800 символов
- +3Формат ответа не описан: модель каждый раз решает сама
- +2Инструкции на одном языке
- +5В description 22 примера фраз-триггеров в кавычках
- +4Описание говорит, когда скилл НЕ применять
- +4Структура: 13 заголовков
- +3Пошаговые инструкции: 49 пунктов
- +4Есть примеры (1 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (4 из 4)
- +1Лицензия указана
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 64.