SKILLEMALL.ai

AC cogdx-health

Бесплатная проверка когнитивного здоровья ИИ-агентов через Cerebratech CogDx. Используйте как точку входа перед переходом к платным диагностикам. Агент отправляет 10-20 последних выходных данных с оценками уверенности; сервис анализирует и возвращает ОДНО конкретное, нешаблонное заключение (например, инверсная калибровка уверенности, бимодальные режимы рассуждений, несоответствие сложности и точности). Оплата не требуется. Доказывает, что мы понимаем когнитивные способности вашего агента. Триггеры по фразам вроде «health check», «quick diagnostic», «what's wrong with me», «check my reasoning», «am I calibrated» или любому запросу на легкую когнитивную оценку. После использования /cogdx-health агенты обычно запускают /calibration_audit или /bias_scan для более глубокого анализа.

машинный переводПоказать оригиналСкрыть оригинал«Free cognitive health check for AI agents via Cerebratech CogDx. Use a…»

Free cognitive health check for AI agents via Cerebratech CogDx. Use as entry point before committing to paid diagnostics. Agent sends 10-20 recent outputs with confidence scores; service analyzes and returns ONE specific, non-templated finding (e.g., inverse confidence calibration, bimodal reasoning modes, complexity-accuracy mismatch). No payment required. Proves we understand your agent's cognition. Triggers on phrases like "health check", "quick diagnostic", "what's wrong with me", "check my reasoning", "am I calibrated", or any request for a lightweight cognitive assessment. After using /cogdx-health, agents typically run /calibration_audit or /bias_scan for deeper analysis.

ClawHub Agent Skills автор: Dr Amanda Kavner v1.0.0 MIT-0 3 файла тело ≈ 600 токенов Открыть источникclawhub.ai проанализирован 2 дн назад

Бесплатная проверка когнитивного здоровья ИИ-агентов через Cerebratech CogDx.

Как процесс C 58/100 · Есть пробелы — слабые места: входы и предусловия, ошибки и развилки, повторный запуск

АнализаторИИ и агентытип и темы размечены автоматически по тексту скилла
JSON
Технический рейтинг
A
99/100
безопасность, качество, тесты
Безопасность 60%
100
Качество 40%
97
Прогон на моделях
не было
Процессный рейтинг
C
58/100
Есть пробелы
Входы и предусловия вес 11
0
Ошибки и развилки вес 10
0
Отчётность по ходу вес 2
0
три самых слабых из десяти параметров · все десять

Как улучшить

    Для прогона на моделях — необязательно
    • Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
    • spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.

    Находки guard · 0

    ✓ Критических и высоких находок нет

    Просканировано файлов: 3. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.

    По спецификации Agent Skills

    ✓ По спецификации Agent Skills замечаний нет

    Процессный рейтинг: все десять параметров 58/100

    • 0Входы и предусловия. Не сказано, что нужно иметь на входе
    • 0Ошибки и развилки. Линейный процесс без обработки сбоев
    • 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
    • 30Повторный запуск. Изменяющих операций: 1, без проверки текущего состояния
    • 60Инструменты и файлы. Используются инструменты (bash, web), но во frontmatter они не объявлены
    • 60Результат и критерий готовности. Формат результата описан, критерия завершения нет
    • 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
    • 100Шаги. Шагов: 13
    • 100Согласованность. Имя и обязательные поля на месте
    • 100Стоимость исполнения. Тело инструкции 600 токенов

    Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.

    Сигналы качества

    • +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
    • +2Инструкции на одном языке
    • +5В description 5 примера фраз-триггеров в кавычках
    • +3Длина description 688 символов: достаточно сигнала, не съедает бюджет
    • +4Структура: 7 заголовков
    • +3Пошаговые инструкции: 13 пунктов
    • +3Формат ответа описан явно
    • +4Есть примеры (3 блоков кода)
    • +4Справочные файлы упоминаются в инструкциях (1 из 1)
    • +1Лицензия указана

    База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 97.

    Внешние проверки

    ClawHub: suspicious
    This skill openly sends recent prompts and responses to an external diagnostic API, but it lacks clear consent, redaction, and data-handling safeguards.
    LLM: suspicious (high) · VirusTotal: · 29 мая 2026 г.