B cua-driver
Drive a native GUI app (macOS, Windows, Linux) via the cua-driver CLI (default) or MCP server; snapshot its accessibility tree, click/type/scroll by element_index or pixel coordinates, and verify via re-snapshot without bringing the target to the foreground. Use when the user asks you to operate, drive, automate, or perform a GUI task in a real application on the host.
B
87/100
Общая оценка
- Безопасность 60%
- Качество 40%
- Тесты бонус
Как улучшить
- Тело SKILL.md длиннее 5 000 токенов: вынесите справочные детали в references/ и подключайте по необходимости.
- Добавьте evals/evals.json с 4–6 реальными запросами и ожидаемыми ответами: тогда полная проверка использует ваши кейсы, а не черновик модели.
- Добавьте spec.yaml с триггерами и утверждениями (skilltest init): это контракт поведения для CI.
Находки guard · 1
✓ Критических и высоких находок нет
Средние и низкие: 1
-
низкая Утечка данных
intent-browser-credential-storeBROWSER.md:122Доступ к хранилищу паролей / cookies браузера (с отрицанием — текст это запрещает)- edit Chromium `Preferences`, `Local State`, or profile files;
с отрицанием
Просканировано файлов: 9. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
Lint
- предупреждение
body-longтело SKILL.md ≈ 12592 токенов (рекомендуется < 5000); вынесите детали в references/
Процессная зрелость 59/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 40Согласованность. Имя во frontmatter (cua-driver) не совпадает с папкой (driver)
- 40Стоимость исполнения. Тело инструкции 12592 токенов: вытесняет саму задачу из окна
- 60Инструменты и файлы. Используются инструменты (bash), но во frontmatter они не объявлены
- 100Шаги. Шагов: 53
- 100Когда включается. Сказано, когда применять и когда не применять
- 100Ошибки и развилки. Развилок: 2, есть раздел про ошибки
- 100Повторный запуск. Изменяющие операции проверяют текущее состояние
- 100Отчётность по ходу. Скилл сообщает о ходе работы
- medium Правила безопасности и запреты внутри скилла: их место в системном промпте, здесь они не защищают
- low Разделов верхнего уровня: 18. Похоже на несколько доменов в одном скилле
- low Ответ описан самодельной разметкой (5 тегов): типизированный вызов надёжнее
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- -2Ссылки на localhost: у другого пользователя не заработает
- -221 эмодзи в инструкциях: шум для модели
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 371 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 25 заголовков
- +3Пошаговые инструкции: 53 пунктов
- +4Есть примеры (7 блоков кода)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 70.
Внешние проверки
ClawHub: suspicious
The skill is coherent desktop automation, but it deserves Review because it grants high-impact screen/control authority and includes risky install and bypass modes that are not strongly user-gated.
LLM: suspicious (high) · 22 июл. 2026 г.