AB unikraft-sandbox
Запускайте задачи агента в изолированной среде Unikraft Cloud (UKC) sandbox VM. Используйте, когда агенту требуется чистая, изолированная среда выполнения — например, для запуска недоверенного кода, тестирования скриптов, воспроизведения проблем сборки или любой задачи, которая не должна выполняться на хосте. Активируется фразами вроде "run this in a sandbox", "spin up a sandbox", "execute in an isolated environment" или в любом случае, когда требуется изоляция. Требует переменных окружения UKC_TOKEN, UKC_METRO, UKC_USER и UKC_SANDBOX_IMAGE.
машинный переводПоказать оригиналСкрыть оригинал«Run agent tasks inside an isolated Unikraft Cloud (UKC) sandbox VM. Us…»
Run agent tasks inside an isolated Unikraft Cloud (UKC) sandbox VM. Use when the agent needs a clean, isolated execution environment — e.g. running untrusted code, testing scripts, reproducing build issues, or any task that should not execute on the host. Triggers on phrases like "run this in a sandbox", "spin up a sandbox", "execute in an isolated environment", or any case where isolation is necessary. Requires UKC_TOKEN, UKC_METRO, UKC_USER, and UKC_SANDBOX_IMAGE env vars.
Запускайте задачи агента в изолированной среде Unikraft Cloud (UKC) sandbox VM.
Как процесс B 70/100 · Почти готов — слабые места: результат и критерий готовности, отчётность по ходу
Как улучшить
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 0
✓ Критических и высоких находок нет
Просканировано файлов: 8. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
✓ По спецификации Agent Skills замечаний нет
Процессный рейтинг: все десять параметров 70/100
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 60Инструменты и файлы. Используются инструменты (web), но во frontmatter они не объявлены
- 70Когда включается. Сказано, когда применять, но не сказано, когда не стоит
- 70Входы и предусловия. Входные данные и предусловия перечислены
- 100Шаги. Шагов: 7
- 100Ошибки и развилки. Развилок: 1, есть раздел про ошибки
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 770 токенов
- 100Повторный запуск. Изменяющие операции проверяют текущее состояние
- low Ответ описан самодельной разметкой (5 тегов): типизированный вызов надёжнее
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- +1Лицензия не указана
- +2Инструкции на одном языке
- +5В description 3 примера фраз-триггеров в кавычках
- +3Длина description 479 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 10 заголовков
- +3Пошаговые инструкции: 7 пунктов
- +4Есть примеры (6 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (1 из 1)
- +3Все 5 скриптов описаны в инструкциях
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 96.