BF agi-evolution-model
此技能作为数字伙伴使用用户的任何问题都可以触发;基于双环架构(两大循环:主循环符号思维 + 次循环行为感知,加超然最外圈)的AGI进化模型,通过意向性分析、人格映射、元认知检测和错误智慧库实现持续自我演进;当用户需要智能对话、人格定制、复杂问题求解或从错误中学习时使用
Как процесс F 35/100 · Не запустится — Скилл ссылается на файлы, которых нет в архиве: LICENSE, scripts/test_phase3.py, scripts/toolnode
Чем это грозит
Находки средней серьёзности: скорее всего скилл честный, но прочитайте, что именно насторожило сканер.
Ниже описан худший случай для этой категории. Здесь находка средней серьёзности: guard увидел признак, но не доказательство.
Скилл содержит команды, которые удаляют файлы, переписывают диски или исполняют код, скачанный из сети. Агент может выполнить их без вопроса, если считает, что так требует инструкция.
Замените разрушительные команды на безопасные аналоги с подтверждением, ограничьте область действия конкретной папкой и не тяните код через curl | bash: укажите версию и контрольную сумму.
Как улучшить
- Скажите в description, КОГДА применять скилл («используй, когда…», примеры запросов): это главный сигнал для агента.
- В тексте есть ссылки на отсутствующие файлы: добавьте файлы или уберите ссылки.
- Свои кейсы (evals/evals.json, 4–6 реальных запросов с ожидаемыми ответами): тогда полная проверка прогонит именно их, а не черновик от модели.
- spec.yaml с триггерными фразами и утверждениями — контракт поведения для CI; `skilltest init` создаст шаблон.
Находки guard · 3
✓ Критических и высоких находок нет
Средние и низкие: 3
-
средняя Опасные команды
cmd-eval-dynamicscripts/perception_node.py:244Динамическое выполнение кода из декодированного/недоверенного вводаreturn eval(compile(tree, "<safe_calc>", "eval"), {"__builtins__": {}}, ns) -
низкая Опасные команды
cmd-privilegescripts/busybox_fallback.py:77Повышение привилегий / права на запись для всех (строковый литерал в коде, не выполняется)"rm -rf ~", "rm -rf /", "sudo rm", "mkfs", "dd if=/dev/",
строка в коде -
низкая Опасные команды
cmd-privilegescripts/verify_toolnode_step2.py:158Повышение привилегий / права на запись для всех (строковый литерал в коде, не выполняется){"group": "exec", "op": "run", "command": "sudo rm -rf /important"})строка в коде
Просканировано файлов: 80. Улики замаскированы. Пометки в серых чипах объясняют, почему серьёзность понижена.
По спецификации Agent Skills
- предупреждение
description-no-whendescription не говорит, КОГДА применять скилл (нет "use when / используй когда") - предупреждение
missing-refссылка на отсутствующий файл: LICENSE - предупреждение
missing-refссылка на отсутствующий файл: scripts/test_phase3.py - предупреждение
missing-refссылка на отсутствующий файл: scripts/toolnode - предупреждение
missing-refссылка на отсутствующий файл: scripts/toolnode.exe - предупреждение
missing-refссылка на отсутствующий файл: scripts/cli_file_operations.py - предупреждение
missing-refссылка на отсутствующий файл: scripts/cli_system_info.py - предупреждение
missing-refссылка на отсутствующий файл: scripts/cli_process_manager.py - предупреждение
missing-refссылка на отсутствующий файл: scripts/cli_executor.py - заметка
frontmatter-keyнеизвестное поле фронтматтера "dependency"
Процессный рейтинг: все десять параметров 35/100
- 0Инструменты и файлы. Не хватает 8 файла(ов): LICENSE, scripts/test_phase3.py, scripts/toolnode
- 0Результат и критерий готовности. Не сказано, что считать результатом
- 0Входы и предусловия. Не сказано, что нужно иметь на входе
- 0Ошибки и развилки. Линейный процесс без обработки сбоев
- 0Отчётность по ходу. Скилл ничего не сообщает по ходу работы
- 20Когда включается. Не сказано, при каком запросе скилл включается
- 100Шаги. Шагов: 201
- 100Согласованность. Имя и обязательные поля на месте
- 100Стоимость исполнения. Тело инструкции 3962 токенов
- 100Повторный запуск. Изменяющих операций нет
- low Разделов верхнего уровня: 14. Похоже на несколько доменов в одном скилле
Всё перечисленное измерено по тексту скилла, а не оценено моделью: цифры проверяемы. Вес параметра тем больше, чем чаще из-за него процесс встаёт.
Сигналы качества
- +5В description нет примеров фраз, по которым скилл должен срабатывать
- +4Описание не говорит, когда скилл НЕ применять (ложные срабатывания)
- +3Формат ответа не описан: модель каждый раз решает сама
- -38 из 42 скриптов не упомянуты в SKILL.md
- +1Лицензия не указана
- +2Инструкции на одном языке
- +3Длина description 134 символов: достаточно сигнала, не съедает бюджет
- +4Структура: 54 заголовков
- +3Пошаговые инструкции: 201 пунктов
- +4Есть примеры (17 блоков кода)
- +4Справочные файлы упоминаются в инструкциях (18 из 18)
База качества 70; замечания lint вычитаются, сигналы прибавляют до 100. Итог: 60.